> ## Documentation Index
> Fetch the complete documentation index at: https://docs2.openclaw.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Baseten

[Baseten-Modell-APIs](https://docs.baseten.co/inference/model-apis/overview) bieten gehosteten, OpenAI-kompatiblen Zugriff auf Frontier-Modelle. Das offizielle externe Plugin verwendet authentifizierte Erkennung, sodass OpenClaw den vollständigen Modellsatz übernimmt, der für Ihr Baseten-Konto aktiviert ist. Der Offline-Fallback enthält jede Modell-API, die beim Erstellen dieser OpenClaw-Version verfügbar war.

| Eigenschaft                          | Wert                                                      |
| ------------------------------------ | --------------------------------------------------------- |
| Provider-ID                          | `baseten`                                                 |
| Plugin                               | offizielles externes Paket (`@openclaw/baseten-provider`) |
| Authentifizierungs-Umgebungsvariable | `BASETEN_API_KEY`                                         |
| Onboarding-Flag                      | `--auth-choice baseten-api-key`                           |
| Direktes CLI-Flag                    | `--baseten-api-key <key>`                                 |
| API                                  | OpenAI-kompatibel (`openai-completions`)                  |
| Basis-URL                            | `https://inference.baseten.co/v1`                         |
| Standardmodell                       | `baseten/thinkingmachines/inkling`                        |

## Plugin installieren

```bash theme={"theme":{"light":"min-light","dark":"min-dark"}}
openclaw plugins install @openclaw/baseten-provider
openclaw gateway restart
```

## Erste Schritte

<Steps>
  <Step title="Baseten-Konto und API-Schlüssel erstellen">
    Für den Basic-Tarif von Baseten fällt keine monatliche Plattformgebühr an; Modell-API-Aufrufe werden nutzungsabhängig berechnet. Erstellen Sie unter [Baseten API key settings](https://app.baseten.co/settings/api_keys) einen Schlüssel und prüfen Sie die aktuellen Preise auf der [Preisseite](https://www.baseten.co/pricing).
  </Step>

  <Step title="Onboarding ausführen">
    <CodeGroup>
      ```bash Onboarding theme={"theme":{"light":"min-light","dark":"min-dark"}}
      openclaw onboard --auth-choice baseten-api-key
      ```

      ```bash Direct flag theme={"theme":{"light":"min-light","dark":"min-dark"}}
      openclaw onboard --non-interactive \
        --auth-choice baseten-api-key \
        --baseten-api-key "$BASETEN_API_KEY"
      ```

      ```bash Env only theme={"theme":{"light":"min-light","dark":"min-dark"}}
      export BASETEN_API_KEY=...
      ```
    </CodeGroup>
  </Step>

  <Step title="Live-Katalog überprüfen">
    ```bash theme={"theme":{"light":"min-light","dark":"min-dark"}}
    openclaw models list --provider baseten
    ```

    Bei verwendbarer Authentifizierung fordert das Plugin `GET /v1/models` an und listet jedes für das Konto zurückgegebene Modell auf. Ohne Authentifizierung bleibt es offline und verwendet den gebündelten Fallback.
  </Step>
</Steps>

## Inkling

[Inkling von Thinking Machines Lab](https://thinkingmachines.ai/news/introducing-inkling/) ist das Standardmodell. In OpenClaw unterstützt es Text- und Bildeingaben, Tool-Aufrufe, strukturierte Tool-Schemata, konfigurierbaren Reasoning-Aufwand, ein Kontextfenster mit 1.048M Token und bis zu 32k Ausgabe-Token:

```json5 theme={"theme":{"light":"min-light","dark":"min-dark"}}
{
  agents: {
    defaults: {
      model: { primary: "baseten/thinkingmachines/inkling" },
    },
  },
}
```

Verwenden Sie `/model baseten/thinkingmachines/inkling`, um einen bestehenden Chat umzustellen.

## Gebündelter Fallback-Katalog

Der authentifizierte Live-Katalog ist maßgeblich. Diese Zeilen sorgen dafür, dass Einrichtung und Modellauswahl auch vor erfolgreicher Erkennung nutzbar bleiben:

| Modellreferenz                                     | Eingabe    | Kontext | Max. Ausgabe |
| -------------------------------------------------- | ---------- | ------: | -----------: |
| `baseten/deepseek-ai/DeepSeek-V4-Pro`              | Text       |    262k |         262k |
| `baseten/zai-org/GLM-4.7`                          | Text       |    200k |         200k |
| `baseten/zai-org/GLM-5`                            | Text       |    202k |         202k |
| `baseten/zai-org/GLM-5.1`                          | Text       |    202k |         202k |
| `baseten/zai-org/GLM-5.2`                          | Text       |    202k |         202k |
| `baseten/thinkingmachines/inkling`                 | Text, Bild |  1.048M |          32k |
| `baseten/moonshotai/Kimi-K2.5`                     | Text, Bild |    262k |         262k |
| `baseten/moonshotai/Kimi-K2.6`                     | Text, Bild |    262k |         262k |
| `baseten/moonshotai/Kimi-K2.7-Code`                | Text, Bild |    262k |         262k |
| `baseten/nvidia/Nemotron-120B-A12B`                | Text       |    202k |         202k |
| `baseten/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B` | Text       |    202k |         202k |
| `baseten/openai/gpt-oss-120b`                      | Text       |    128k |         128k |

Alle gebündelten Modelle unterstützen Tool-Aufrufe und Reasoning. OpenClaw ordnet seine Denkstufen Modellen mit nativem `reasoning_effort` zu. Bei den optional aktivierbaren GLM-, Kimi- und Nemotron-Modellen von Baseten ist das Denken standardmäßig deaktiviert; die meisten bieten eine binäre Aus-/Ein-Steuerung, während GLM 5.2 die Stufen Aus, Hoch und Maximum bietet. OpenClaw übermittelt diese Auswahl über Basetens `chat_template_args.enable_thinking`-Steuerung und bei GLM 5.2 über den validierten Top-Level-Parameter `reasoning_effort`.

<Note>
  Baseten kann Modell-APIs unabhängig von OpenClaw-Versionen hinzufügen, entfernen oder ändern. Das Plugin aktualisiert Modell-IDs, Kontextlimits, Ausgabelimits sowie die Preise für Eingabe, zwischengespeicherte Eingabe und Ausgabe über die authentifizierte API, während die modellspezifische OpenClaw-Transportrichtlinie beibehalten wird.
</Note>

## Manuelle Konfiguration

Für die meisten Einrichtungen ist nur der API-Schlüssel erforderlich. So legen Sie den Provider explizit fest:

```json5 theme={"theme":{"light":"min-light","dark":"min-dark"}}
{
  env: { BASETEN_API_KEY: "..." },
  agents: {
    defaults: {
      model: { primary: "baseten/thinkingmachines/inkling" },
    },
  },
  models: {
    mode: "merge",
    providers: {
      baseten: {
        baseUrl: "https://inference.baseten.co/v1",
        apiKey: "${BASETEN_API_KEY}",
        api: "openai-completions",
        models: [
          {
            id: "thinkingmachines/inkling",
            name: "Inkling",
            reasoning: true,
            input: ["text", "image"],
            contextWindow: 1048000,
            maxTokens: 32000,
          },
        ],
      },
    },
  },
}
```

<Note>
  Wenn das Gateway als Daemon ausgeführt wird (launchd, systemd, Docker), stellen Sie sicher, dass `BASETEN_API_KEY` für diesen Prozess verfügbar ist. Ein Schlüssel, der nur in einer interaktiven Shell exportiert wurde, ist für einen bereits ausgeführten verwalteten Dienst nicht sichtbar.
</Note>

## Verwandte Themen

<CardGroup cols={2}>
  <Card title="Modell-Provider" href="/de/concepts/model-providers" icon="layers">
    Auswahl von Providern, Modellreferenzen und Failover-Verhalten.
  </Card>

  <Card title="Denkmodi" href="/de/tools/thinking" icon="brain">
    Wählen Sie die Reasoning-Aufwandsstufen von OpenClaw aus.
  </Card>

  <Card title="Modell-CLI" href="/de/cli/models" icon="terminal">
    Erkannte Modelle auflisten, untersuchen und auswählen.
  </Card>

  <Card title="Modell-FAQ" href="/de/help/faq-models" icon="circle-question">
    Fehlerbehebung bei Authentifizierungsprofilen und der Modellauswahl.
  </Card>
</CardGroup>
