Zum Hauptinhalt springen

So funktioniert ClawAI

Von der Kontoerstellung bis zum Lesen einer Antwort, und alles dazwischen: wie ein Modell ausgewählt wird, womit es arbeitet und wie Ihre Nutzung gezählt wird.

Zuletzt geprüft 2026-07-25

Das Ganze in acht Schritten

Jeder dieser Schritte hat weiter unten einen eigenen Abschnitt.

  1. Konto erstellen. eine E-Mail-Adresse und ein Passwort. Der kostenlose Tarif startet sofort, ohne dass eine Karte erforderlich ist.

  2. Tarif wählen. kostenlos zum Einstieg; kostenpflichtige Tarife ab 5 $ im Monat erhöhen Ihr Kontingent und schalten die größeren Modelle sowie die Mehrmodell-Modi frei.

  3. Unterhaltung beginnen. eine Nachricht eingeben, optional Dateien anhängen und entweder ein Modell wählen oder es auf Auto belassen.

  4. ClawAI wählt das Modell. die Nachricht wird klassifiziert und an ein Modell weitergeleitet, das diese Art von Arbeit gut bewältigt.

  5. Der Kontext wird zusammengestellt. relevante Erinnerungen, angehängte Kontextpakete und die wichtigen Teile Ihrer Dateien werden dem Prompt hinzugefügt.

  6. Die Antwort wird zurückgestreamt. Text trifft ein, während er erzeugt wird, mit Zeitmessung in Echtzeit und, sofern das Modell dies offenlegt, seinem Denkprozess.

  7. Sie sehen, was passiert ist. welches Modell geantwortet hat, warum es gewählt wurde, was es gekostet hat und genau, welcher Kontext ihm mitgegeben wurde.

  8. Die Nutzung wird gezählt. die Kosten werden in kostennormalisierten Token gegen Ihr Kontingent verrechnet und auf Ihrer Nutzungsseite angezeigt.

Ein Konto erstellen und einen Tarif wählen

Registrierung

Eine E-Mail-Adresse und ein Passwort reichen aus. Es gibt kein Anbieterkonto zu erstellen, keinen API-Schlüssel einzufügen und nichts zu installieren – ClawAI pflegt die Anbieterbeziehungen in Ihrem Namen.

Die Tarife

Sieben Stufen, von kostenlos bis Unlimited für 200 $ im Monat. Jeder kostenpflichtige Tarif erreicht jedes Modell; was sich ändert, ist, wie viel Sie nutzen können und welche Mehrmodell-Modi freigeschaltet sind.

  • Free — 0 $. Ein kleines tägliches Kontingent, Modelle der Einstiegsstufe und je ein Testlauf für Vergleich, Judge und Recherche.
  • Starter 5 $, Plus 10 $, Pro 20 $ im Monat. Steigende Kontingente, mit Premium-Modellen und größeren Vergleichs- und Judge-Kontingenten, je höher Sie gehen.
  • Team 50 $, Scale 100 $ im Monat. Unbegrenzt Vergleich, Judge, Kritiker und Recherche, plus deutlich mehr Workspace-Verbindungen.
  • Unlimited 200 $ im Monat. Unbegrenzte Unterhaltungen und Nachrichten, mit einer Fair-Use-Grenze bei Premium-Modellen, vor deren Erreichen Sie gewarnt werden.

Zahlen Sie jährlich, zahlen Sie nur für zehn statt zwölf Monate. Sie können den Tarif jederzeit wechseln oder kündigen – ein Upgrade gilt sofort, ein Downgrade zu Beginn Ihres nächsten Abrechnungszeitraums.

Die Modelle, die Sie erreichen können

Ein Abonnement, jede Familie unten. Sie können innerhalb einer einzigen Unterhaltung zwischen ihnen wechseln.

Anthropic Claude
Sorgfältiges Schlussfolgern, lange Dokumente und die zuverlässigsten Code-Reviews im Angebot.
Claude Opus 5 · Claude Sonnet 5 · Claude Fable 5
OpenAI GPT
Breite Allgemeinfähigkeit mit starker Tool-Nutzung und strukturierter Ausgabe.
GPT-5 · GPT-5 mini
Google Gemini
Riesige Kontextfenster, schnelle Antworten und native Eingabe von Bild, Audio und Video.
Gemini 3 Pro · Gemini 3 Flash
Moonshot Kimi
Analyse mit langem Kontext und agentische Arbeit zu niedrigen Kosten.
Kimi K2
Zhipu GLM
Starkes zweisprachiges Schlussfolgern mit einem expliziten Denkmodus.
GLM-5.1
Alibaba Qwen
Exzellente Code-Generierung über eine breite Palette an Modellgrößen.
Qwen3
DeepSeek
Mathematik, Algorithmen und schrittweise Herleitungen.
DeepSeek V3.2
xAI Grok
Schnelle konversationelle Antworten mit Bewusstsein für aktuelle Ereignisse.
Grok 4
Amazon Bedrock
Auf AWS gehostete Modelle für Teams, die bereits auf Amazon standardisiert sind.
Nova Pro · Bedrock-hosted Claude

Welche Modelle ein Tarif erreicht, hängt von der Stufe ab: Einstiegsmodelle bei Free, alles inklusive der größten Spitzenmodelle ab Pro aufwärts. Neue Modelle werden hinzugefügt, sobald Anbieter sie veröffentlichen.

Wie ClawAI entscheidet, welches Modell antwortet

Im Auto-Modus wird jede Nachricht vor dem Versand klassifiziert. Das sind die Kategorien, die das Ergebnis am stärksten verändern:

Code
Schreiben, Überprüfen, Refactoring oder Debuggen von Code geht an die Modelle mit der stärksten Code-Bilanz.
Komplexes Schlussfolgern
mehrstufige Probleme, Beweise, Architekturentscheidungen und alles, wo ein Fehler teuer ist.
Schreiben
Entwerfen, Bearbeiten und Umschreiben, wo Ton und Lesbarkeit mehr zählen als reine Schlussfolgerungstiefe.
Daten und Dokumente
lange Eingaben, Tabellenkalkulationen und Berichte, geleitet an die Modelle mit den größten Kontextfenstern.
Bilder
Anfragen zum Erzeugen oder Interpretieren eines Bildes gehen an ein Modell, das tatsächlich mit Pixeln umgehen kann.
Alltagsfragen
kurze Sachfragen und schnelle Korrekturen gehen an ein schnelles, günstiges Modell – die meisten Nachrichten landen hier.

Sie können es jederzeit übersteuern

Wählen Sie ein Modell aus der Auswahl, und es wird für diese Unterhaltung verwendet, bis Sie es ändern. Sie können Auto auch zugunsten von Geschwindigkeit, Denktiefe oder Kosten gewichten, was die Klassifizierung pro Nachricht beibehält, aber ändert, worauf sie optimiert. Was immer Sie wählen, die Antwort verrät Ihnen, welches Modell sie erzeugt hat.

Mehr als ein Modell gleichzeitig nutzen

Für Arbeiten, bei denen eine Antwort nicht ausreicht, schalten kostenpflichtige Tarife Modi frei, die mehrere Modelle auf denselben Prompt ansetzen.

Vergleich
ein Prompt an bis zu fünf Modelle, Antworten nebeneinander, mit Latenz und Token-Anzahl für jedes.
Konsens
mehrere Modelle antworten, und ClawAI leitet eine Antwort aus ihrer Übereinstimmung ab, während markiert wird, wo sie nicht übereinstimmen.
Eskalation
beginnen Sie günstig und schnell, und eskalieren Sie automatisch zu einem stärkeren Modell, nur wenn die Antwort nicht gut genug ist.
Best-of-N
erzeugen Sie mehrere Kandidaten und behalten Sie den mit der höchsten Bewertung.
Judge und Kritiker
ein unabhängiges Modell bewertet die Antwort anhand expliziter Kriterien, und ein Kritiker-Durchgang schreibt aus, was schwach ist und warum.

Free gibt Ihnen je einen Testlauf für Vergleich, Judge und Recherche. Kostenpflichtige Tarife haben monatliche Kontingente, die mit der Stufe steigen, und ab Team aufwärts sind sie unbegrenzt. Reparatur, Verifikation, Rollenpakete und Pipelines runden das Angebot in den höheren Tarifen ab.

Was das Modell außer Ihrer Nachricht noch erhält

Drei Schichten dauerhaften Kontexts können in einen Prompt eingebaut werden, alle unter Ihrer Kontrolle.

Gedächtnis
Fakten, Präferenzen und Anweisungen, die es wert sind, zwischen Unterhaltungen mitgeführt zu werden. Kandidaten gehen in eine Genehmigungswarteschlange, statt stillschweigend gespeichert zu werden.
Kontextpakete
benannte Bündel aus wiederverwendbarem Text, Dateien, Links und Gedächtnisverweisen, die Sie an eine Unterhaltung anhängen, wenn sie relevant sind.
Dateien
hochgeladene Dokumente werden in Abschnitte zerlegt und indexiert, sodass nur die für Ihre Frage relevanten Passagen einbezogen werden.

Gedächtnis und Kontext sind Schalter pro Unterhaltung. Sind sie aktiviert, trägt die Antwort einen Beleg, der genau auflistet, welche Erinnerungen, Paketelemente und Datei-Abschnitte verwendet wurden und wie viel vom Token-Budget jedes davon beansprucht hat.

Was Ihnen jede Antwort verrät

Routing, das Sie nicht einsehen können, ist nur eine Blackbox mit besserem Marketing. Jede Antwort trägt ihren eigenen Beleg.

Das Modell
der Anbieter und die genaue Modellversion, die die Antwort erzeugt hat, einschließlich wann ein Fallback für die erste Wahl eingesprungen ist.
Warum dieses Modell
die Klassifizierung, der Konfidenzwert und die Gründe hinter der Routing-Entscheidung.
Was es gekostet hat
Eingabe- und Ausgabe-Token, Latenz und das in kostennormalisierten Einheiten abgezogene Kontingent.
Was es gesehen hat
die Erinnerungen, Kontextpaket-Elemente und Datei-Abschnitte, die in den Prompt eingebaut wurden, in der Reihenfolge, in der sie erschienen.
Wo Sie stehen
Ihre Nutzungsseite fasst alles zu täglichen und monatlichen Salden zusammen, aufgeschlüsselt nach Modell.

All das ist sichtbar, sobald Sie die Antwort lesen, nicht in einem Bericht, den Sie anfordern müssten.

Wie die Nutzung gezählt wird

Eine Kennzahl deckt jedes Modell ab, und sie bleibt fair über Modelle hinweg, deren Preise sich um mehr als eine Größenordnung unterscheiden.

Kostennormalisierte Token

Ein Token von einem teuren Spitzenmodell zehrt Ihr Kontingent stärker an als ein Token von einem günstigen, schnellen Modell, im Verhältnis zu dem, was es tatsächlich kostet. So funktioniert eine einzige Kontingentzahl, welches Modell Sie auch nutzen, und Sie werden nie dafür bestraft, das richtige Werkzeug für die Aufgabe zu wählen.

Leichte Modelle
schnelle, günstige Modelle zehren langsam. Ein Tag mit kurzen Fragen bewegt die Zahl kaum.
Modelle der mittleren Stufe
die Allzweck-Arbeitspferde liegen in der Mitte. Hier landet der Großteil der andauernden Arbeit.
Spitzenmodelle
die größten Denkmodelle zehren am schnellsten. Lohnenswert für schwierige Probleme, verschwenderisch für Small Talk – genau dafür ist Auto-Routing da.

Die Zeitfenster

Täglich
wird alle 24 Stunden zurückgesetzt, sodass ein intensiver Tag nie den Rest des Monats verdirbt.
Wöchentlich
gleicht Ausschläge in den höheren Stufen aus, wo ein tägliches Limit allein zu grob wäre.
Monatlich
die Hauptkennzahl Ihres Tarifs, die sich mit Ihrem Abrechnungszeitraum zurücksetzt.

Sie können den Saldo aller drei Zeitfenster jederzeit einsehen. Erreichen Sie eines, teilt ClawAI Ihnen mit, welches Limit es war, wie viel auf den anderen übrig ist und wann es zurückgesetzt wird.

Im Unlimited-Tarif haben Unterhaltungen und Nachrichten wirklich keine Obergrenze. Premium-Spitzenmodelle unterliegen einer Fair-Use-Grenze, damit ein einzelnes Konto keine unbegrenzten Anbieterkosten verursachen kann – Sie werden klar informiert, sobald Sie sich ihr nähern, nie ohne Vorwarnung abgeschnitten.

Für Unternehmen

Wenn Ihr Unternehmen keine Daten an einen externen Modellanbieter senden darf, kann ClawAI innerhalb Ihres eigenen Netzwerks bereitgestellt werden, mit offenen Modellen auf Ihrer eigenen Hardware. Nichts verlässt Ihre Infrastruktur. Das wird pro Projekt abgestimmt, nicht als Tarif verkauft.

Mit dem kostenlosen Tarif starten

Eine Minute zum Anmelden, keine Karte erforderlich. Stellen Sie ein paar Fragen, führen Sie einen Vergleich durch, und sehen Sie, ob sich das Routing bezahlt macht.