So funktioniert ClawAI
Von der Kontoerstellung bis zum Lesen einer Antwort, und alles dazwischen: wie ein Modell ausgewählt wird, womit es arbeitet und wie Ihre Nutzung gezählt wird.
Zuletzt geprüft 2026-07-25
Das Ganze in acht Schritten
Jeder dieser Schritte hat weiter unten einen eigenen Abschnitt.
Konto erstellen. eine E-Mail-Adresse und ein Passwort. Der kostenlose Tarif startet sofort, ohne dass eine Karte erforderlich ist.
Tarif wählen. kostenlos zum Einstieg; kostenpflichtige Tarife ab 5 $ im Monat erhöhen Ihr Kontingent und schalten die größeren Modelle sowie die Mehrmodell-Modi frei.
Unterhaltung beginnen. eine Nachricht eingeben, optional Dateien anhängen und entweder ein Modell wählen oder es auf Auto belassen.
ClawAI wählt das Modell. die Nachricht wird klassifiziert und an ein Modell weitergeleitet, das diese Art von Arbeit gut bewältigt.
Der Kontext wird zusammengestellt. relevante Erinnerungen, angehängte Kontextpakete und die wichtigen Teile Ihrer Dateien werden dem Prompt hinzugefügt.
Die Antwort wird zurückgestreamt. Text trifft ein, während er erzeugt wird, mit Zeitmessung in Echtzeit und, sofern das Modell dies offenlegt, seinem Denkprozess.
Sie sehen, was passiert ist. welches Modell geantwortet hat, warum es gewählt wurde, was es gekostet hat und genau, welcher Kontext ihm mitgegeben wurde.
Die Nutzung wird gezählt. die Kosten werden in kostennormalisierten Token gegen Ihr Kontingent verrechnet und auf Ihrer Nutzungsseite angezeigt.
Ein Konto erstellen und einen Tarif wählen
Registrierung
Eine E-Mail-Adresse und ein Passwort reichen aus. Es gibt kein Anbieterkonto zu erstellen, keinen API-Schlüssel einzufügen und nichts zu installieren – ClawAI pflegt die Anbieterbeziehungen in Ihrem Namen.
Die Tarife
Sieben Stufen, von kostenlos bis Unlimited für 200 $ im Monat. Jeder kostenpflichtige Tarif erreicht jedes Modell; was sich ändert, ist, wie viel Sie nutzen können und welche Mehrmodell-Modi freigeschaltet sind.
- Free — 0 $. Ein kleines tägliches Kontingent, Modelle der Einstiegsstufe und je ein Testlauf für Vergleich, Judge und Recherche.
- Starter 5 $, Plus 10 $, Pro 20 $ im Monat. Steigende Kontingente, mit Premium-Modellen und größeren Vergleichs- und Judge-Kontingenten, je höher Sie gehen.
- Team 50 $, Scale 100 $ im Monat. Unbegrenzt Vergleich, Judge, Kritiker und Recherche, plus deutlich mehr Workspace-Verbindungen.
- Unlimited 200 $ im Monat. Unbegrenzte Unterhaltungen und Nachrichten, mit einer Fair-Use-Grenze bei Premium-Modellen, vor deren Erreichen Sie gewarnt werden.
Zahlen Sie jährlich, zahlen Sie nur für zehn statt zwölf Monate. Sie können den Tarif jederzeit wechseln oder kündigen – ein Upgrade gilt sofort, ein Downgrade zu Beginn Ihres nächsten Abrechnungszeitraums.
Die Modelle, die Sie erreichen können
Ein Abonnement, jede Familie unten. Sie können innerhalb einer einzigen Unterhaltung zwischen ihnen wechseln.
- Anthropic Claude
- Sorgfältiges Schlussfolgern, lange Dokumente und die zuverlässigsten Code-Reviews im Angebot.
- Claude Opus 5 · Claude Sonnet 5 · Claude Fable 5
- OpenAI GPT
- Breite Allgemeinfähigkeit mit starker Tool-Nutzung und strukturierter Ausgabe.
- GPT-5 · GPT-5 mini
- Google Gemini
- Riesige Kontextfenster, schnelle Antworten und native Eingabe von Bild, Audio und Video.
- Gemini 3 Pro · Gemini 3 Flash
- Moonshot Kimi
- Analyse mit langem Kontext und agentische Arbeit zu niedrigen Kosten.
- Kimi K2
- Zhipu GLM
- Starkes zweisprachiges Schlussfolgern mit einem expliziten Denkmodus.
- GLM-5.1
- Alibaba Qwen
- Exzellente Code-Generierung über eine breite Palette an Modellgrößen.
- Qwen3
- DeepSeek
- Mathematik, Algorithmen und schrittweise Herleitungen.
- DeepSeek V3.2
- xAI Grok
- Schnelle konversationelle Antworten mit Bewusstsein für aktuelle Ereignisse.
- Grok 4
- Amazon Bedrock
- Auf AWS gehostete Modelle für Teams, die bereits auf Amazon standardisiert sind.
- Nova Pro · Bedrock-hosted Claude
Welche Modelle ein Tarif erreicht, hängt von der Stufe ab: Einstiegsmodelle bei Free, alles inklusive der größten Spitzenmodelle ab Pro aufwärts. Neue Modelle werden hinzugefügt, sobald Anbieter sie veröffentlichen.
Wie ClawAI entscheidet, welches Modell antwortet
Im Auto-Modus wird jede Nachricht vor dem Versand klassifiziert. Das sind die Kategorien, die das Ergebnis am stärksten verändern:
- Code
- Schreiben, Überprüfen, Refactoring oder Debuggen von Code geht an die Modelle mit der stärksten Code-Bilanz.
- Komplexes Schlussfolgern
- mehrstufige Probleme, Beweise, Architekturentscheidungen und alles, wo ein Fehler teuer ist.
- Schreiben
- Entwerfen, Bearbeiten und Umschreiben, wo Ton und Lesbarkeit mehr zählen als reine Schlussfolgerungstiefe.
- Daten und Dokumente
- lange Eingaben, Tabellenkalkulationen und Berichte, geleitet an die Modelle mit den größten Kontextfenstern.
- Bilder
- Anfragen zum Erzeugen oder Interpretieren eines Bildes gehen an ein Modell, das tatsächlich mit Pixeln umgehen kann.
- Alltagsfragen
- kurze Sachfragen und schnelle Korrekturen gehen an ein schnelles, günstiges Modell – die meisten Nachrichten landen hier.
Sie können es jederzeit übersteuern
Wählen Sie ein Modell aus der Auswahl, und es wird für diese Unterhaltung verwendet, bis Sie es ändern. Sie können Auto auch zugunsten von Geschwindigkeit, Denktiefe oder Kosten gewichten, was die Klassifizierung pro Nachricht beibehält, aber ändert, worauf sie optimiert. Was immer Sie wählen, die Antwort verrät Ihnen, welches Modell sie erzeugt hat.
Mehr als ein Modell gleichzeitig nutzen
Für Arbeiten, bei denen eine Antwort nicht ausreicht, schalten kostenpflichtige Tarife Modi frei, die mehrere Modelle auf denselben Prompt ansetzen.
- Vergleich
- ein Prompt an bis zu fünf Modelle, Antworten nebeneinander, mit Latenz und Token-Anzahl für jedes.
- Konsens
- mehrere Modelle antworten, und ClawAI leitet eine Antwort aus ihrer Übereinstimmung ab, während markiert wird, wo sie nicht übereinstimmen.
- Eskalation
- beginnen Sie günstig und schnell, und eskalieren Sie automatisch zu einem stärkeren Modell, nur wenn die Antwort nicht gut genug ist.
- Best-of-N
- erzeugen Sie mehrere Kandidaten und behalten Sie den mit der höchsten Bewertung.
- Judge und Kritiker
- ein unabhängiges Modell bewertet die Antwort anhand expliziter Kriterien, und ein Kritiker-Durchgang schreibt aus, was schwach ist und warum.
Free gibt Ihnen je einen Testlauf für Vergleich, Judge und Recherche. Kostenpflichtige Tarife haben monatliche Kontingente, die mit der Stufe steigen, und ab Team aufwärts sind sie unbegrenzt. Reparatur, Verifikation, Rollenpakete und Pipelines runden das Angebot in den höheren Tarifen ab.
Was das Modell außer Ihrer Nachricht noch erhält
Drei Schichten dauerhaften Kontexts können in einen Prompt eingebaut werden, alle unter Ihrer Kontrolle.
- Gedächtnis
- Fakten, Präferenzen und Anweisungen, die es wert sind, zwischen Unterhaltungen mitgeführt zu werden. Kandidaten gehen in eine Genehmigungswarteschlange, statt stillschweigend gespeichert zu werden.
- Kontextpakete
- benannte Bündel aus wiederverwendbarem Text, Dateien, Links und Gedächtnisverweisen, die Sie an eine Unterhaltung anhängen, wenn sie relevant sind.
- Dateien
- hochgeladene Dokumente werden in Abschnitte zerlegt und indexiert, sodass nur die für Ihre Frage relevanten Passagen einbezogen werden.
Gedächtnis und Kontext sind Schalter pro Unterhaltung. Sind sie aktiviert, trägt die Antwort einen Beleg, der genau auflistet, welche Erinnerungen, Paketelemente und Datei-Abschnitte verwendet wurden und wie viel vom Token-Budget jedes davon beansprucht hat.
Was Ihnen jede Antwort verrät
Routing, das Sie nicht einsehen können, ist nur eine Blackbox mit besserem Marketing. Jede Antwort trägt ihren eigenen Beleg.
- Das Modell
- der Anbieter und die genaue Modellversion, die die Antwort erzeugt hat, einschließlich wann ein Fallback für die erste Wahl eingesprungen ist.
- Warum dieses Modell
- die Klassifizierung, der Konfidenzwert und die Gründe hinter der Routing-Entscheidung.
- Was es gekostet hat
- Eingabe- und Ausgabe-Token, Latenz und das in kostennormalisierten Einheiten abgezogene Kontingent.
- Was es gesehen hat
- die Erinnerungen, Kontextpaket-Elemente und Datei-Abschnitte, die in den Prompt eingebaut wurden, in der Reihenfolge, in der sie erschienen.
- Wo Sie stehen
- Ihre Nutzungsseite fasst alles zu täglichen und monatlichen Salden zusammen, aufgeschlüsselt nach Modell.
All das ist sichtbar, sobald Sie die Antwort lesen, nicht in einem Bericht, den Sie anfordern müssten.
Wie die Nutzung gezählt wird
Eine Kennzahl deckt jedes Modell ab, und sie bleibt fair über Modelle hinweg, deren Preise sich um mehr als eine Größenordnung unterscheiden.
Kostennormalisierte Token
Ein Token von einem teuren Spitzenmodell zehrt Ihr Kontingent stärker an als ein Token von einem günstigen, schnellen Modell, im Verhältnis zu dem, was es tatsächlich kostet. So funktioniert eine einzige Kontingentzahl, welches Modell Sie auch nutzen, und Sie werden nie dafür bestraft, das richtige Werkzeug für die Aufgabe zu wählen.
- Leichte Modelle
- schnelle, günstige Modelle zehren langsam. Ein Tag mit kurzen Fragen bewegt die Zahl kaum.
- Modelle der mittleren Stufe
- die Allzweck-Arbeitspferde liegen in der Mitte. Hier landet der Großteil der andauernden Arbeit.
- Spitzenmodelle
- die größten Denkmodelle zehren am schnellsten. Lohnenswert für schwierige Probleme, verschwenderisch für Small Talk – genau dafür ist Auto-Routing da.
Die Zeitfenster
- Täglich
- wird alle 24 Stunden zurückgesetzt, sodass ein intensiver Tag nie den Rest des Monats verdirbt.
- Wöchentlich
- gleicht Ausschläge in den höheren Stufen aus, wo ein tägliches Limit allein zu grob wäre.
- Monatlich
- die Hauptkennzahl Ihres Tarifs, die sich mit Ihrem Abrechnungszeitraum zurücksetzt.
Sie können den Saldo aller drei Zeitfenster jederzeit einsehen. Erreichen Sie eines, teilt ClawAI Ihnen mit, welches Limit es war, wie viel auf den anderen übrig ist und wann es zurückgesetzt wird.
Im Unlimited-Tarif haben Unterhaltungen und Nachrichten wirklich keine Obergrenze. Premium-Spitzenmodelle unterliegen einer Fair-Use-Grenze, damit ein einzelnes Konto keine unbegrenzten Anbieterkosten verursachen kann – Sie werden klar informiert, sobald Sie sich ihr nähern, nie ohne Vorwarnung abgeschnitten.
Für Unternehmen
Wenn Ihr Unternehmen keine Daten an einen externen Modellanbieter senden darf, kann ClawAI innerhalb Ihres eigenen Netzwerks bereitgestellt werden, mit offenen Modellen auf Ihrer eigenen Hardware. Nichts verlässt Ihre Infrastruktur. Das wird pro Projekt abgestimmt, nicht als Tarif verkauft.
Mit dem kostenlosen Tarif starten
Eine Minute zum Anmelden, keine Karte erforderlich. Stellen Sie ein paar Fragen, führen Sie einen Vergleich durch, und sehen Sie, ob sich das Routing bezahlt macht.