GRACE Die Arbeit bleibt auf deinem Rechner. Ein Bruchteil deiner Claude-Token.

Lokaler Coding-Agent

Die Arbeit bleibt auf deinem Rechner.
Ein Bruchteil deiner Claude-Token.

Grace läuft auf deinem eigenen Rechner und macht die Arbeit selbst. Claude wird nur für die Schritte gerufen, die es wirklich brauchen — das Ergebnis ist dasselbe, dein Kontingent reicht viel länger.

97 %

weniger zahlst du Anthropic, wenn du je Token zahlst

Gemessen am 22. September 2026 an 19 Aufgaben, insgesamt 38 Läufe. Eine größere Reihe über 30 Aufgaben läuft gerade und wird diese Zahl ersetzen.

weiter reicht dein Fünf-Stunden-Fenster im Abo

noch nicht gemessen — das Fenster meldet nur ganze Prozentpunkte, und das ist zu grob zum Teilen. Wir messen es stattdessen direkt: ein Fenster mit Aufgaben füllen und zählen, einmal mit Grace und einmal ohne.


Was Grace tut

Du gibst eine Aufgabe. Die Arbeit passiert auf deinem Rechner.

Du gibst Grace eine Aufgabe, so wie du sie Claude Code geben würdest. Grace erledigt sie mit einem Modell, das auf deinem eigenen Rechner läuft — das kostet nichts von deinem Kontingent, also von der Menge Claude Code, die du nutzen kannst, bevor eine Weile Schluss ist. Nur wenn ein Schritt nicht abzuschließen oder nicht zu belegen ist, ruft Grace für diesen einen Schritt Claude Code. Danach laufen die Prüfungen deines Projekts gegen die Änderung, und Grace sagt dir, was sie belegen konnte und was nicht.

  • Läuft auf deinem Rechner Dein Kontingent bleibt unangetastet.
  • Ruft das große Modell selten Nur für Schritte, die das lokale nicht schafft oder nicht belegen kann.
  • Sagt, was es belegen kann Und sagt es auch, wenn es nichts belegen kann.

Die Lage

Drei Dinge gehen mit Coding-Agenten schief.

Das erste trifft dich mitten im Satz. Du bist mitten in etwas, das Kontingent ist leer, und es bleibt nur warten. Dir sind nicht die Ideen ausgegangen, sondern das Kontingent.

Das zweite ist die Rechnung. Mehr Spielraum kostet mehr, und jeder Schritt, der an ein großes Modell ging, ging dorthin — ob er es brauchte oder nicht.

Das dritte ist leiser. Eine Änderung gilt als fertig, weil ein Modell das gesagt hat, nicht weil etwas gelaufen ist. Du merkst es später, wenn etwas kaputtgeht.

Wie es funktioniert

Eine Aufgabe, ein Weg, höchstens ein Aufruf auf dein Kontingent.

Grace plant die Aufgabe, lässt das lokale Modell arbeiten, schreibt die Änderung und lässt dann die Prüfungen des Projekts dagegen laufen. An Claude geht ein Schritt aus einem von vier Gründen: der lokale Versuch hielt nicht, die Reparaturschleife dreht sich im Kreis, der Plan war zu unsicher zum blinden Schreiben, oder die Aufgabenart ist eine, in der das lokale Modell messbar schwach ist. Die letzten beiden greifen, bevor überhaupt etwas geschrieben wird.

acme-shop Product demo
  • src/components/Header.astro relevant
  • src/components/MobileNav.astro relevant
  • src/styles/global.css relevant
  • src/layouts/Base.astro read only
  • src/pages/index.astro read only

Grace liest dein Projekt, bevor sie plant. Dateien, die sie nicht anfasst, bleiben unberührt — der Umfang einer Aufgabe wird vor der ersten Änderung entschieden, nicht danach.

Der ganze Ablauf, Schritt für Schritt

Lokal zuerst

Alles, was auf deinem Rechner bleiben kann, bleibt dort.

A task goes to the local model on your machine: it reads the repository, plans, and writes the change. Then your project's own checks run against it. Three things can happen. If a check passed, Grace is done and reports VERIFIED_PASS. If nothing could prove the change, it reports NOT_VERIFIED — a statement, not a failure. If a check failed, that one step goes to Claude, which writes a new change, and the checks run again on that one. A failed check is not the only way a step gets there: Grace also hands one over before writing it, when the plan is too uncertain to write blindly or the task is of a kind the local model is measurably weak at. What it never hands over is the whole task.

durchgezogen · bleibt auf deinem Rechner gepunktet · nichts, was es belegen könnte gestrichelt · verlässt deinen Rechner


Im Terminal

So sieht eine echte Aufgabe aus.

Eine durchgefallene Prüfung ist kein Scheitern des Laufs. Sie ist der Moment, in dem das große Modell gerufen wird.

grace — task run
graceadd a rate limit to the upload endpointlocal model · isolation: git worktreeplanobjective, files to read, files to modify, checkseditsrc/routes/upload.tsrunning typechecktypecheckrunning lintlintrunning testtest — 1 failing: upload rejects the 4th requestVERIFIED_FAIL frontier escalating to frontier model editsrc/routes/upload.tsrunning typechecktypecheckrunning lintlintrunning testtestVERIFIED_PASSeffect: VERIFIED · checks executed: typecheck, lint, test

State names, check names and the effect ladder are taken from Grace's source.

Verifikation

Drei Zustände, und einer davon ist ein Eingeständnis.

Grace kennt kein „fertig", das daher kommt, dass ein Modell es sagt. Es gibt drei Zustände, und nur der erste erlaubt es, eine Aufgabe als erledigt zu melden.

VERIFIED_PASS

Eine Prüfung lief gegen die Änderung und ging durch. Nur dieser Zustand darf „fertig" heißen.

VERIFIED_FAIL

Eine Prüfung lief und ging nicht durch. Die Änderung wird nicht angenommen, die Arbeit geht weiter.

NOT_VERIFIED

Nichts Ausführbares konnte diese Änderung belegen. Grace sagt das, statt Erfolg zu behaupten.

Was geprüft wird, und was sich nicht prüfen lässt →

Dein Kontingent

Grace macht dein Limit nicht größer. Es braucht weniger davon.

Das lokale Modell liest, plant und schreibt. Diese Schritte laufen auf deinem Rechner und rühren das Kontingent nicht an.

Ein Aufruf an das große Modell passiert an genau einer Stelle: ein Schritt ließ sich nicht abschließen oder nicht belegen. Dann wird das Modell gerufen, für das du ohnehin zahlst — für den Schritt, der es braucht.

Und wenn das Kontingent knapp wird, schiebt Grace dich nicht heimlich auf etwas Kleineres. Das Modell, das du gewählt hast, bleibt das Modell, das du bekommst. Es sind einfach weniger Aufrufe, also reicht dasselbe Kontingent weiter, weil weniger davon verbraucht wird.

Dasselbe Kontingent, dieselben Aufgaben, dieselbe Reihenfolge. Achte darauf, wo es ausgeht.

Gleiches Kontingent in beiden Spuren, gleiche Aufgaben, gleiche Reihenfolge. Ohne Grace zahlt jede Aufgabe darauf ein, und die letzten Aufgaben fangen gar nicht erst an. Mit Grace werden die meisten Aufgaben auf deinem Rechner fertig, und das Kontingent wird nur dort ausgegeben, wo ein Schritt nicht fertig wurde oder sich nicht belegen liess — so kommt die Liste bis zum Ende, und ein Teil des Kontingents steht noch da.

Illustration of the mechanism. The measured ratio will replace this — the method is on the Benchmark-Seite.

Aufgaben, die mit demselben Kontingent fertig werden

wird gemessen

Das hier ist noch nicht gemessen. Die Methode steht vor dem Ergebnis —siehe die Benchmark-Seite.

Weniger Claude-Token je Aufgabe94%Gemessen am 21. September 2026. M1 · 3 tasks × 3 repetitions × 2 arms = 18 runs · paired Die größere Reihe läuft noch, die Zahl kann sich also noch bewegen.
Aufgaben ohne einen einzigen Aufruf

Das hier ist noch nicht gemessen. Die Methode steht vor dem Ergebnis —siehe die Benchmark-Seite.

Eine dieser drei Zahlen ist gemessen: 94 % weniger Token, an 3 Aufgaben mit je 3 Wiederholungen, am 21. September 2026. Die beiden anderen sind es nicht und bleiben leer, bis die größere Reihe über 30 Aufgaben durch ist. Die Methode stand vor dem Ergebnis fest.

Dein Claude-Abo

Es bleibt dein Abo. Es reicht nur weiter.

Grace ersetzt dein Claude-Abo nicht und verkauft keinen Modellzugang weiter. Es braucht eins — und verbraucht davon sehr viel weniger.

  • Dein Fenster wird nach Kosten abgebucht, nicht nach Token Ein billiger und ein teurer Schritt nehmen nicht dasselbe Stück aus deinem Fünf-Stunden-Fenster. Grace hält die meisten Schritte auf deinem Rechner, und die wenigen, die zu Claude gehen, sind klein.
  • Wie viel weiter, sagen wir noch nicht Dass die Ersparnis beim Abo überhaupt ankommt, ist gemessen. Der genaue Faktor nicht — die Messung löst nur in ganzen Prozentpunkten auf, und die größere Reihe läuft noch.
  • An deiner Rechnung bei Anthropic ändert sich nichts Gleicher Zugang, gleiches Abo, gleiche Rechnung. Grace sieht nie einen API-Schlüssel und rechnet keine Modellnutzung über uns ab.

Wenn das Fenster leer ist, lautet die übliche Antwort: eine Stufe höher. Pro kostet $20 im Monat, Max $100, das große Max $200. Grace kostet €19 und lässt dich auf dem Abo, das du schon hast.

Abopreise, wie Anthropic sie veröffentlicht, Stand 22. September 2026. anthropic.com/pricing

Was wir über Spar-Erweiterungen gemessen haben

Die Erweiterungen, die Token sparen sollen, haben uns mehr gekostet.

Wir haben dieselben Aufgaben zweimal laufen lassen — einmal mit den üblichen Spar-Erweiterungen, einmal ohne. Alles andere war gleich: derselbe Agent, dieselbe Aufgabenliste, dasselbe Konto, dieselbe Denkstufe. Mit ihnen brauchte der Lauf das 2.68× an Token, gemessen an 20 gepaarten Aufgaben.

  • 19 von 20 Aufgaben waren mit ihnen teurer Kein knappes Ergebnis und kein Mittelwert, der eine Spaltung verdeckt. Neunzehn Aufgaben gingen hoch, eine blieb gleich. Die mittlere Aufgabe brauchte das 3,6-Fache.
  • Die Rechnung stieg weniger als die Tokenzahl Token um das 2,7-Fache, die Rechnung um das 1,2-Fache. Der Großteil ist erneut gelesener Zusammenhang, und der wird billiger abgerechnet. Bezahlt wird er trotzdem — und beim Abo füllt er weiter dein Fenster.
  • Wir nennen sie nicht beim Namen Das ist eine Messung unserer eigenen Läufe auf unserer eigenen Aufgabenliste, kein Urteil über jemandes Produkt. Eine andere Liste oder ein anderer Aufbau kann anders ausgehen — genau deshalb veröffentlichen wir die Methode.

Das ist ein Zwischenstand aus einer laufenden Reihe, und er sagt nichts über Qualität: Wenn eine Erweiterung mehr kostet und mehr leistet, ist das ein Handel und kein Fehler. Ob das Ergebnis besser wird, messen wir getrennt.

Gemessen am 22. September 2026. Wie gemessen wurde

Was es heute kann

Nur, was schon läuft.

  • 01

    Läuft lokal

    Dein Code bleibt auf deinem Rechner, außer wenn für einen Schritt ein großes Modell gerufen wird, den das lokale nicht abschließen konnte.

  • 02

    Deterministische Prüfungen

    Grace führt die Prüfungen des Projekts aus — typecheck, lint, test, build — dazu Browser-Beobachtung und strukturelle Prüfungen.

  • 03

    Auch für statische Seiten

    Nicht nur Framework-Projekte. Eine reine HTML- und CSS-Seite ist ein vollwertiges Ziel.

  • 04

    Sagt NOT_VERIFIED

    Wenn nichts Ausführbares eine Änderung belegen kann, meldet Grace diesen Zustand, statt Erfolg zu behaupten.

  • 05

    Ein Befehl

    grace im Terminal, in dem Verzeichnis, in dem du ohnehin arbeitest.

Loslegen

Ein Befehl, im Verzeichnis, in dem du schon bist.

Keine Entwicklungsumgebung installieren, kein Konto anlegen, kein Projekt importieren. Grace ist ein Terminal-Agent und startet dort, wo deine Arbeit ohnehin liegt.

npm install -g grace-agent

Der Befehl, den du zum Start ausführen wirst. Es gibt noch nichts zu installieren.

Was dein Rechner braucht

  • Ein Rechner mit 24 GB Arbeitsspeicher oder mehr Allein das lokale Modell belegt rund 18 GB — gemessen, nicht geschätzt. 16 GB reichen heute nicht. Entwickelt wird auf einer 48-GB-Maschine.
  • macOS Dort entwickelt und dort gemessen. Andere Systeme sind ungetestet — ungetestet, nicht ausgeschlossen.
  • Node 24 und Ollama Grace benutzt das Ollama, das auf deinem Rechner ohnehin läuft, und das Modell, das du dort geladen hast.
  • Dein eigenes Claude-Code-Abo Optional, und nur wenn ein Schritt eskaliert. Grace verkauft keinen Modellzugang weiter.

Der Arbeitsspeicher ist bei einem lokalen Modell der ehrliche Knackpunkt. Deshalb steht er hier und nicht in einer Fußnote. Die Zahl ist das, was das Modell selbst belegt — Speicher verschiedener Teile derselben Maschine wird nicht addiert, denn es ist zweimal derselbe physische Speicher.

grace — zsh — 80×24
~/my-project $ npm install -g grace-agent added 1 package in 3s ~/my-project $ grace ██████╗ ██████╗ █████╗ ██████╗███████╗ ██╔════╝ ██╔══██╗██╔══██╗██╔════╝██╔════╝ ██║ ███╗██████╔╝███████║██║ █████╗ ██║ ██║██╔══██╗██╔══██║██║ ██╔══╝ ╚██████╔╝██║ ██║██║ ██║╚██████╗███████╗ ╚═════╝ ╚═╝ ╚═╝╚═╝ ╚═╝ ╚═════╝╚══════╝ Arbeitet lokal, fragt Claude nur wenn nötig · mein-shopDu: unten steht noch unsere alte TelefonnummerGrace:Ich sehe sie an drei Stellen — auch im Anruf-Link. Ich tausche sie überall aus. lib/inhalte.ts:210 +49 30 1234567 lib/inhalte.ts:211 tel:+49301234567 lib/inhalte.ts:251 +49 30 1234567 Geändert. Danach das ganze Projekt durchsucht — die alte Nummer kommt nirgends mehr vor. › Sag, was zu tun ist — oder /helpGrace · Projekt mein-shop · Modell qwen3.6:35b-a3b · Örtlich erledigt noch nichts gemessen · Auftrag wartetStrg+C beendet Grace · /help zeigt die Befehle · sonst einfach sagen, was zu tun ist
This is the first run as it will work at launch — the package is not published yet.

Preis

€19 im Monat für die ersten 10.000.

Danach €39. Keine Stufen, keine Mindestanzahl, kein Aufschlag auf die Modellnutzung — Eskalationen laufen über das Abo, das du ohnehin zahlst.

Regulär

€39 / Monat

Der Preis für alle nach den ersten 10.000 Plätzen.

  • Dasselbe Produkt, dieselbe Prüfung
  • Keine Stufen, keine Mindestanzahl
Auf die Warteliste

Preise in Euro. Es wird noch nicht abgerechnet — die Warteliste sammelt nur E-Mail-Adressen.

Alle Preisdetails →

Fertig sollte heißen, dass etwas gelaufen ist.

Ein lokales Modell für die gewöhnliche Arbeit, ein Aufruf an das große Modell nur dort, wo er sich verdient, und ein Zustand, der aus ausgeführten Prüfungen kommt statt aus einem Satz.

Warteliste

Grace ist noch nicht offen.

Trag eine Adresse ein, dann hörst du von uns, wenn es losgeht — und wenn die Benchmark-Zahlen veröffentlicht sind, je nachdem was zuerst kommt.

Keine Zahlung, kein Konto. Ein Feld für die Adresse, sonst nichts.