GRACE 作業はあなたのマシンで。使う Claude トークンはわずか。

ローカルで動くコーディングエージェント

作業はあなたのマシンで。
使う Claude トークンはわずか。

Grace は自分のマシンで動き、作業そのものをこなします。Claude を呼ぶのは、本当に必要なステップだけ。だから結果は同じまま、利用枠はずっと長くもちます。

97 %

トークン課金なら、Anthropic への支払いがこれだけ減ります

2026年9月22日 に 19 件のタスクで測定、のべ 38 回の実行です。30 タスクによるより大きな試験が進行中で、この数字を置き換えます。

サブスクなら、5 時間枠がこれだけ長くもちます

まだ測定できていません。利用枠は整数パーセントでしか報告されず、割り算には粗すぎます。代わりに直接測ります — 枠が尽きるまでタスクを流し、Grace あり・なしで数えます。


Grace がすること

タスクを渡すだけ。作業は自分のマシンで進みます。

Claude Code に渡すのと同じようにタスクを渡します。Grace は自分のマシン上で動くモデルで作業するので、利用枠 — つまり止まるまでに使える Claude Code の量 — は減りません。ステップを完了できない、または証明できない場合にだけ、そのステップのために Claude Code を呼びます。そのあとプロジェクト自身の検査を変更に対して実行し、何を証明できて何を証明できなかったかを伝えます。

  • 自分のマシンで動く 利用枠には手をつけません。
  • 大きなモデルはめったに呼ばない ローカルで終わらない、または証明できないステップだけです。
  • 証明できたことだけを言う 証明できないときは、そう言います。

現状

コーディングエージェントで困ることは三つ。

一つめは作業の途中で来ます。何かの最中に枠が尽きて、待つしかなくなる。アイデアが尽きたのではなく、枠が尽きたのです。

二つめは請求です。余裕を増やせば費用も増える。しかも大きなモデルに回ったステップは、必要だったかどうかに関わらず回っています。

三つめは静かです。モデルがそう言ったというだけで、何も動いていないのに変更が完了と報告される。壊れてから気づくことになります。

仕組み

一つのタスク、一本の道、利用枠を使うのは多くて一回。

Grace はタスクを計画し、ローカルモデルに作業させ、変更を書き、そのうえでプロジェクト自身の検査を実行します。ステップが Claude に渡るのは次の四つのいずれかです。ローカルの試みが通らなかった、修正が堂々巡りになった、計画が不確かで当てずっぽうに書けない、そのタスクの種類がローカルモデルの明らかに苦手なものである。後の二つは、何かを書く前に起こります。

acme-shop Product demo
  • src/components/Header.astro relevant
  • src/components/MobileNav.astro relevant
  • src/styles/global.css relevant
  • src/layouts/Base.astro read only
  • src/pages/index.astro read only

Grace は計画を立てる前にリポジトリを読みます。触れないファイルはそのまま残ります。タスクの範囲は最初の編集より前に決まり、後から決まるのではありません。

仕組みの全体を順に見る

ローカル優先

自分のマシンに置いておけるものは、すべてそこに残ります。

A task goes to the local model on your machine: it reads the repository, plans, and writes the change. Then your project's own checks run against it. Three things can happen. If a check passed, Grace is done and reports VERIFIED_PASS. If nothing could prove the change, it reports NOT_VERIFIED — a statement, not a failure. If a check failed, that one step goes to Claude, which writes a new change, and the checks run again on that one. A failed check is not the only way a step gets there: Grace also hands one over before writing it, when the plan is too uncertain to write blindly or the task is of a kind the local model is measurably weak at. What it never hands over is the whole task.

実線 · 自分のマシンに残る 点線 · 証明できるものがない 破線 · 自分のマシンの外に出る


ターミナルでは

実際のタスクはこう進みます。

検査に落ちることは、その実行の失敗ではありません。大きなモデルが呼ばれる瞬間です。

grace — task run
graceadd a rate limit to the upload endpointlocal model · isolation: git worktreeplanobjective, files to read, files to modify, checkseditsrc/routes/upload.tsrunning typechecktypecheckrunning lintlintrunning testtest — 1 failing: upload rejects the 4th requestVERIFIED_FAIL frontier escalating to frontier model editsrc/routes/upload.tsrunning typechecktypecheckrunning lintlintrunning testtestVERIFIED_PASSeffect: VERIFIED · checks executed: typecheck, lint, test

State names, check names and the effect ladder are taken from Grace's source.

検証

三つの状態、そのうち一つは「できなかった」という表明。

Grace には、モデルがそう言ったから成り立つ「完了」はありません。状態は三つあり、完了と報告できるのは最初の一つだけです。

VERIFIED_PASS

変更に対して検査が実行され、通りました。完了と報告できるのはこの状態だけです。

VERIFIED_FAIL

検査が実行され、通りませんでした。変更は受け入れられず、作業は続きます。

NOT_VERIFIED

この変更を証明できる実行可能なものがありませんでした。成功を主張せず、そう報告します。

何を検査し、何は検査できないのか →

利用枠

Grace は制限を広げません。使う量を減らします。

読むこと、計画すること、書くことはローカルモデルが行います。これらのステップは自分のマシンで動き、利用枠には触れません。

大きなモデルが呼ばれるのは一点だけです。ステップを完了できなかったか、証明できなかったとき。そのときだけ、すでに支払っているモデルが、必要なステップのために呼ばれます。

そして枠が細ってきても、Grace が黙って小さいモデルに切り替えることはありません。選んだモデルがそのまま使われます。単に呼び出しが減るので、使う量が減り、同じ枠がより長くもちます。

同じ枠、同じタスク、同じ順番。どこで尽きるかを見てください。

どちらの行も同じ利用枠、同じタスク、同じ順序です。Grace がなければ、すべてのタスクが利用枠を消費し、最後のタスクは始まりさえしません。Grace があれば、ほとんどのタスクは手元のマシンで終わり、利用枠は工程を終えられなかった場所、または裏づけを取れなかった場所にだけ使われます。だからリストは最後まで進み、利用枠はまだ残っています。

Illustration of the mechanism. The measured ratio will replace this — the method is on the ベンチマークのページ.

同じ枠で完了したタスク数

測定中

これはまだ測定していません。結果より先に方法を公開しています —ベンチマークのページ.

タスクあたりの Claude トークン削減94%2026年9月21日 時点の実測値です。 M1 · 3 tasks × 3 repetitions × 2 arms = 18 runs · paired より大きな試験はまだ進行中で、この数字は変わる可能性があります。
一度も呼ばずに終わったタスク

これはまだ測定していません。結果より先に方法を公開しています —ベンチマークのページ.

三つのうち一つは実測値です。3 タスクを各 3 回、2026 年 9 月 21 日に測定して 94 % のトークン削減。残る二つはまだ測定できておらず、30 タスクによる大きな試験が終わるまで空のままです。方法は結果より先に公開しています。

お使いの Claude プラン

プランはそのまま。持ちが変わります。

Grace は Claude の契約を置き換えませんし、モデル利用権を転売もしません。契約は必要です — ただし、その消費がはるかに少なくなります。

  • 利用枠はトークンではなく費用で減ります 安いステップと高いステップが 5 時間枠から同じだけ削るわけではありません。Grace はほとんどのステップを自分のマシンで処理するので、Claude に届くのは少数かつ小さなものだけです。
  • どれだけ持つかは、まだ言いません 節約が契約に効くこと自体は測定済みです。正確な倍率はまだです — 測定の分解能は整数パーセントで、より大きな試験も進行中です。
  • Anthropic への支払いは変わりません 同じログイン、同じプラン、同じ請求。Grace が API キーを見ることはなく、モデル利用料を当社経由で請求することもありません。

枠が尽きたときの普通の答えは「上のプラン」です。Pro は月 $20、Max は $100、大きい Max は $200。Grace は ¥3,400 で、いまのプランのまま使えます。

プラン料金は Anthropic の公開価格、2026 年 9 月 22 日時点。 anthropic.com/pricing

トークン節約をうたう拡張を測ってみた

トークンを節約するはずの拡張は、かえって多く使いました。

同じタスクを二度走らせました。よくあるトークン節約系の拡張を入れた場合と、入れない場合です。ほかはすべて同じ条件 — 同じエージェント、同じタスク一覧、同じアカウント、同じ思考レベル。入れた場合は 2.68× のトークンを必要としました(対応づけた 20 タスクでの実測)。

  • 20 タスク中 19 タスクで高くついた 僅差でもなければ、平均が偏りを隠しているわけでもありません。19 件が増え、1 件が同等。中央値のタスクで 3.6 倍でした。
  • 請求額の増え方はトークンほどではない トークンは 2.7 倍、請求は 1.2 倍。増分の多くは読み直したコンテキストで、これは安く計上されます。それでも支払いは発生し、サブスクでは利用枠を埋めます。
  • 名指しはしません 自分たちのタスク一覧での自分たちの実測であって、他社製品への評決ではありません。一覧や構成が変われば結果も変わりえます。だからこそ方法を公開しています。

これは進行中の試験の途中経過であり、品質については何も述べていません。費用が増えても成果がそれ以上なら、それは取引であって欠陥ではありません。結果が良くなるかどうかは別に測っています。

2026年9月22日 時点の実測値です。 測定方法

今できること

すでに動くものだけ。

  • 01

    ローカルで動く

    コードは自分のマシンに残ります。ローカルモデルが完了できなかったステップのために大きなモデルが呼ばれるときを除いて。

  • 02

    決定的な検査

    プロジェクト自身の検査を実行します — typecheck、lint、test、build — さらにブラウザ観察と構造的な検査。

  • 03

    静的サイトにも

    フレームワークの案件だけではありません。素の HTML と CSS のサイトも一級の対象です。

  • 04

    NOT_VERIFIED と言う

    変更を証明できる実行可能なものがないとき、成功を主張せずこの状態を報告します。

  • 05

    コマンド一つ

    いま作業しているリポジトリで、ターミナルに grace と打つだけ。

はじめかた

いま開いているリポジトリで、コマンド一つ。

エディタの導入も、アカウント作成も、プロジェクトの取り込みも不要です。Grace はターミナルのエージェントで、作業がすでにある場所から始まります。

npm install -g grace-agent

公開時に実行するコマンドです。まだインストールするものはありません。

マシンに必要なもの

  • メモリ 24 GB 以上のマシン ローカルモデルだけで約 18 GB を占めます。推定ではなく実測値です。16 GB では今日のところ足りません。開発は 48 GB のマシンで行っています。
  • macOS macOS で開発し、macOS で測定しました。他の OS は未検証です — 非対応ではなく、未検証です。
  • Node 24 と Ollama Grace はすでに動いている Ollama と、そこに取り込んだモデルを使います。
  • ご自身の Claude Code の契約 任意です。ステップがエスカレーションしたときだけ使います。Grace がモデル利用権を転売することはありません。

ローカルモデルにとってメモリは正直な決め手です。だから脚注ではなく、ここに書いています。

grace — zsh — 80×24
~/my-project $ npm install -g grace-agent added 1 package in 3s ~/my-project $ grace ██████╗ ██████╗ █████╗ ██████╗███████╗ ██╔════╝ ██╔══██╗██╔══██╗██╔════╝██╔════╝ ██║ ███╗██████╔╝███████║██║ █████╗ ██║ ██║██╔══██╗██╔══██║██║ ██╔══╝ ╚██████╔╝██║ ██║██║ ██║╚██████╗███████╗ ╚═════╝ ╚═╝ ╚═╝╚═╝ ╚═╝ ╚═════╝╚══════╝ Arbeitet lokal, fragt Claude nur wenn nötig · mein-shopDu: unten steht noch unsere alte TelefonnummerGrace:Ich sehe sie an drei Stellen — auch im Anruf-Link. Ich tausche sie überall aus. lib/inhalte.ts:210 +49 30 1234567 lib/inhalte.ts:211 tel:+49301234567 lib/inhalte.ts:251 +49 30 1234567 Geändert. Danach das ganze Projekt durchsucht — die alte Nummer kommt nirgends mehr vor. › Sag, was zu tun ist — oder /helpGrace · Projekt mein-shop · Modell qwen3.6:35b-a3b · Örtlich erledigt noch nichts gemessen · Auftrag wartetStrg+C beendet Grace · /help zeigt die Befehle · sonst einfach sagen, was zu tun ist
This is the first run as it will work at launch — the package is not published yet.

料金

最初の 10,000 人は月額 ¥3,400。

その後は ¥7,100。プランの段階も、最低人数も、モデル利用料への上乗せもありません。エスカレーションはすでに支払っている契約を通ります。

通常

¥7,100 請求は €39 / 月

最初の 10,000 人より後は、この価格です。

  • 同じ製品、同じ検証
  • 段階分けなし、最低人数なし
ウェイトリストに登録

請求はユーロで行われます。表示額は 1 ユーロ = 181.38783 JPY(open.er-api.com, Kurse vom 07.09.2026 00:02 UTC)で換算し、丸めた参考値です。実際の請求額はその日のレートによります。 請求はユーロです。まだ課金は始まっていません。ウェイトリストはメールアドレスのみを集めます。

料金の詳細 →

「完了」は、何かが動いたという意味であるべきです。

普段の作業はローカルモデルが担い、大きなモデルはそれに値する場所でだけ呼ばれ、状態は文章ではなく実行された検査から決まります。

ウェイトリスト

Grace はまだ公開されていません。

アドレスを登録しておくと、公開のとき、そしてベンチマークの数値が出たとき、早いほうでお知らせします。

支払いもアカウントも不要です。入力はメールアドレスだけ。