fable.tokyo

Mythos・Fable・Opus・Sonnet・Haikuで生成内容が変わる境目

モードを選ぶとき、本当に知りたいのは「どれが賢いか」ではなく「自分の作業で結果が変わるのはどこか」のはずです。実際に効いてくるのは、文脈の長さ・トークン単価・APIが受け付けるパラメータの形という、数字ではっきり分かれる3つの仕様差でした。まず一覧から置きます。

1MMythos 51MFable 51MOpus 51MSonnet 5200KHaiku 4.5

単価は段階的なのに、文脈長は1Mと200Kの二択で中間がありません。ここが選択肢を分けます。

このサイトはAnthropicの公式サイトではありません。モデルの提供状況・仕様・料金は変わる可能性があるため、実装や契約の前には公式のドキュメントとご自身のアカウント設定を確認してください。

まず一覧:5つのモードの位置づけ

2026年8月15日時点で確認できる範囲では、次のような並びです。詳しくは5つのモードの仕様差にまとめました。

モード文脈入力 $/1M出力 $/1M備考
Mythos 51M10.0050.00Project Glasswing でのみ提供
Fable 51M10.0050.00最上位
Opus 51M5.0025.00既定にしているもの
Sonnet 51M3.0015.002026年8月末まで導入価格あり
Haiku 4.5200K1.005.00文脈だけ他と桁が違う

表を見て最初に目につくのは、Haiku だけ文脈が 200K で、他は 1M という点です。単価の差は連続的ですが、文脈は連続していません。ここが実務でいちばん効きます。あなたの入力が200Kに収まるかどうかで、選択肢そのものが変わります。

もうひとつ、Mythos 5 は一般の環境では選べません。仕様の数字は Fable 5 と同じですが、提供の経路が違います。詳しくはMythos 5 が手元に出てこない理由に書きました。

知りたいことから飛ぶ

このサイトの各ページが担いでいる数字を並べておきます。判断に効くのは、ほとんどこれだけです。

数字何の数字かページ
1M×4、200K×1文脈長の分布。中間が無く、二択になっている仕様の一覧
200Kここに収まるかどうかで、選べるモードの数が5と4に分かれる文脈の長さ
1 : 5入力と出力の単価比。全モード共通。だから実務では入力側が支配的になるトークン単価
2倍最上位と既定の単価差。「重要なところだけ上位」という割り当てが成立する幅トークン単価
400思考の指定を古い書き方のまま新世代に送ると返るステータス思考の設定
差は0Mythos 5 と最上位の仕様差。数字は同一で、違いは提供経路だけMythos 5

症状からなら、こう引けます。入力が大きい作業をしているなら文脈の長さ、費用が想定より膨らんでいるならトークン単価、モデルを新しくしたらエラーになったなら思考の設定、Mythos 5 が選べないなら提供の経路、使えるはずのモードが選択肢に出てこないなら手元に出てこないときです。

いずれも2026年8月15日時点の確認です。どの数字から古くなりやすいか、変わったときに何で確かめるかは一覧のページにまとめてあります。

3つの境目

この3つはどれも「出力の質」ではなく「投げられる形」の話です。ところが実際に生成物が変わるのは、たいていここが原因でした。材料を全部渡せなかった、費用が合わないので短く済ませた、思考の指定が効いていなかった——順番に潰していくほうが、モードを変えるより結果が動きます。

「モードを上げたのに変わらない」ときに見るところ

上位のモードに切り替えたのに出力が変わらない、という相談をよく見ます。実際に自分でも起きました。原因はモードではなく、次のどれかだったことが多いです。

  1. 思考の指定が入っていない。エラーで弾かれるのを避けるためにパラメータごと削っていて、上位モードを思考なしで動かしていました。エラーにならないので気づけません(詳しく)
  2. 材料が渡り切っていない。読ませたつもりのファイルが入力に入っていない、あるいは途中で切れています。渡した内容のトークン数を実際に数えると分かります(詳しく)
  3. 指示が曖昧で、判断の余地が大きすぎる。「よくして」に対しては、どのモードでも何かしら返ってきます。判定基準を書かないと、モードの差は出力に現れません
  4. そもそも差が出ない作業。数を数える、形式を判定する、決まった変換をする。こういう作業は下位でも同じ結果になります

4つとも、モードを上げても解決しません。順に確認して、それでも足りないと分かってから上げるのが順序として正しいと思っています。逆順にやると、費用だけが上がります。

実際にどう割り当てているか

90サイト前後を回していて、全部を最上位で処理すると費用が合いません。実際には次のような線を引いています。

  • 最上位(Fable 5)を使うのは、トップページ・ハブページ・検索順位が11〜30位のページ・本命のランディングページ。つまり1本あたりの重みが大きいものだけです
  • それ以外は既定(Opus 5)。調査、検査コードの作成、一括処理、事実確認はここでやります
  • 下位モードは、判定が単純で件数が多いものに回します。文脈が200Kで足りる範囲かどうかを先に確認します

この線引きの根拠は品質の測定ではなく、失敗したときの被害の大きさです。トップページを書き損じると全体に効きますが、下層の1ページなら書き直せば済みます。被害が大きいところに上位を割り当てる、という考え方です。

逆に言うと、下位モードで足りる作業に上位を使っても、結果はあまり変わりませんでした。ファイルを読んで数を数える、決まった形に整える、といった作業がそれにあたります。

このサイトが書かないこと

ベンチマークを取っていないので「AのほうがBより賢い」とは書きません。同じ指示を投げて出力を並べる比較記事はたくさんありますが、判定基準が示されていないものは読んでも判断に使えません。

代わりに書けることが3つあります。

  • 公開されている仕様の差。文脈の長さ、トークンあたりの単価、APIが受け付けるパラメータの形。これは調べれば誰でも確認できます
  • 実際の運用でどのモードに何を割り当てているかと、その基準。90サイト前後を運用していて、全部を最上位で回すと費用が合わないので、実際に線を引いています
  • 実際に出た失敗。たとえば、以前の書き方でパラメータを渡すと400で弾かれるモードがあります

この3つは、どれも「賢さ」の話ではありません。ただ、生成される内容が実際に変わるのはこの3点が原因であることが多い、というのがここまでの実感です。各ページには書いた時点の日付を入れてあります。仕様が変わった箇所を見つけられた場合は、お問い合わせからお知らせいただけると助かります。

よくある質問

結局どれを使えばいいですか?

このサイトはその問いには答えません。答えは用途と予算で変わりますし、根拠のない推奨は害になります。代わりに、何を測れば自分で決められるかを書いています。まず自分の入力が200Kに収まるかを確認してください。そこで選択肢が分かれます。

モードを変えれば文章の質は上がりますか?

上がる場面はありますが、それより先に効くことが多いのは、材料を全部渡せているかと、指示が具体的かです。同じモードでも、渡す材料を変えると出力は大きく変わります。

情報はいつ時点のものですか?

各ページに明記しています。トップの表は2026年8月15日時点です。提供状況・料金は変わるので、実装や契約の前には公式のドキュメントとご自身のアカウント設定をご確認ください。