この記事には楽天アフィリエイトの広告が含まれます。リンク経由で購入されると、運営者に報酬が入ることがあります。本文の判断と広告は分けて記載しています。

GPT-6 Astraがこれだけ話題になると、次に気になるのは「Claudeは、どこまで上げてくるのか」ですよね。

僕も、次のClaudeにはかなり期待しています。文章やコードだけでなく、コンピューターを使う仕事や3D制作まで、もっと安心して任せられるようになってほしい。正直、次はどこまで行くんだろう、と気になっています。

そこで今回は、「Claude Fable 5.5」という名前をめぐる未確認情報を調べ、公式に分かっているFable 5.1と、次のモデルへの期待を整理しました。

最初に大切な点です。9月11日時点の今回の調査では、Fable 5.5の正式発表、発売日、確定した性能表は確認できませんでした。 タイトルの「登場か?」は、その確認前の段階を表しています。以下の対決は、実測結果ではなく、次に注目したい比較の観点です。

この記事の目次
01

「Fable 5.5」の話は、どこまで確かなのか

今回たどれた未確認情報には、8月に海外コミュニティで共有された、端末上に「Fable 5.5」という名前が表示されたとする利用者の報告があります。一般の利用者については、個人を特定できる情報を出さず、内容の要旨だけを紹介します。

この種の表示は気になりますが、表示された名前だけでは、裏側でどのモデルが動いているかまでは分かりません。別名、開発中の表示、ツール側の扱いなど、ほかの説明があり得るためです。

今回の調査で、直近の複数のX投稿を独立した裏付けとしてそろえたり、性能の詳細まで確認したりすることはできていません。 そのため、「リークで仕様が判明」「近日発売が確定」とは紹介しません。

また、8月の話が再び流れてきても、それだけで9月の新しい証拠にはなりません。情報を読むときは、投稿された日と、もともとの出来事の日を分けて見る必要があります。

ここは少し地味ですが、期待しているモデルだからこそ、間違った数字や日付に期待を預けないようにしたいところです。

02

公式に確認できる現在地は、Claude Fable 5.1

Anthropicの公式製品ページでは、9月1日公開のClaude Fable 5.1が案内されています。コーディング、知識を扱う仕事、長いタスクなどを担う上位モデルとして紹介されています。

公式のシステムカード一覧にも、Fable 5.1の資料があります。モデル名、公開されている資料、評価条件がそろっていることは、未確認の画面表示との大きな違いです。

僕たちが次を考えるときの土台は、このように確認できる現行モデルです。まだない5.5の能力を説明するために、5.1の紹介文をそのまま「次はもっとすごい」と膨らませるのは避けたいです。

公式公開資料:公式に確認できる現在地は、Claude Fable 5.1
画像:Anthropic公式がFable 5.1の紹介に使用するビジュアル。Fable 5.5の画像ではありません。
03

性能表は「数字」だけでなく「条件」まで読む

図では、科学研究の作業、端末上のコーディング、知識を扱う仕事、コンピューター操作、複数分野の推論、業務手順、開発環境でのコーディングを別々に評価しています。%表示は各評価の得点や達成割合で、GDPval-AA v2の数値は別の尺度です。異なる行を足したり、同じ単位として比べたりはできません。

たとえばOSWorld 2.0は、コンピューターを操作して課題を進める評価です。Fable 5.1は部分達成を含む評価で77.9%、厳格な達成判定では41.7%と、判定方法で数字が変わります。「普段のPC作業が約8割必ず成功する」という意味ではない点に注意してください。

公式の評価を見るときも、問題の種類、モデルに使わせた道具、考える時間、試行回数などが大切です。違う条件の数字を並べると、実際より差が大きく見えたり、逆に小さく見えたりすることがあります。

同じ評価の名前が付いていても、課題の更新や実行条件が違う場合があります。自分の仕事でどう使えるか考えるなら、順位だけでなく、「何をどこまで任せたテストなのか」まで見たいです。

たとえば、短いコードの修正と、複数の画面を使いながら長い制作を終える仕事では、求められる力が違います。前者で強いからといって、後者でも必ず同じように進められるとは限りません。

公式公開資料:性能表は「数字」だけでなく「条件」まで読む
画像:Anthropic公式掲載のFable 5.1の評価図。Fable 5.5のスコアではありません。比較対象のGPTはGPT-5.6 Solで、GPT-6は含まれていません。画像内の比較は、公式が示す評価条件によるものです。
04

GPT-6 VS 次のClaude。僕が見たいのは、仕事が終わるまでの差

ここからは、僕自身の期待です。未発表モデルの仕様ではありません。

GPT-6の能力が話題になっている中で、次のClaudeには、単発のきれいな回答より、作業全体を最後まで進める力を期待しています。

コンピューターを使う仕事なら、画面の変化を読み、正しい場所を選び、入力し、結果を確かめる。この流れが長く続きます。一か所の操作を間違えただけで、その先が全部ずれることもあります。

そこで見たいのは、失敗しないことだけではありません。失敗に気づいて戻れるか。途中で条件が変わったときに、無理に進まず整理できるか。保存できたと言う前に、実際に開き直して確かめられるか。

僕にとっては、このあたりが伸びると、毎日の仕事の体感がかなり変わります。

05

3D制作は「一枚の見栄え」から、どこまで進むか

3Dモデリングでも、見た目がそれっぽいだけでは終わらない仕事があります。

正面からはきれいでも、裏側に破綻がある。形はできているけれど、寸法が合わない。あとから修正したいのに、構造が複雑すぎる。そうした部分まで整って、初めて使える制作物になります。

次のClaudeで僕が期待したいのは、指示された形を作るだけでなく、別の角度で見て確認し、用途に合わせて直すことです。

これは、次世代ClaudeがすでにGPT-6を超えたという意味ではありません。むしろ、両方に同じ制作条件を渡したとき、完成までに何回の手直しが必要で、どこを人が補うのかを比較してみたい、という話です。

「画像はすごい」で終わらず、編集できるデータや、作業の続けやすさまで良くなったら、かなりうれしいですね。

06

ベンチマークが高得点になるほど、次の物差しが必要になる

もう一つ気になるのが、AIの性能をどう測るかです。

一部の評価で上位モデルの得点が高くなると、順位だけでは日常の違いが見えにくくなることがあります。ただし、すべてのベンチマークが飽和し、評価がもう無意味になった、という意味ではありません。 難しい課題や、まだ差が出る領域もあります。

僕は今後、もっと長く、変化のある仕事をどう評価するかが重要になると考えています。新しいテストだけでなく、既存の評価条件を丁寧にそろえることも必要です。

こうした情報があると、「点数が少し高い」から一歩進んで、自分の仕事に合うモデルを選びやすくなると思います。

  • 長い依頼で、最初の条件を最後まで守れるか。
  • 途中の失敗を発見し、修正できるか。
  • 完成したものを、別の方法で確認できるか。
  • 人の助け、時間、費用がどれだけ必要だったか。
07

「何%伸びる?」に、今は数字で答えられない

Fable 5.5について、発売日、速度、コンテキスト長、利用料金、ベンチマークの伸びを、確かなものとして紹介できる材料はまだありません。

現行モデルの世代番号から「0.4増えるから、このくらい強くなる」と推測することもできません。名前の付け方と、能力の伸び方は別です。

今後、公式のモデルカードや提供ページが出たら、まず現行の5.1と同じ条件で比べられるかを確認したいです。そのうえで、GPT-6との比較や、自分の作業での試し方を考える。その順番なら、期待と検証の両方を大事にできます。

08

期待は大きい。だからこそ、本当に出てきたものを見たい

僕は、Claudeの次の一手にかなりワクワクしています。GPT-6が強いほど、「ここからClaudeは何を見せてくれるんだろう」と期待が膨らみます。

コンピューター操作や3D制作、長い開発のタスクが、今よりずっと安定して進むようになったら。新しいモデルが出る意味は、ベンチマークの数字だけではなく、僕たちが挑戦できる仕事の幅にも表れるはずです。

一方で、今回確認できた情報だけで、Fable 5.5の登場や性能を確定することはできませんでした。

「次のClaudeが楽しみ」という気持ちはそのままに、名前の噂と公式発表は分けて待つ。 今回は、そのための整理として読んでもらえたらうれしいです。

確認日:2026年9月12日。未確認の利用者報告は個人を特定しない形で要旨を紹介しています。本記事は未発表モデルの提供や性能を保証するものではありません。

QUICK ANSWERS

よくある疑問を、ここで。

使い始める前に、気になるところから。

Claude Fable 5.5の公式発表はありますか?

今回確認した公式資料では、Fable 5.5の発表を確認できませんでした。記事では噂として扱い、提供済みのFable 5.1と区別しています。

評価表の高い数字だけ見れば比較できますか?

部分的な成功を含む採点と、厳密な成功だけの採点では値が違います。モデル名、設定、採点方式がそろっているかを先に確認すると、比較を取り違えにくくなります。

商品情報の提供:Supported by Rakuten Developers

SOURCES & EDITORIAL NOTE

出典と、この記事について

公式資料や、記事で参照した発表・報道をまとめています。仕様や料金は、利用する前に最新の案内をご確認ください。

製品の実測レビューや、導入効果の保証を示すものではありません。編集方針を読む