Anthropic、内部モデル2を開示:総合能力はClaude Mythos 5をわずかに上回る

Anthropicは2026年8月のリスク報告書の中で、Model 2という未公開の内部AIモデルを静かに開示しました。このモデルは公開されているClaude版ではなく、Anthropicも発表していません...

发布于 2026年8月19日generalGEO 评分: 07 次阅读
Anthropic、内部モデル2を開示:総合能力はClaude Mythos 5をわずかに上回る

Anthropic、内部モデル2を開示:総合能力はClaude Mythos 5をわずかに上回る

はじめに

Anthropicは2026年8月のリスク報告書の中で、Model 2という未公開の内部AIモデルを静かに開示した。

このモデルは公開されたClaudeのバージョンではなく、Anthropicもこれを製品としてリリースしていない。このモデルが報告書に登場したのは、同社が先進AIのリスクを評価する際に、内部で展開しているフロンティアおよびフロンティアに近いシステムを評価対象に含めたためである。

Anthropicによると、Model 2は総合能力がClaude Mythos 5をわずかに上回るという。

改善は確かに存在するが、同社はこれを大きな世代間飛躍として説明することを慎重に避けている。

Anthropic自身の要約によれば、内部利用に関連する多くのタスクにおいてModel 2はMythos 5を明確に上回るものの、Claude Opus 4.6からClaude Mythos Previewへのアップグレード時に同社が観察した能力の飛躍には依然として遠く及ばない。

これにより、Model 2は異なる観点から意義を持つことになる。

新たな世代の到来を示すというよりも、むしろAnthropicによるフロンティアモデル能力の継続的な磨き上げを象徴している。

報告書はまた、具体的なデータポイントも示している。Anthropicの内部CoBench評価において、Model 2は**62.8%を獲得し、Claude Mythos 5の50.3%およびClaude Mythos Previewの54.8%**を上回った。

同じ報告書には、もう一つの内部システムModel 1にも言及があり、Anthropicが内部モデルのシリーズを開発し、その後公開のClaude製品名を割り当てているのではないかという憶測を外部に呼び起こした。

公式報告書は、この解釈を部分的にしか支持していない。

AnthropicはModel 1とModel 2が内部モデルであることを確認したが、Model 2がModel 1の正式な後継であるとは述べておらず、またこれらのいずれかが将来のClaudeバージョンになるとも述べていない。

Model 2の総合能力はClaude Mythos 5をわずかに上回る

AIBaseの報道における核心的な見解は正確である。AnthropicはModel 2が総合的にClaude Mythos 5より優れていると述べている。

同社の8月のリスク報告書はModel 2を次のように説明している:

  • 一部の分野ではMythos 5より能力が優れている。
  • 他の分野ではMythos 5より能力が劣る。
  • 総合能力はわずかに上回る。

Anthropicはまた、おおまかな定性的評価として、Model 2は内部利用に関連する多くのタスクにおいて明確な改善をもたらすと述べている。

この表現は重要である。

Model 2は、あらゆるベンチマークやあらゆるリスク関連分野においてMythos 5を全面的に上回るものとして説明されるべきではない。

報告書自体が、比較結果はタスクによって異なることを示している。

例えば、一部の化学・生物リスク評価において、AnthropicはModel 2の限定的な結果はClaude Mythos 5と同等かそれ以下であると述べている。

別の隠蔽行動評価では、Model 2はMythos 5をわずかに上回るものの、Mythos Previewには依然として明らかに及ばない。

したがって、最も公正な要約は次のとおりである:

Model 2
= 総合能力はわずかに上回る
≠ すべての評価で優れている

改善は重大な世代間飛躍ではない

元記事は、この向上が比較的限定的であることを強調している。

Anthropicは、…と比較して、

同じ状況である。

同社は特にModel 2を、Claude Opus 4.6からClaude Mythos Previewへのアップグレードという以前の飛躍と対比している。

そのアップグレードはより大きな能力向上を表していた。

Model 2はそうではない。

Anthropicによると、この新しい内部モデルは多くの内部タスクで明確な改善を示しているが、同規模の破壊的な変化ではない。

この点は、別の内部能力指標にも反映されている。

AnthropicはAECIと呼ばれるEpoch能力指数の内部版を維持しており、これは複数の内部ベンチマークでのパフォーマンスを統合したものである。

限られたデータによると、Model 2のスコアはおおよそ:

AECI 1.5ポイント

Claude Mythos 5より高い。

Anthropicは、この推定には大きな誤差範囲があることを明確にしている。

また、この増加幅はMythos PreviewからMythos 5への改善幅よりも小さいとも述べている。

これは記事の主要な定性評価、すなわちModel 2はフロンティアモデルの漸進的な改善のように見え、明確な新たな能力段階ではないことを支持している。

CoBenchが最も明確な公開比較を提供

報告書の中で最も具体的な証拠はCoBenchに由来する。

AnthropicはCoBenchを、汎用ベンチマークを代替指標として使うのではなく、モデルが企業の実際の研究開発問題を解決する能力をテストすることを目的とした内部評価であると説明している。

この評価は、モデルをAnthropicインフラストラクチャの歴史のある時点に配置する。

モデルには以下のリソーススナップショットが提供される:

  • コード。
  • ログ。
  • 内部ドキュメント。
  • 過去の内部メッセージ。

その後、モデルはAnthropicのエンジニアが以前に解決した技術的問題の根本原因を診断する必要がある。

8月の報告書に記載された現在のバージョンには以下が含まれる:

449の問題

主に2026年2月から4月にかけて解決された問題に由来する。

これらの問題は、以下の分野に関わるAnthropicの技術組織内の部門からのものである:

  • モデルのトレーニング。
  • モデルインフラの運用。
  • 技術システムのデバッグ。
  • 研究エンジニアリング。

これにより、CoBenchはAnthropicのAIによるAI研究開発の自動化への注力と特に関連性が高い。

Model 2はCoBenchで62.8%を獲得

報告書に示された比較スコアは以下のとおりである:

モデル CoBenchスコア
Claude Sonnet 4.6 12.0%
Claude Opus 4.6 15.6%
Claude Opus 4.7 27.4%
Claude Mythos 5 50.3%
Claude Mythos Preview 54.8%
Model 2 62.8%

したがって、Model 2は図表に示されたモデルの中でトップに立っている。

Mythos 5との差は:

62.8% - 50.3% = 12.5パーセントポイント

この特定の内部ベンチマークにおいては、これは顕著な差である。

しかし、これはAnthropicが技術スタッフを完全に代替するために十分と考えるスコアには依然として遠く及ばない。

Anthropicは研究員の完全代替には約85%のスコアが必要と推定

Anthropicは、タスクと採点プロセスの人手によるレビューに基づき、Anthropicの研究科学者およびエンジニアを真に完全に代替できるシステムは、CoBenchで少なくともおおよそ:

85%

のスコアが必要であると述べている。

Model 2の62.8%は、したがって依然として大きな隔たりがある。

Anthropicはまた、このベンチマークが人間との同等性を完璧に測定するものではないと注意を促している。

データセットは

意図的に難しい問題を選別している。

ほとんどのタスクは、Mythos Previewが3回の試行で少なくとも1回は失敗したために選ばれている。

Anthropicによると、この選別がなければ、データセットの規模はおよそ2倍になる。

他の制約もある:

  • 過去の人間による結論の一部は完全ではない可能性がある。
  • 一部の回答は曖昧である可能性がある。
  • 自動採点は誤る可能性がある。

モデルは、実際のAnthropicのエンジニアが持つであろうすべての権限やインフラ支援を得られるわけではない。

したがって、CoBenchは、AIモデルが研究者に取って代わることができるかを測る一般的な基準ではなく、有用な内部シグナルと見なすのが最も適切である。

Mythos 5 により多くのトークンを与えても、ギャップを完全に埋めることはできない

Anthropicはまた、CoBenchの結果が単に推論予算の不足を反映しているだけなのかもテストした。

このグラフで使用されたトークン予算はおよそ:

30万トークン

評価された設定に対して。

AnthropicがMythos 5の予算を次のように増やしたとき:

90万トークン

そのスコアはおよそ次のようにしか向上しなかった:

3パーセントポイント

これは、Model 2の優位性の少なくとも一部は、Mythos 5により多くのトークンを与えるだけでは説明できないことを示している。

Anthropicは依然として、より良いスキャフォールディングと評価フレームワークが結果を改善できると考えており、したがってこのベンチマークは純粋にモデルの重みそのものを測定するものではない。

エージェントアーキテクチャは重要である。

Model 2 は Anthropic 社内で既に広く使用されている

Model 2はまだリリースされていないが、誰も使っていない実験室のチェックポイントではない。

Anthropicによると、Model 2とClaude Mythos 5は、同社の内部で最も能力が高く、最も頻繁に使用されているモデルの一部である。

これらは以下の用途で大量に使用されている:

  • プログラミング。
  • データ生成。
  • その他のエージェントワークフロー。
  • 研究。
  • エンジニアリング。

Anthropicはまた、これらのモデルは両方とも、対話型チャットセッションだけでなく、持続的なエージェント展開を通じて使用されていると述べている。

これは、同社のリスク報告書が、AIシステムがAnthropic自身の研究開発業務のますます多くの部分を自動化する可能性に焦点を当てているため、重要である。

報告書によると、Claudeは現在、Anthropicの本番コードベースにマージされるコードの大部分を作成している。

しかし、Anthropicは、そのモデルが現在、研究者を完全に置き換えることができるという結論には至っていない。

同社は、AIが内部業務を実質的に加速させていると考えているが、8月の評価は、AI主導の研究開発の大幅な加速に関する責任ある拡張ポリシーのしきい値を依然として下回っている。

Model 2 は Anthropic の完全なデプロイ前評価スイートをまだ完了していない

報告書には、もう1つの重要な注意点も含まれている。

Model 2はAnthropicの内部デプロイ審査プロセスを通過しているが、外部デプロイ前に同社が通常実行する完全な評価スイートはまだ受けていない。

したがって、Anthropicは、完全に評価されたリリースモデルに対する自信よりも、Model 2に対する理解の自信度がやや低いと述べている。

これは、ベンチマーク比較を解釈する上で重要である。

単一のCoBench結果は、Model 2が内部研究開発タスクで強力に機能することを示すことができる。

しかし、それは以下を網羅する完全なパフォーマンス像を確立するものではない:

  • 一般的な推論。
  • プログラミング。
  • サイバーセキュリティ。
  • 生物学。
  • 安全性。
  • アライメント。
  • 長期的自律性。
  • 消費者向け使用。
  • エンタープライズ環境。

作業量。

Anthropicの現在の結論は意図的に広範である:Model 2は全体的にMythos 5よりもわずかに優れているように見える。

Anthropic は現在、Model 2 を外部にリリースする計画はない

AIBaseのその短い記事の中で、最も重要な実際的な詳細は見落とされがちである。

Anthropicは明確に述べている:

私たちは現在、このモデルを
外部にリリースする計画はありません。

したがって、Model 2は、暗黙のリリース日を持つ差し迫ったClaude製品と見なすべきではない。

現在、公式なものはない:

  • リリース日。
  • 公開モデル名。
  • Claude API モデルID。
  • 価格。
  • コンテキストウィンドウ仕様。
  • 消費者向け利用計画。
  • エンタープライズ展開計画。

Model 2が「Claude Mythos 6」、「Claude Opus 6」、または他の命名製品になるという主張はすべて単なる推測である。

Anthropicがこのモデルを開示したのは、内部モデルが同社のリスク評価に関連しているためである。

これは製品リリースとは異なる。

Claude Mythos 5 は実際には広く利用可能な公開モデルではない

AIBaseの元の見出しは、Claude Mythos 5がAnthropicの最も強力な公開利用可能なモデルであると述べていた。

この点は少し修正する必要がある。

Claude Mythos 5 は広く利用可能ではない。

Anthropicは現在、Project Glasswingおよび関連する信頼できるアクセスプログラムを通じて、限られた承認済み顧客グループにのみこのモデルを提供している。

広く利用可能な対応バージョンは Claude Fable 5 である。

Anthropicによると、Fable 5とMythos 5は同じ基盤モデルを使用している。

違いは、Fable 5にはサイバーセキュリティや生物学などの機密分野におけるより強力な安全対策が含まれているのに対し、Mythos 5は、承認された作業においてより少ない制限を必要とする審査済みユーザーに提供される点である。

現在の製品関係は次のとおりである:

Claude Mythos 5
= 制限付き信頼できるアクセス

Claude Fable 5
= 同じ基盤モデル
  + より強力な安全対策
  + 広範な利用可能性

したがって、一般的な読者にとっては、Mythos 5はAnthropicの最も強力な制限付きアクセスフロンティアモデルであり、Fable 5はその最も能力の高い広くリリースされたモデルであると言う方がより正確である。

Model 1 は実在するが、「Model 1 → Model 2」という製品ストーリーは単なる推測である

報告書には Model 1 についても言及されている。

これは当然、次のような推測を引き起こすのに十分である:

Model 1
→ Model 2
→ 将来のClaudeバージョン?

しかし、Anthropicはそのような主張をしていない。

実際、同社はModel 1についてかなり控えめに説明している。

同社は、Model 1は能力においておおよそ次のものと同等であると述べている:

  • Claude Mythos Preview。
  • Claude Mythos 5。

その内部展開は比較的限られていた。

Anthropicによると、内部ユーザーの大多数はMythos 5を好み、Model 1の使用率は、報告書の対象期間である7月15日時点で既に低く、減少し続けていた。

同社はまた、次のように述べている:

Model 1は今後、外部展開や
広範な内部使用は
行われないと予想される

したがって、Model 1は、公開リリースを待つ明確に定義された前世代製品というよりも、内部開発ブランチまたはチェックポイントのように見える。

Model 2 は Model 1 と重要な点で異なる

AnthropicはModel 2の扱いにおいて、明らかに慎重さが増している。

Model 1は簡単に議論されただけで、その後リスク分析から基本的に除外されている。これは、Anthropicが

Mythos 5をそのリスクの合理的な上限と見なしているためである。

対照的に、Model 2は報告書の大部分で使用されている。なぜなら、それは:

  • 全体的な能力が高い。
  • 内部でより頻繁に使用されている。
  • Anthropicのフロンティアリスク分析に関連している。

報告書によると、Model 2の内部使用状況はMythos 5と同様である。

これは差し迫った公開リリースを証明するものではない。

しかし、それはModel 2がAnthropic内部で重要な運用上の地位を占めていることを示している。

リスク報告書がモデルが公に知られる理由である

Model 2は、従来のリリースブログ記事を通じて発表されたわけではない。

それが登場したのは、Anthropicの責任ある拡張ポリシーが、同社に実際に内部で開発・展開されているシステムのリスク分析を要求するためである。

2026年8月のリスク報告書は、2026年7月15日時点でのAnthropicの活動を対象としている。

内部モデルが以下の問題に関連する場合、Anthropicはそれをリストアップする:

  • 高リスク環境におけるアライメントの問題。
  • 自動化されたAI研究開発。
  • 生物学的および化学的リスク。
  • モデルの安全性。
  • 内部モニタリング。

これが、報告書におけるModel 2

の情報は、通常の未公開モデルが得るものよりも多い。

この開示は、まず第一にセキュリティガバナンスの産物であり、その次に製品リークである。

報告書が私たちに伝えたこと、伝えていないこと

主張 ステータス
Anthropicにはモデル2という内部モデルが存在する 確認済み
モデル2はまだ公開されていない 確認済み
モデル2は全体的にMythos 5よりわずかに優れている Anthropicが確認済み
モデル2はあらゆる分野でMythos 5より優れている いいえ
モデル2は報告書に示されたCoBench比較で62.8%を獲得 報告書データで確認済み
Mythos 5は同じ比較で50.3%を獲得 報告書データで確認済み
AnthropicはCoBenchで全技術スタッフ代替率約85%を達成と推定 確認済み
モデル2は内部で広く使用されている 確認済み
モデル2は完全な通常の外部公開評価スイートを完了している いいえ
Anthropicは現在モデル2を公開する計画がある いいえ
モデル2には正式なClaude製品名がある いいえ
モデル1は実際の内部モデルである 確認済み
モデル1がモデル2の直接の前身であると確定 まだ未確定
モデル1は公開予定である いいえ
Claude Mythos 5はすべての人に利用可能 いいえ
Claude Fable 5はMythos 5に対応する広範なリリース版である 確認済み

よくある質問

Anthropicモデル2とは何か?

モデル2は、Anthropicの2026年8月リスク報告書で開示された未公開の内部フロンティアモデルです。Anthropicは、全体的にClaude Mythos 5よりわずかに優れており、社内でコーディング、データ生成、研究、エンジニアリング、その他のエージェント業務に広く使用されていると述べています。

モデル2はClaude Mythos 5より優れているか?

全体的に見れば、Anthropicは「はい」と述べています——ただし、わずかにのみです。同社はまた、モデル2は一部の分野ではより強く、他の分野ではより弱いため、全面的に超越していると説明すべきではないと述べています。

モデル2のCoBenchスコアは?

報告書に示された比較では、モデル2は**62.8%**を獲得し、Mythos Previewの54.8%とMythos 5の50.3%を上回っています。Anthropicは、完全な能力を備えたモデルが

その技術者の代替能力は、現在の評価では少なくとも約85%に達する必要があると推定しています。

CoBenchは何を評価するのか?

CoBenchは、Anthropicが技術者が過去に解決した歴史的な研究・エンジニアリング問題に基づいて設計した内部評価です。モデルには、コード、ログ、内部メッセージ、ドキュメントを含む過去のスナップショットが渡され、根本的な技術的問題を診断しなければなりません。

Anthropicはモデル2を公開するのか?

Anthropicは、現時点ではモデル2を外部に公開する計画はないと述べています。同社は製品名、リリース日、API識別子、価格、公開アクセス計画を発表していません。

モデル2は次のClaude Mythosモデルか?

Anthropicはそのように述べていません。モデル2はリスク報告書で使用された内部識別子であり、これを将来のClaude製品名に対応付けることは純粋に推測です。

Anthropicモデル1とは何か?

モデル1は、同じ報告書で開示された別の内部モデルです。Anthropicは、Mythos PreviewおよびMythos 5とおおむね類似しており、内部使用率は比較的低く減少傾向にあり、外部展開は予定されていないと述べています。

Claude Mythos 5は公開されているか?

一般には利用できません。Mythos 5はProject Glasswingなどの制限付きトラステッドアクセスプログラムを通じて提供されており、Claude Fable 5は同じ基盤モデルを使用していますが、より強力な安全対策が施され、広く利用可能です。

関連ツール

  • Claude:消費者および専門家向けのAnthropicの汎用AIアシスタント。
  • Claude API:広く利用可能なClaudeモデル向けのAnthropicの開発者プラットフォーム。
  • Anthropic Console:Claude APIモデルをテストし、開発者アクセスを管理するための公式ワークスペース。
  • Project Glasswing:高度なMythosレベルのサイバーセキュリティ機能のためのAnthropicのトラステッドアクセスプログラム。
  • Anthropic Transparency Hub:モデルの安全評価、システムカード、リスク情報の中央リソース。

関連リンク

要約

Anthropicの2026年8月リスク報告書は、モデル2という内部モデルを明らかにしました。このモデルは、

現在、研究、エンジニアリング、コーディング、データ生成、および持続的なエージェントワークフローに大量に使用されています。

このモデルは、Anthropic内部のCoBench評価においてClaude Mythos 5を上回り、それぞれ62.8%と50.3%を獲得しています。Anthropicはまた、モデル2は全体的にわずかに優れているように見えるものの、一部の分野ではMythos 5より弱く、改善幅はこれまでの重大な能力の飛躍よりもはるかに小さいと述べています。

報告書はモデル1にも言及していますが、モデル1とモデル2を確認済みの公開製品シリーズと見なすには証拠が不十分です。モデル1の内部使用量は減少しており、Anthropicは現時点でモデル2を外部に公開する計画がないことを明確にしています。

最も明確な結論は、Anthropicの内部フロンティアレベルはMythos 5をわずかに超えているということです——ただし、モデル2は内部研究システムであり、公開された次世代Claude製品ではありません。