OpenAIの次期「Bel」はAstra超え? 実測データはゼロ
ポイント
- OpenAIの次期モデル「Bel」は、GPT-6 Astraより強いと出回っています。ただし公式発表も、比べられるベンチマークの数字もまだありません
- 話の出どころは、2026年8月25日にXへ投稿された単一アカウントの投稿です。複数の情報源が独立に確かめたわけではありません
- 今の独立評価では、Astraより上にClaude Opus 5.5があります。Belの実測データは現時点でゼロです
発端は8月末の1つの投稿
「Bel」は、OpenAIが学習を終えたとされる巨大な基盤モデルです。前の世代の「Doug」の後継と説明されています。
話が広がったきっかけは、X上の@synthwavedd氏が8月25日に書いた投稿でした。そこには、Belが「Astraより強い」と書かれていました。
9月5日には、@Mr_Salio氏が「Astraに勝つ」という見出しで投稿し、さらに拡散しました。
ただし、どちらも個人のXの投稿が元になっています。OpenAIの文書や公式の資料は示されていません。取り上げた記事も、OpenAIが認めたとは書いていません。
話の流れを日付で並べると、次のようになります。
| 日付 | 出来事 |
|---|---|
| 8月25日 | @synthwavedd氏がXでBelの話を投稿 |
| 8月26日 | Wccftechが、Belの規模と位置づけを報じる |
| 9月3日 | 現行のGPT-6 Astraが公開される |
| 9月5日 | @Mr_Salio氏が「Astraに勝つ」と投稿 |
| 9月28日 | OpenAIが次の版「GPT-6.1 Astra」の公開を中止すると発表 |
| 10月1日 | Artificial Analysisの比較が報じられる |
Belの噂は、Astraの公開前の8月末に始まり、公開後も続いています。ただし、Belを比べられる数字は、この表のどこにも出てきません。
「Astraより強い」の中身は示されていない
主張では、コードを書く力、推論、長く続くエージェント作業で上回るとされています。エージェント作業とは、AIが自分で手順を組み、仕事を最後まで進めることです。
しかし、点数も比較表も、比べたテストの名前すら出ていません。どの課題で、どれだけ上回ったのかが分からないのです。
「強いらしい」という印象だけが先に広まっている状態といえます。確かなのは、現行のGPT-6 Astraが9月3日に公開されたことだけです。
Belは次のモデルの土台なのか
Belの位置づけも、出典によって説明が分かれています。
Wccftechは、Belが「AstraとGPT-6の土台になる」と伝えています。一方で、別の記事は、GPT-6より後のモデルの土台としています。
もしAstraの土台なら、AstraはBelの成果を含むことになります。その場合、「BelがAstraを上回る」という比べ方そのものが難しくなります。仕上げ前の土台と完成品を比べるようなものだからです。
Kucoinの速報は、土台として使うには追加の強化学習が必要だと書いています。
今の独立評価では、Astraはトップではない
第三者機関のArtificial Analysisは、AIモデルの性能を総合指数で比べています。報道によると、10月1日時点の数字は次のとおりです。
| モデル | 総合指数 |
|---|---|
| Claude Opus 5.5 | 57.6 |
| Claude Sonnet 5.5 | 56.0 |
| GPT-6 Astra | 52.7 |
| Gemini 4 Argon | 52.6 |
| GPT-6.1 Sol | 52.0 |
Opus 5.5はAstraを約5点上回っています。Gemini 4 ArgonはAstraとほぼ同じ水準です。Belがこの表に入るには、公開されて評価を受ける必要があります。
別の集計サイトでは、OpenAIの「GPT-5.6 Sol」が58.9で首位と表示されています。集計元やモデル名の表記によって順位は違って見えるため、数字は出典を確かめて読むことが大切です。
AnthropicとAGIの話は未確認
同じ噂には、Anthropicは計算資源が足りず、Astraに対抗できないという主張も添えられています。OpenAIがそう見ているという内容です。
ただし、これも元は同じ単一アカウントの投稿です。今の性能の評価とは別の、将来の話にすぎません。
10兆パラメータ規模や、AGIの閾値に近いという話も未確認です。パラメータ数は規模の目安にはなりますが、強さの証拠にはなりません。
強いかどうかは何で判断できるか
現時点の事実からは、Belが強いとは言えません。一方で、弱いと言える根拠もありません。判断を保留するのが正直なところです。
判断材料は次の3つです。
- OpenAIの公式発表でBelという名前が出ること
- Artificial Analysisなどの第三者が、点数を公開すること
- 誰でも使える形で一般公開されること
点数が出れば、Opus 5.5やArgonと同じ表で比べられます。それまでは、リークであり公式発表ではないという前提で読んでください。
なお、Astraの後継としてGPT-6.1 Astraの公開は中止されたばかりです。次の世代の話は、公式の発表を待つのが確実です。
Belに関する質問
Belとは何ですか?
Belは、OpenAIが社内で学習を終えたとされる次の基盤モデルの名前です。
ただし、公式の発表はありません。名前と規模は、リーカーの投稿と一部の報道にだけ出ています。
Belは本当にAstraより強いのですか?
現時点では確認できません。主張はありますが、比べられる点数はまだ出ていません。
判断は、第三者の評価が出てから行うのが安全です。
Belはいつ公開されますか?
公式な日程はありません。噂では、次の世代の土台になるとされていますが、時期ははっきりしていません。
今いちばん強いモデルはどれですか?
報道による独立評価では、Claude Opus 5.5が57.6で上位です。ただし、集計元によって順位が違って見える場合があります。
公式の情報はどこで確認できますか?
OpenAIの公式ブログと、公式のX(旧Twitter)アカウントが一次情報です。噂の段階の話は、公式の発表が出てから確かめてください。