ソネット5.5が抜け出し、本番テストではGPT-6ソルを粉砕しアストラに肉薄

📅 2026-09-28

要約:

Opus 5.5 がリリースされてからわずか数日後に Sonnet 5.5 もリリースされるとは誰が予想したでしょうか?昨夜以来、X 界隈でこのニュースが広まっています。ソネット 5.5 が間もなく、おそらく米国時間の火曜日の午後にリリースされる予定です。演奏的にはソネット 5.5 の方がオーパス 5.5 に近いですが、価格はオーパス 5.5 よりもはるかに安いです。現在、Sonnet 5.5 はリリース前の最終段階に入り、Claude Code でグレースケールのテストが開始されています。

多くの社内ベータ テスターに​​よって公開されたデモは、Sonnet 5.5 が新しくリリースされた GPT-6 Sol を圧倒し、コーディングとエージェント機能の点で OpenAI の主力 GPT-6 Astra にさえ近づいていることを示しています。

さらに衝撃的なのは、その価格が地球の中心に直接到達し、100 万トークンの入力に対して 2 ドルという低さであることです。

リークされたリリース日が本当であれば、Anthropic は OpenAI の Dev Dayl を狙撃することを決意しているようです。

Sonnet 5.5 がリークされ、専用のモデル識別子が登場

Anthriopic が 9 月 22 日に突然 Opus 5.5 をリリースしたとき、公式文書に「Sonnet 5.5 と Haiku 5.5 は数週間以内にリリースされる予定です」と書いたことを今でも覚えています。

Sonnet 5.5 がこんなに早く登場するとは誰も思っていませんでした。

つい昨日、開発者 V @Mr_Salio が X に関するニュースを発表しました。Claude Sonnet 5.5 が捕まったということです。そのニュースは瞬時にインターネット全体に広がりました。

アーティファクトには、Sonnet 5.5 専用のモデル構成識別子「claude-sonnet-5-5」が表示されています。

それだけでなく、同じ設定ファイル内に「claude-opus-5-5」、「claude-sonnet-5」、そして謎の「claude-fable-5.1」も並んでいます。

フロントエンド コードの記述は、モデルがサーバーにインストールされ、スイッチを待っているだけであることを意味します。

その後、ビッグ V @notjazii も、Sonnet 5 が実際には約 1 週間前に「秘密テスト」のために密かにバージョン 5.5 に変更されたというニュースを発表しました。

グレースケールで検出されましたか?今回は古い方法を使用します。

クロード コードを開き、ネットワーク機能とメモリ機能をオフにして、直接質問してください: リセット ブラザー ティボを知っていますか?インターネットとメモリを使用しないでください。

古いバージョンのモデルを使用している場合は、意味が不明瞭になる可能性があります。ただし、バージョン 5.5 にルーティングされている場合は、Tibo と Codex のリセット ジョークの詳細が正確に説明されます。

何人かのネチズンは、実際のテストを通じて、一部のアカウントが実際にサイレントに切り替えられ、事前に Opus 5.5 を経験していることを確認しました。

必ずクロード コードを使用してください

ネットワーク全体での実際のテストは非常に低いため、実際に GPT-6 を上回ります

これまで共有された実際の測定値を要約すると、Sonnet 5.5 は実際に GPT-6 Sol を粉砕しましたか?

まず第一に、これは純粋な JS フロントエンド UI/アニメーションの極限対決であり、4 つの主流の大型モデルが同じステージで競い合います。

開発者 @notjazii は、「プロンプト ワード アニメーション生成を備えた 4 つの主流モデルの比較」という、視覚的にインパクトのある一連の実際のテストをリリースしました。

彼は、複雑な UI アニメーション効果を生成するためにモデルを必要としています。

アニメーションの比較を投稿した後、@notjazii は次のようにコメントしました。「Sonnet 5.5 は両方の OpenAI モデル (Sol と Astra) を本当に地面にこすりつけました!」

実際、下の図からわかるように、Sonnet 5.5 は強力なコーディングの直感と美的センスを示しています。

GPT-6 アストラ

GPT-6 ソル

クロード作品 5.5

クロード ソネット 5.5

一部のネチズンはこの結果を見て信じられない様子でした。「UI とアニメーションでは常にクロードの方が強かったが、これが純粋なコードによって生成されたとしたら、それが真実であるとは信じられないでしょう!」

Big V @chetaslua は、Sonnet 5.5 の日常的なコーディング能力とコーディングの感触をテストすることに重点を置きました。

彼は同じ 3 つのプロンプト ワードを使用して 6 つの並列実行を実行し、各モデルを 1 回生成しましたが、出力結果は変更されませんでした。

Sonnet 5.5 は最終的に 90 ~ 131 KB のファイルを 3 つ生成し、すべての実行で 90 分の上限に達しました。 GPT-6 Sol は 20 ~ 29 KB のファイル サイズを生成し、9 ~ 12 分かかりました。

彼は興奮気味にこう言いました。「さあ、Claude Code を使ってみましょう! Ultracode モードの Sonnet 5.5 は驚くほど高速です。非常に効率的であるだけでなく、Sonnet 4 時代の極めて自然な "人間味" も取り戻しています!」

彼の意見では、同じ価格帯と同じプロンプトの言葉で、Sonnet 5.5 は GPT-6 Sol を打ち負かしました。

OpenAI がさらに恐ろしいのは、Sonnet 5.5 が GPT-6 Sol を粉砕するほど単純ではなくなっていることです。

内部告発者の @srikanthvaluri と @buildwithrajath は、初期の総合的な実際のテストの結果、次のように指摘しました。「Sonnet 5.5 のパフォーマンスは予想をはるかに上回っていました。研磨面では GPT-6 Astra がまだわずかに優れていますが、Sonnet 5.5 のパフォーマンスは Astra とまったく同等です。」

信じられないことに、高度なコーディング機能やエージェント機能の点でも Astra に近いものがあります。

ソネットですらアストラを潰したと嘆く人もいます。私たちはどんな時代に突入しているのでしょうか?

コストパフォーマンスの王様、プライスブッチャー

測定されたパフォーマンスを上回ることが OpenAI に「不快感」を与えるだけであるならば、Sonnet 5.5 によって明らかにされた価格設定は OpenAI の根幹に食い込んでいることになります。

アストラに近い性能を持ち、ソルを上回るこの「魔法のモデル」は、完全にローエンド市場に合わせた価格設定であることが明らかになりました。

入力: $2 / 100 万トークン

出力: 100 万トークンあたり 10 ドル

キャッシュ読み取り: 100 万トークンあたりわずか 0.20 ドル!

これは、Anthropic が最先端の AI 機能を「キャベツ価格」で提供していることを意味します。

OpenAI の GPT-6 Sol と Luna は、GPT-5.6 の半額であり、高頻度のシナリオを捉えることを目的としています。

しかし現在、Anthropic は Sonnet 5.5 と同じ価格帯に入りましたが、そのパフォーマンスははるかに強力です。

「Anthropic が、非常に競争力のある価格で Opus 5.5 のような大幅なパフォーマンスの飛躍的向上を実現できれば、OpenAI は反撃できなくなるでしょう。」誰かがコメントしました。

開発者の Rajath Gowda 氏は、率直にこう言いました。「Sonnet 5.5 は OpenAI にとって大きな問題になりつつあります。もしそれが本当に Opus 5.5 に近づいたら、Anthropic は最先端の機能を非常に安価にするでしょう。これは OpenAI が最も心配すべきことです。」

Anthropic の戦略的意図は明らかです。Opus 5.5 を使用してハイエンドの王座を保持し、Sonnet 5.5 を使用して究極の費用対効果でミッドレンジおよびデイリー開発市場を完全に引き継ぎます。

Anthropic が顔を開いて DevDay を殺す

さらに、リリースのタイミングは、製品自体よりも劇的であることがよくあります。

OpenAI が GPT-6 Sol と Luna をリリースしたのと同じ日に、Anthropic は Claude Opus 5.5 を直接リリースしました。前世代よりもパフォーマンスが向上し、コストが 40% 削減され、30% 高速になりました。

過去 2 週間で、Anthropic はさらに輝かしい結果を達成しました。クロードは物理学の 9 円の振幅を計算し、世界記録を破りました。未知の生物学的酵素システムを発見しました。また、2,000 を超えるプラグインを含む Claude Marketplace も立ち上げました。

対照的に、OpenAI は最近、内部モデルに関する論争を抱えているだけでなく、AI によるユーザー画像の漏洩や研究者の GitHub トークン不正行為の暴露など、不整合な事件も暴露しています。

来週の火曜日 (9 月 29 日) は、OpenAI が非常に重視している年次開発者カンファレンスである DevDay です。

この時点で、Sonnet 5.5 グレー テストがネットワーク全体を席巻しました。

多くの偉い人たちがこの話題を騒がせました。「モデルは来週リリースされる予定です。来週の火曜日 (DevDay) になると思います。誰もがそれを知っています。」

おそらく、明日のニューヨーク時間午後 2 時に大規模なウォームアップが行われるでしょう。

ある人は、「OpenAI には悪いと思う。彼らは DevDay で強く対応したほうがいい。そうしないと本当にひどいことになる。」

Sonnet 5.5 を支える主要なテクノロジー

新しいバージョンがこれほど早くリリースされる理由は、Anthropic がすでに RL/トレーニング後のプロセスを理解しているためかもしれません。

すべての鍵となるのは高品質のデータです。

Anthropic がどのようにしてこれほど高速に反復できるのかと尋ねられたとき、業界リーダーの @yacineMTB は、そのコアは非常に高水準のデータ フライホイールであると推測しました。

「しかし、私はまだショックを受けています。彼らはどうやってそれをしたのですか?」

Anthropic は大規模モデル開発の「内部閉ループ」を実現し、AI を使用して AI を作成しています。

内部定量データの最新の暴露によると、Anthropic は「データ フライホイール」を敵対者を怖がらせる速度に変えました。

中核となる研究開発作業の 26% は AI (前世代のクロード モデル) によって主導されてきました。

自作コードの 80% 以上は、大きなモデルによって独立して記述されています。

これは単に「コスト削減と効率向上」という単純な話ではなく、技術的には

再帰的自己改善 (RSI) が現れ始めていることを意味します

。

Anthropic は、早ければ 2027 年にはクロードが完全に自動化される可能性があり、その頃には反復速度がさらに高速になる可能性があると推定しています。

ASI の 2 人の英雄が決闘しており、Google も行動を起こす準備ができています。私たち一般ユーザーはただ座して戦いを待つだけです。

ビッグ V トークン グレムリンはこう言いました。「来週の AI サークルでは、これまで見たことのないシーンが繰り広げられます。時間を解放し、スケジュールをクリアし、精神的に準備を整え、手元にある最も困難なワークフローを後回しにしてください。信じてください、これから起こることがあなたの働き方を完全に変えるでしょう。」

Sonnet 5.5 の登場は、「手頃な価格で高品質な AI 時代」の正式な到来を示しています。

2 米ドルで、100 万トークンの「Baicai インフラストラクチャ」を購入できます。

非常に低コストのキャッシュ読み取り ($0.20/M) により、超長コンテキスト メモリを備えたパーソナル AI アシスタントを誰でも簡単に構築できます。

準備はできていますか?このニュースが本当であれば、24時間以内に新しいモデルが乗れるようになるでしょう。

参考資料:

https://x.com/notjazii/status/2103884749202993411

https://x.com/notjazii/status/2103884167104831573

https://x.com/chetaslua/status/2104153687077904613

https://x.com/chetaslua/status/2104259190432903599

https://x.com/Mr_Salio/status/2104210803545030792

https://x.com/Mr_Salio/status/2104178854633849145/

関連タグ

関連記事

コメント

0/500
Captcha (click to refresh)
コメントなし