Xwriter / 注目トピック
← すべての注目トピックX2026/9/18
謎のステルスモデルがGPT-5.6 Solをコーディングベンチマークで上回る
新たなステルスモデルがDeepSWEで74%を記録し、GPT-5.6 Solを含むほとんどのモデルを上回った。Terminal-Bench 2.1とSWE-Bench Verifiedでも上回っていると報じられ、コストも安いという。@kimmonismusは中国系モデルではないかと見ている——ベンチマーク首位の入れ替わりが今かなり速い。
元の情報源を開く ↗この視点から投稿を生成執筆調査用の情報です。公開前に一次情報を確認してください。市場データは投資助言ではありません。