Xwriter

Xwriter / 注目トピック

すべての注目トピック
X2026/9/18

謎のステルスモデルがGPT-5.6 Solをコーディングベンチマークで上回る

新たなステルスモデルがDeepSWEで74%を記録し、GPT-5.6 Solを含むほとんどのモデルを上回った。Terminal-Bench 2.1とSWE-Bench Verifiedでも上回っていると報じられ、コストも安いという。@kimmonismusは中国系モデルではないかと見ている——ベンチマーク首位の入れ替わりが今かなり速い。

元の情報源を開くこの視点から投稿を生成

執筆調査用の情報です。公開前に一次情報を確認してください。市場データは投資助言ではありません。