Xwriter / 热点
← 所有热点X2026/9/18
神秘模型在编程基准上力压 GPT-5.6 Sol
一个新的神秘模型在 DeepSWE 上拿下 74% 的成绩,超过了 GPT-5.6 Sol 以及大多数其他模型,据称在 Terminal-Bench 2.1 和 SWE-Bench Verified 上也同样领先,成本还更低。@kimmonismus 押注这又是一个中国模型——目前基准排行榜的变化速度相当快。
查看原始来源 ↗基于这条生成一条推文信息仅供写作研究。发布前请核对原始来源;市场数据不构成投资建议。