GPT-5.6系列模型的社区反馈、基准表现和使用建议 Bensz | 2026-7-12 19:42 | 193 | 人工智能 5665 字 | 24 分钟 概览 这次升级最实用的变化,不是多了一个“最强模型”,而是终于有了三档可选:Sol 攻坚、Terra 干日常活、Luna 跑可验证的批量任务。 Sol 在终端、代理式编码、网页浏览和电脑操作上确有亮点;但代码基准之间的排序并不一致,暂时还不能简单喊“全面领先”。 Terra 的 API 单价只有 Sol 一半,几项代理测试却咬得很紧。对多数开发者,… ai-applicationchatgpt