Anthropic 发布 Claude Sonnet 5.5,速度提升 30% 以上且成本更低
Anthropic 今日发布 Claude Sonnet 5.5,官方称其运行速度快 30% 以上,大多数任务成本降低最多 30%,定价与 Sonnet 5 相同但在各项基准上表现更优。该模型现用于 claude.ai 免费层,作者实测其免费层生成 WebGL 3D 页面效果不错,并指出 Haiku 5.5 将在未来几周内推出。
Anthropic 今日发布 Claude Sonnet 5.5,官方称其运行速度快 30% 以上,大多数任务成本降低最多 30%,定价与 Sonnet 5 相同但在各项基准上表现更优。该模型现用于 claude.ai 免费层,作者实测其免费层生成 WebGL 3D 页面效果不错,并指出 Haiku 5.5 将在未来几周内推出。
Anthropic 发布 Claude Sonnet 5.5,输出速度提升超 30%,单任务成本最高降低 30%,在多项基准上接近 Opus 5.5。
推荐理由:Sonnet 5.5 在编码和知识工作基准上逼近 Opus 5.5,同时单任务成本降低,读者可据此评估中端模型的性价比。
NVIDIA 公布 MLPerf Inference v6.1 结果,Vera Rubin NVL72 首次提交即在 Qwen3-VL 上实现最高 3.7 倍于 GB300 NVL72 的吞吐,在 DeepSeek-R1 上最高 2.5 倍。
Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking 两款语音对话模型,前者面向规模化与成本效率,后者面向高复杂度任务并支持边推理边说话。
推荐理由:原文给出了两款语音模型的定位差异、基准成绩和开放渠道,读者可以据此判断它们适合哪些语音智能体场景。
Google DeepMind 和 Google Research 发布 WeatherNext 3,据 Brightband 独立实时评测为目前最先进、最准确的全球天气模型。
推荐理由:原文给出了模型在分辨率、更新频率和降水精度上的具体提升,读者可以据此判断新一代天气模型的实际能力。