跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

最新精选

第 21–39 条 · 共 40 条
7月15日周三
  1. Hugging Face Blog80

    Thinking Machines 发布开源多模态模型 Inkling 及 Inkling-Small

    Thinking Machines Lab 在 Hugging Face 发布开源多模态模型 Inkling,约 1T 参数、1M 上下文,原生支持图像、文本和音频输入,具备智能体能力,并推出 276B 总参数、12B 激活参数的 Inkling-Small 版本。

    推荐理由:原文给出了 Inkling 的架构细节、部署配置和基准表现,读者可以据此评估它在多模态推理场景下的适用性。

7月8日周三
  1. Mistral AI72

    Mistral AI 发布 8B 具身导航模型 Robostral Navigate,单 RGB 摄像头实现 76.6% 未见环境成功率

    Mistral AI 发布首个具身导航模型 Robostral Navigate,这是一个 8B 参数模型,仅凭单个 RGB 摄像头和自然语言指令即可让机器人在复杂环境中自主导航。

    推荐理由:原文给出了模型在未见环境基准上的具体得分和单摄像头方案优势,读者可以据此判断其相对现有导航方案的竞争力。

7月2日周四
  1. Mistral AI78

    Mistral 发布 Leanstral 1.5:6B 激活参数模型刷新形式化验证基准

    Mistral AI 发布 Leanstral 1.5,这是一个 Apache-2.0 许可的模型,总参数 119B、激活参数仅 6B。它在 miniF2F 上达到 100%,解决 587/672 道 PutnamBench 题目,并在 FATE-H(87%)和 FATE-X(34%)上取得新 SOTA。

    推荐理由:该模型在形式化验证基准上刷新成绩,并展示了在真实代码库中发现未知 bug 的能力,为形式化方法在工程中的落地提供了参考。

6月11日周四
  1. Google DeepMind78

    Google DeepMind 发布开源实验模型 DiffusionGemma,GPU 上文本生成速度最高提升 4 倍

    Google DeepMind 发布开源实验模型 DiffusionGemma,这是一个 26B 参数的 MoE 模型,通过文本扩散技术并行生成整块文本,在专用 GPU 上推理速度最高提升 4 倍,单张 NVIDIA H100 上每秒可生成 1000+ token。

    推荐理由:原文给出了速度、参数量和硬件门槛等关键数字,读者可以据此判断它适合哪些本地交互场景。

4月16日周四
  1. Google DeepMind62

    Google DeepMind 发布 Gemini 3.1 Flash TTS 语音模型

    Google DeepMind 发布 Gemini 3.1 Flash TTS,这是最新的文本转语音模型,主打更强的可控性、表现力和质量。该模型在 Artificial Analysis TTS 榜单上取得 Elo 1211 分,支持 70 多种语言和原生多说话人对话,并引入音频标签功能,可通过自然语言指令精细控制语速、语气和表达。

    推荐理由:官方介绍了新 TTS 模型的音频标签控制能力和评测成绩,读者可据此判断其表达力与可控性提升。

4月13日周一
  1. Google DeepMind62

    Google DeepMind 发布 Gemini Robotics-ER 1.6,增强具身推理能力

    Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其推理优先模型的重大升级,通过增强空间推理和多视角理解,让机器人更精准地感知环境。

    推荐理由:官方介绍了新模型在空间推理、多视角理解和仪表读取上的能力提升,并给出 API 开放入口,读者可据此评估其落地价值。

4月3日周五
3月24日周二
  1. Mistral AI73

    Mistral AI 发布 Voxtral TTS 语音合成模型

    Mistral AI 发布 Voxtral TTS,这是其首个文本转语音模型,4B 参数,支持 9 种语言,具备情感表达和低延迟(70ms)特性。模型可通过 API 使用,定价为每 1k 字符 $0.016,并提供开源权重版本。

    推荐理由:原文给出了 Voxtral TTS 的参数量、定价、延迟和与 ElevenLabs 的对比评测,读者可据此评估它在语音智能体场景中的可用性。

3月17日周二
  1. Mistral AI78

    Mistral 发布 Mistral Small 4:统一推理、多模态与智能体编码能力的开源模型

    Mistral 发布 Mistral Small 4,这是首个将 Magistral 推理、Pixtral 多模态和 Devstral 智能体编码能力统一到单一模型中的 Mistral 模型。

    推荐理由:Mistral Small 4 将推理、多模态与智能体编码能力统一到一个开源模型中,并给出可配置推理强度与效率数据,便于评估其部署价值。

12月9日周二
  1. Mistral AI78

    Mistral 发布 Devstral 2 系列编码模型及 Mistral Vibe CLI

    Mistral AI 发布下一代开源编码模型 Devstral 2(123B,修改版 MIT 许可)和 Devstral Small 2(24B,Apache 2.0),两者均支持 256K 上下文窗口,在 SWE-bench Verified 上分别取得 72.2% 和 68.0% 的成绩。

    推荐理由:原文给出了新模型在 SWE-bench Verified 上的成绩、与竞品的参数和成本对比,以及配套 CLI 工具,读者可以据此评估开源编码模型的性价比。

12月3日周三
  1. Mistral AI80

    Mistral 发布 Mistral 3 系列模型,含 675B 参数 MoE 旗舰与 3B/8B/14B 边缘模型

    Mistral AI 发布 Mistral 3 系列,包含三个小尺寸稠密模型(14B、8B、3B)和旗舰 Mistral Large 3,后者为稀疏 MoE 架构,激活 41B、总参数 675B,全部以 Apache 2.0 许可证开源。

    推荐理由:Mistral 3 系列以 Apache 2.0 开源,覆盖从 3B 到 675B 参数的多档模型,并首次回归稀疏 MoE 架构,读者可据此评估其在大模型生态中的定位与可用性。

7月15日周二
  1. Mistral AI80

    Mistral 发布 Voxtral 语音理解模型,24B 与 3B 双版本开源

    Mistral 发布 Voxtral 语音理解模型,提供 24B 和 3B 两个版本,均以 Apache 2.0 协议开源并上线 API。Voxtral 支持 32k token 上下文、多语言、问答与摘要及函数调用,定价从每分钟 0.001 美元起,在转录任务上优于 Whisper large-v3,价格低于同类 API 一半。

    推荐理由:原文给出了两款开源语音模型的规模、价格和基准对比,读者可以据此评估其在转录与理解任务上的性价比。

7月11日周五
6月10日周二
5月28日周三
  1. Mistral AI60

    Mistral 发布首个代码专用嵌入模型 Codestral Embed

    Mistral 发布首个代码专用嵌入模型 Codestral Embed,在真实代码检索任务上显著优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的嵌入模型。模型支持不同维度和精度,256 维 int8 精度仍优于竞品,API 定价为每百万 token 0.15 美元,批量 API 享五折优惠。

    推荐理由:原文给出了模型在代码检索上的基准表现和定价,读者可以据此评估它在代码助手场景中的适用性。

5月21日周三
  1. Mistral AI77

    Mistral AI 发布开源编码智能体 Devstral,SWE-Bench Verified 得分 46.8%

    Mistral AI 与 All Hands AI 合作推出面向软件工程任务的智能体大模型 Devstral,在 SWE-Bench Verified 上取得 46.8% 的得分,超过此前开源 SoTA 模型 6 个百分点以上,并超越 DeepSeek-V3-0324 和 Qwen3 232B-A22B 等更大模型。

    推荐理由:原文给出了 Devstral 在 SWE-Bench Verified 上的得分和与闭源模型的对比,读者可以据此判断开源编码智能体的当前水平。

5月7日周三
  1. Mistral AI73

    Mistral 发布 Mistral Medium 3,主打低成本高性能

    Mistral AI 发布 Mistral Medium 3,在多数基准上达到 Claude Sonnet 3.7 的 90% 以上性能,定价为每百万 token 输入 0.4 美元、输出 2 美元,成本显著更低。该模型在编码和 STEM 任务上表现突出,支持混合或本地部署,API 即日起在 Mistral La Plateforme 和 Amazon SageMaker 上线。

    推荐理由:原文给出了性能对比和定价,读者可以据此判断它在中端模型中的性价比位置。

3月17日周一
  1. Mistral AI74

    Mistral 发布 Mistral Small 3.1,支持多模态与 128k 上下文

    Mistral 发布 Mistral Small 3.1,在文本性能、多模态理解和 128k 上下文窗口上均有提升,推理速度达每秒 150 token,并超越 Gemma 3 和 GPT-4o Mini。模型以 Apache 2.0 许可开源,可在单张 RTX 4090 或 32GB 内存的 Mac 上运行,即日起可通过 API 和 Google Cloud Vertex AI 使用。

    推荐理由:原文给出了性能对比、推理速度和开源许可,读者可以据此判断它是否适合端侧或企业部署。