跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

72条精选相关主题模型发布行业动态AI 编码

最新精选

第 41–60 条 · 共 72 条
5月20日周三
5月18日周一
  1. Google DeepMind62

    Project Genie 接入 Street View 并面向 Google AI Ultra 订阅者全球开放

    Google DeepMind 宣布 Project Genie 新增 Street View 落地能力,用户可基于美国真实地点生成可交互的虚拟世界,并可选 Ocean World、B&W film 等风格。该功能即日起逐步向全球 18 岁以上 Google AI Ultra 订阅者开放,未来将扩展至更多地区。

    推荐理由:原文给出了Street View落地能力与订阅开放范围,读者可据此判断Genie在真实世界模拟上的实际可用性。

5月17日周日
  1. Google DeepMind70

    Google 推出 Gemini for Science:科学智能体工具与实验集

    Google 发布 Gemini for Science,包含 Google Labs 上的三个实验工具(Hypothesis Generation、Computational Discovery、Literature Insights)以及 Google Antigravity 上的 Science Skills 技能包。

    推荐理由:原文给出了面向科研场景的智能体工具集和开放入口,读者可以据此判断它如何加速科学发现流程。

  2. Google DeepMind62

    Google 扩展内容溯源与验证工具,覆盖搜索、Chrome、Pixel 和云端

    Google 宣布扩展内容透明度和验证工具,覆盖 Search、Gemini、Chrome、Pixel 和 Cloud。SynthID 已为超 1000 亿张图片和视频及 6 万小时音频加水印,Gemini 应用中的 SynthID 验证功能已被使用 5000 万次,现正扩展到 Search 和 Chrome。

    推荐理由:原文给出了内容溯源工具在搜索、Chrome、Pixel 和云端的扩展路径,读者可以据此判断行业内容验证标准的走向。

5月16日周六
  1. Google DeepMind60

    Google DeepMind 展示 Co-Scientist 加速肝病机制发现

    Google DeepMind 发布博客,展示其 AI 智能体 Co-Scientist 在爱丁堡大学的应用:研究人员用它梳理代谢功能障碍相关脂肪性肝炎(MASH)的文献,生成候选联合疗法假设。系统针对药物 resmetirom 仅对部分患者有效的问题,提出 NLRP3 炎症小体是连接炎症与代谢的分子桥梁,该假设随后得到实验验证。

    推荐理由:原文展示了 Co-Scientist 在真实科研问题中生成可验证假设的完整案例,读者可据此评估其辅助科研发现的实际价值。

5月12日周二
  1. Google DeepMind75

    Google DeepMind 发布 Co-Scientist 多智能体科研助手,开放个人研究者申请

    Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体系统,可迭代生成、辩论和进化科学假设。该系统通过假设生成工具向个人研究者开放,并已在肝纤维化、ALS、细胞衰老等研究中取得成果,包括发现一个在实验室测试中阻断91%疤痕相关反应的药物候选。

    推荐理由:原文给出了多智能体系统的完整架构和多个真实科研应用案例,读者可以据此判断它在假设生成上的实际能力与开放入口。

5月6日周三
  1. Google DeepMind78

    Google DeepMind 发布 AlphaEvolve 年度影响报告

    Google DeepMind 发布 AlphaEvolve 年度影响报告,展示其作为 Gemini 驱动的编码智能体在多个领域的应用成果。在基因组学中,AlphaEvolve 改进 DeepConsensus 模型,将变异检测错误率降低 30%;在电网优化中,将 GNN 模型找到可行解的能力从 14% 提升至超过 88%。

    推荐理由:原文汇总了 AlphaEvolve 在基因组学、电网、量子物理和商业场景中的具体成果,读者可据此评估其跨领域应用价值。

4月27日周一
4月23日周四
  1. Google Research62

    Google Photos 推出 Auto frame 功能,用 3D 感知重构图修复拍摄角度

    Google 宣布在 Google Photos 的 Auto frame 功能中推出新的 3D 感知图像编辑方法,可自动调整照片的相机视角和焦距,修复广角镜头造成的透视畸变。该方法分两步:先用 ML 模型估计 3D 场景和相机参数,再用生成式扩散模型补全新视角下缺失的内容,现已面向含人物的照片开放。

    推荐理由:原文给出了技术原理和产品入口,读者可以据此判断这项功能对日常照片编辑的实际价值。

4月14日周二
  1. Google Research62

    Google 推出 Vantage:用生成式 AI 评估未来技能

    Google 推出 Vantage,一个利用生成式 AI 在模拟环境中评估未来技能的研究实验,现已开放英文版注册。Vantage 通过 AI 化身与学习者进行多轮对话,由 Executive LLM 动态引导对话以收集技能证据,再由 AI Evaluator 依据评分标准给出详细技能图谱。与纽约大学的联合研究显示,AI 评估者与人类专家的评分一致性接近专家之间的一致性。

    推荐理由:原文介绍了 Vantage 的评估机制和与人类专家评分的一致性,读者可据此判断 AI 模拟评估的可靠性。

3月31日周二
  1. Mistral AI62

    Mistral AI 发布 Spaces CLI,为人类与智能体共同设计

    Mistral AI 发布 Spaces CLI,一个为人类开发者和编码智能体共同设计的命令行工具,可用三条命令完成项目脚手架、开发环境启动和部署。团队总结了设计原则:每个交互输入都有 flag 等价物、每个 flag 都有无头模式默认值、状态显式化、插件可内省、生成 context.json 和 AGENTS.md 上下文文件。

    推荐理由:原文给出了 CLI 为智能体设计的完整原则清单,读者可据此改造自己的开发工具。

3月29日周日
  1. Google DeepMind65

    Google DeepMind 发布 AI 指针,重新构想鼠标交互

    Google DeepMind 发布由 Gemini 驱动的 AI 指针原型,让用户通过指向和说话即可完成操作,无需编写复杂提示词。该能力已集成到 Chrome 中,用户可选中网页内容直接向 Gemini 提问,并即将在 Googlebook 推出 Magic Pointer。

    推荐理由:原文给出了AI指针的交互原则和Chrome、Googlebook中的落地入口,读者可以据此判断这种免提示词交互会怎样改变日常使用AI的方式。

3月25日周三
3月18日周三
  1. Mistral AI60

    Mistral AI 推出 Forge,支持企业用专有数据训练前沿级模型

    Mistral AI 发布 Forge 系统,企业可利用内部文档、代码库和运营数据训练定制模型,支持预训练、后训练和强化学习全流程,并兼容稠密与 MoE 架构及多模态输入。Forge 已与 ASML、爱立信、欧洲航天局等机构合作,模型可在企业自有基础设施内运行,同时支持智能体通过自然语言微调模型和优化超参数。

    推荐理由:原文给出了企业自训模型的完整能力栈和已落地客户名单,读者可据此评估其与通用模型的差异。

3月12日周四
  1. Google Research78

    Google Research 推出 AI 驱动的城市山洪预报,最长提前 24 小时预警

    Google Research 宣布在 Flood Hub 上线城市山洪预报,利用基于 Gemini 从新闻报道中提取历史洪水事件构建的 Groundsource 数据集训练 LSTM 模型,可提前 24 小时预测人口密度超过 100 人/平方公里区域的山洪风险。模型目前以 20x20 公里分辨率运行,在多个全球南方国家的精度和召回率与美国 NWS 预警系统相当。

    推荐理由:原文给出了新模型的技术路线和与现有系统的性能对比,读者可以据此判断AI驱动的城市山洪预警在欠发达地区的覆盖价值。

2月5日周四
1月28日周三
  1. Mistral AI70

    Mistral 发布终端原生编码智能体 Vibe 2.0

    Mistral 发布终端原生编码智能体 Vibe 2.0,由 Devstral 2 模型家族驱动,新增自定义子智能体、执行前多选澄清、斜杠命令技能和统一智能体模式。Vibe 现已在 Le Chat Pro 和 Team 套餐上线,支持按量付费或自带 API key;Devstral 2 转为付费 API 访问,Experiment 计划仍提供免费额度。

    推荐理由:原文给出了 Vibe 2.0 的新增控制能力和定价变化,读者可以据此判断它是否适合接入自己的开发工作流。

12月17日周三
  1. Mistral AI68

    Mistral 发布 OCR 3,性能大幅提升并上线 Document AI Playground

    Mistral 发布 OCR 3,在表单、扫描件、复杂表格和手写内容上对 OCR 2 取得 74% 的整体胜率,定价为每 1000 页 2 美元,批量 API 享 5 折优惠。模型支持 markdown 输出和 HTML 表格结构重建,可通过 API 或 Mistral AI Studio 中的 Document AI Playground 使用,并保持与 OCR 2 完全向后兼容。

    推荐理由:官方给出了新模型的性能提升、价格和接入方式,读者可以据此评估其在文档处理工作流中的性价比。

9月2日周二
  1. Mistral AI62

    Mistral 推出 Le Chat 记忆功能(beta)

    Mistral 推出 Le Chat 的 Memories(beta)功能,采用混合方式自动保存有用信息,并在召回时显示来源链接。用户可随时关闭记忆、使用无记忆的隐身对话、编辑或删除单条记忆,并支持导出和导入。官方还推出 Memory Insights 提示词,帮助用户探索记忆内容。

    推荐理由:官方介绍了记忆功能的设计原则和具体能力,读者可以据此判断其透明可控的召回方式是否适合自己。