Google 发布 ERA 科学编码工具并开放 Computational Discovery 访问
Google 在 Nature 发表论文介绍其研究工具 ERA,该工具基于 Gemini 编写和优化科学代码,在基因组学、流行病学等多个基准上达到专家级水平。
推荐理由:ERA 的 Nature 论文与 Gemini for Science 工具同步落地,读者可据此判断 AI 科学编码工具的实际可用性。
AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。
Google 在 Nature 发表论文介绍其研究工具 ERA,该工具基于 Gemini 编写和优化科学代码,在基因组学、流行病学等多个基准上达到专家级水平。
推荐理由:ERA 的 Nature 论文与 Gemini for Science 工具同步落地,读者可据此判断 AI 科学编码工具的实际可用性。
Google DeepMind 宣布 Project Genie 新增 Street View 落地能力,用户可基于美国真实地点生成可交互的虚拟世界,并可选 Ocean World、B&W film 等风格。该功能即日起逐步向全球 18 岁以上 Google AI Ultra 订阅者开放,未来将扩展至更多地区。
推荐理由:原文给出了Street View落地能力与订阅开放范围,读者可据此判断Genie在真实世界模拟上的实际可用性。
Google 发布 Gemini Omni 系列首个模型 Gemini Omni Flash,可结合图像、音频、视频和文本输入生成高质量视频,并支持通过自然语言对话编辑视频。
推荐理由:原文给出了Omni Flash的开放入口和核心能力,读者可以据此判断它如何改变视频创作与编辑工作流。
Google 发布 Gemini for Science,包含 Google Labs 上的三个实验工具(Hypothesis Generation、Computational Discovery、Literature Insights)以及 Google Antigravity 上的 Science Skills 技能包。
推荐理由:原文给出了面向科研场景的智能体工具集和开放入口,读者可以据此判断它如何加速科学发现流程。
Google 宣布扩展内容透明度和验证工具,覆盖 Search、Gemini、Chrome、Pixel 和 Cloud。SynthID 已为超 1000 亿张图片和视频及 6 万小时音频加水印,Gemini 应用中的 SynthID 验证功能已被使用 5000 万次,现正扩展到 Search 和 Chrome。
推荐理由:原文给出了内容溯源工具在搜索、Chrome、Pixel 和云端的扩展路径,读者可以据此判断行业内容验证标准的走向。
Google DeepMind 发布博客,展示其 AI 智能体 Co-Scientist 在爱丁堡大学的应用:研究人员用它梳理代谢功能障碍相关脂肪性肝炎(MASH)的文献,生成候选联合疗法假设。系统针对药物 resmetirom 仅对部分患者有效的问题,提出 NLRP3 炎症小体是连接炎症与代谢的分子桥梁,该假设随后得到实验验证。
推荐理由:原文展示了 Co-Scientist 在真实科研问题中生成可验证假设的完整案例,读者可据此评估其辅助科研发现的实际价值。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体系统,可迭代生成、辩论和进化科学假设。该系统通过假设生成工具向个人研究者开放,并已在肝纤维化、ALS、细胞衰老等研究中取得成果,包括发现一个在实验室测试中阻断91%疤痕相关反应的药物候选。
推荐理由:原文给出了多智能体系统的完整架构和多个真实科研应用案例,读者可以据此判断它在假设生成上的实际能力与开放入口。
Google DeepMind 发布 AlphaEvolve 年度影响报告,展示其作为 Gemini 驱动的编码智能体在多个领域的应用成果。在基因组学中,AlphaEvolve 改进 DeepConsensus 模型,将变异检测错误率降低 30%;在电网优化中,将 GNN 模型找到可行解的能力从 14% 提升至超过 88%。
推荐理由:原文汇总了 AlphaEvolve 在基因组学、电网、量子物理和商业场景中的具体成果,读者可据此评估其跨领域应用价值。
Mistral AI 发布 Workflows 公开预览,这是面向企业 AI 的编排层,提供持久执行、可观测性和人工审批能力,帮助将 AI 流程从概念验证推进到生产环境。
推荐理由:原文给出了企业级编排层的具体能力与部署模型,读者可据此判断它如何解决生产环境可靠性问题。
Google 宣布在 Google Photos 的 Auto frame 功能中推出新的 3D 感知图像编辑方法,可自动调整照片的相机视角和焦距,修复广角镜头造成的透视畸变。该方法分两步:先用 ML 模型估计 3D 场景和相机参数,再用生成式扩散模型补全新视角下缺失的内容,现已面向含人物的照片开放。
推荐理由:原文给出了技术原理和产品入口,读者可以据此判断这项功能对日常照片编辑的实际价值。
Google 推出 Vantage,一个利用生成式 AI 在模拟环境中评估未来技能的研究实验,现已开放英文版注册。Vantage 通过 AI 化身与学习者进行多轮对话,由 Executive LLM 动态引导对话以收集技能证据,再由 AI Evaluator 依据评分标准给出详细技能图谱。与纽约大学的联合研究显示,AI 评估者与人类专家的评分一致性接近专家之间的一致性。
推荐理由:原文介绍了 Vantage 的评估机制和与人类专家评分的一致性,读者可据此判断 AI 模拟评估的可靠性。
Mistral AI 发布 Spaces CLI,一个为人类开发者和编码智能体共同设计的命令行工具,可用三条命令完成项目脚手架、开发环境启动和部署。团队总结了设计原则:每个交互输入都有 flag 等价物、每个 flag 都有无头模式默认值、状态显式化、插件可内省、生成 context.json 和 AGENTS.md 上下文文件。
推荐理由:原文给出了 CLI 为智能体设计的完整原则清单,读者可据此改造自己的开发工具。
Google DeepMind 发布由 Gemini 驱动的 AI 指针原型,让用户通过指向和说话即可完成操作,无需编写复杂提示词。该能力已集成到 Chrome 中,用户可选中网页内容直接向 Gemini 提问,并即将在 Googlebook 推出 Magic Pointer。
推荐理由:原文给出了AI指针的交互原则和Chrome、Googlebook中的落地入口,读者可以据此判断这种免提示词交互会怎样改变日常使用AI的方式。
Google 发布 Vibe Coding XR 工作流,结合 Gemini 与 XR Blocks 框架,将自然语言直接转成可运行的 Android XR 应用,耗时不到 60 秒。
推荐理由:原文给出了将自然语言直接转成可运行 XR 应用的具体工作流和实测成功率,读者可以据此评估这类原型工具的成熟度。
Mistral AI 发布 Forge 系统,企业可利用内部文档、代码库和运营数据训练定制模型,支持预训练、后训练和强化学习全流程,并兼容稠密与 MoE 架构及多模态输入。Forge 已与 ASML、爱立信、欧洲航天局等机构合作,模型可在企业自有基础设施内运行,同时支持智能体通过自然语言微调模型和优化超参数。
推荐理由:原文给出了企业自训模型的完整能力栈和已落地客户名单,读者可据此评估其与通用模型的差异。
Google Research 宣布在 Flood Hub 上线城市山洪预报,利用基于 Gemini 从新闻报道中提取历史洪水事件构建的 Groundsource 数据集训练 LSTM 模型,可提前 24 小时预测人口密度超过 100 人/平方公里区域的山洪风险。模型目前以 20x20 公里分辨率运行,在多个全球南方国家的精度和召回率与美国 NWS 预警系统相当。
推荐理由:原文给出了新模型的技术路线和与现有系统的性能对比,读者可以据此判断AI驱动的城市山洪预警在欠发达地区的覆盖价值。
Mistral AI 发布 Voxtral Transcribe 2 系列,包含面向批量转写的 Voxtral Mini Transcribe V2 和面向实时应用的 Voxtral Realtime。
推荐理由:原文给出了新模型的精度、延迟和价格数据,读者可以据此评估其在实时语音场景中的性价比。
Mistral 发布终端原生编码智能体 Vibe 2.0,由 Devstral 2 模型家族驱动,新增自定义子智能体、执行前多选澄清、斜杠命令技能和统一智能体模式。Vibe 现已在 Le Chat Pro 和 Team 套餐上线,支持按量付费或自带 API key;Devstral 2 转为付费 API 访问,Experiment 计划仍提供免费额度。
推荐理由:原文给出了 Vibe 2.0 的新增控制能力和定价变化,读者可以据此判断它是否适合接入自己的开发工作流。
Mistral 发布 OCR 3,在表单、扫描件、复杂表格和手写内容上对 OCR 2 取得 74% 的整体胜率,定价为每 1000 页 2 美元,批量 API 享 5 折优惠。模型支持 markdown 输出和 HTML 表格结构重建,可通过 API 或 Mistral AI Studio 中的 Document AI Playground 使用,并保持与 OCR 2 完全向后兼容。
推荐理由:官方给出了新模型的性能提升、价格和接入方式,读者可以据此评估其在文档处理工作流中的性价比。
Mistral 推出 Le Chat 的 Memories(beta)功能,采用混合方式自动保存有用信息,并在召回时显示来源链接。用户可随时关闭记忆、使用无记忆的隐身对话、编辑或删除单条记忆,并支持导出和导入。官方还推出 Memory Insights 提示词,帮助用户探索记忆内容。
推荐理由:官方介绍了记忆功能的设计原则和具体能力,读者可以据此判断其透明可控的召回方式是否适合自己。