跳到正文

#Agent

今日 0 条
9月25日周五
  1. Google Research62

    Google Research 提出 AI 视频联合导演框架,自动化长视频生成

    Google Research 发布 AI 视频联合导演框架,通过多智能体架构在 Gemini 和 Veo 之上实现长视频的视觉一致性规划。该框架包含 Co-Director、CANVAS、A²RD 和 VQQA 四个组件,分别处理创意编排、视觉故事板、时序扩展和闭环优化,在 GenAD-Bench 上取得 81.4 的峰值质量分,并能在多分钟视频中缓解视觉漂移和错误传播。

    推荐理由:原文给出了一套多智能体框架在长视频一致性上的完整方案和基准数据,读者可以据此评估其相对现有方法的实际增益。

9月23日周三
9月11日周五
9月9日周三
  1. Mistral AI62

    Mistral 用 AI 智能体迁移 4 万行 Fortran 77 遗留代码

    Mistral 帮助一家欧洲能源运营商将 4 万行 Fortran 77 物理模拟器迁移到 C++,并总结了三条经验:先构建数值一致性验证框架、整理文档、采用带人工审查的结构化智能体工作流。项目首阶段完成 30 万行代码中的 4 万行核心功能。

    推荐理由:原文用真实迁移案例拆解了遗留代码现代化的完整流程,读者可借鉴其验证与工作流设计。

9月3日周四
  1. Google DeepMind62

    谷歌推出 Fairwind 计划,向政府和企业提供自主网络防御能力

    谷歌今日推出 Fairwind 计划,这是一个面向政府和可信合作伙伴的受限访问项目,提供其最先进的网络防御能力。该计划首先让防御者使用 Gemini 3.8 Flash Cyber 模型配合 CodeMender 工具,自主发现并修复漏洞,在组织安全云环境中几分钟内生成可部署的补丁。目前已有超过 650 家参与伙伴,谷歌还通过 Google.org 将网络安全资助总额提升至超过 1 亿美元。

    推荐理由:原文介绍了面向政府和企业的受限访问计划,读者可据此了解谷歌如何将前沿模型用于自主漏洞修复。

8月20日周四
  1. Mistral AI75

    Mistral 发布 Agentic Search,多步检索提升复杂文档问答准确率

    Mistral 发布 Agentic Search,通过 search、open、navigate、read、grep 五个工具实现多步检索循环,让模型在长文档和跨来源中查找、定位并验证信息。

    推荐理由:原文给出 Agentic Search 在 FinanceBench 和 OfficeQA Pro 上的准确率、延迟与 token 消耗数据,读者可据此评估多步检索相对传统 RAG 的实际收益。

5月8日周五
  1. Berkeley AI Research62

    自适应并行推理:高效推理扩展的新范式综述

    Berkeley AI Research 发布综述,介绍自适应并行推理(APR)范式,让模型自行决定何时分解任务、并行生成多少线程以及如何协调。文章比较了 Multiverse、ThreadWeaver、Parallel-R1 等方法的推理系统设计与训练奖励机制,并讨论了并行化是否主要作为训练期探索脚手架等开放问题。

    推荐理由:文章梳理了自适应并行推理这一范式的动机、实现与训练方法,并比较了不同方案的取舍,适合想了解推理扩展新方向的读者。