跳到正文

#部署/工程

今日 0 条
9月28日周一
  1. Mistral AI42

    Mistral 在慕尼黑开设德国中心,推进欧洲工业 AI

    Mistral 在慕尼黑开设新中心,聚焦 Physics AI 与工业 AI,并组建专门研究团队服务企业客户。公司计划到 2030 年在欧洲建成 1 吉瓦算力,其开放权重架构允许模型在客户自有基础设施上运行。Mistral 已与 BMW 合作碰撞仿真、与 Siemens Energy 合作工业 AI,并与慕尼黑工业大学建立研究伙伴关系。

9月26日周六
  1. AWS Machine Learning Blog38

    在 Amazon SageMaker AI 上部署 Qwen3-TTS 实现实时个性化语音

    Amazon SageMaker JumpStart 现支持部署 Qwen3-TTS-12Hz-1.7B-Base 文本转语音模型,提供全托管实时推理端点,可从数秒参考音频克隆说话人音色,无需重新训练。该模型覆盖 10 种语言,支持跨语言克隆和流式生成,输出 24 kHz 音频。用户可通过 SageMaker Python SDK 部署,并利用 CloudWatch 指标监控端点规模。

9月25日周五
9月22日周二
  1. Hugging Face Blog70

    Hugging Face 让 transformers 支持运行 llama.cpp 的 GGUF 量化模型

    Hugging Face 为 transformers 添加了 GGUF 模型支持,可在 Apple Silicon 上通过熟悉的 from_pretrained API 加载 GGUF 检查点,并复用 llama.cpp 的 ggml Metal 内核以接近其推理性能。

    推荐理由:Hugging Face 将 llama.cpp 的 GGUF 量化模型接入 transformers,并复用其 ggml Metal 内核,本地推理性能接近 llama.cpp,为开发者提供了在 PyTorch 生态中使用 GGUF 检查点的新路径。

9月21日周一
9月16日周三
9月10日周四
  1. Mistral AI38

    Cloudera 与 Mistral 达成合作,为企业数据带来定制化主权智能

    Cloudera 与 Mistral 宣布建立新合作伙伴关系,将 Mistral 模型集成到 Cloudera 混合数据平台,使企业能在私有云、公共云、本地及完全隔离环境中部署 AI 模型并保持完全控制。企业可利用专有数据在受控环境中训练定制模型,保留数据和智能的所有权。该合作旨在满足对主权 AI 日益增长的需求,覆盖 Cloudera 平台上 30 EB 的客户管理数据。

9月9日周三
  1. Mistral AI62

    Mistral 用 AI 智能体迁移 4 万行 Fortran 77 遗留代码

    Mistral 帮助一家欧洲能源运营商将 4 万行 Fortran 77 物理模拟器迁移到 C++,并总结了三条经验:先构建数值一致性验证框架、整理文档、采用带人工审查的结构化智能体工作流。项目首阶段完成 30 万行代码中的 4 万行核心功能。

    推荐理由:原文用真实迁移案例拆解了遗留代码现代化的完整流程,读者可借鉴其验证与工作流设计。

9月4日周五
  1. GitHub Blog · AI & ML40

    GitHub Copilot app 初学者指南:如何同时运行多个智能体

    GitHub Copilot app 支持在同一项目中并行运行多个 AI 智能体会话,每个会话独立执行任务、互不干扰。每个会话可运行在独立的 Git worktree 上,并保持各自的上下文,用户可自由切换而无需重新解释任务。通过会话视图可同时跟踪多个任务的进度,减少上下文切换,提升开发效率。

8月11日周二
  1. Mistral AI67

    Mistral 推出区域推理端点与优先服务层级,并支持第三方开放模型

    Mistral 宣布三项主权 AI 举措:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,提供自定义速率限制和正常运行时间 SLA;平台将支持第三方开放模型,首个为 Z.ai 的 GLM-5.2。

    推荐理由:原文给出了区域端点、优先服务层级和第三方开放模型支持的具体安排,读者可以据此判断 Mistral 主权 AI 方案的落地路径。

4月20日周一