跳到正文
9月29日 · 周二

最新精选

9月28日周一
  1. Hugging Face Blog67

    H 公司发布通用计算机使用模型 Holo4,含 27B 与 35B-A3B

    H 公司发布智能体模型系列 Holo4,提供 27B 稠密与 35B-A3B Mixture of Experts 两个尺寸,并推出 Holotron4 Nano。

    推荐理由:同一模型同时覆盖屏幕操作、代码执行和工具调用,公开轨迹则让桌面长流程上的成本与得分可以直接对照。

9月25日周五
  1. Google DeepMind60

    Gemini 3.8 Live 推出 Live Avatar,为企业对话加入近实时视频形象

    Gemini 3.8 Live 即日起在 Gemini Enterprise 提供 Live Avatar,把近实时视频生成与语音结合,为对话带来可听、可看、可说的动态视觉形象。

    推荐理由:Live Avatar 把近实时视频形象接到 Gemini 3.8 Live 语音对话中,使企业能在不中断交流的情况下后台调用工具并跨 97 种语言同步口型与表情。

9月23日周三
  1. Google DeepMind71

    Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS,前者侧重用自然语言从零设计角色声线,后者面向高用量、低成本的配音与语音代理。

    推荐理由:Gemini 3.8 的两款新语音模型可用自然语言设计角色声线,并公开基准名次与各端入口,方便对照现有配音和语音代理流程。

9月22日周二
  1. Hugging Face Blog61

    Hugging Face transformers 现可运行 llama.cpp 的 GGUF 量化模型

    Hugging Face transformers 现可在 main 分支高效运行 GGUF,用户用 from_pretrained 加载 Hub 检查点后即可在本机生成。

    推荐理由:GGUF 现在能直接进 transformers 做检查和自定义生成,Apple Silicon 上速度接近 llama.cpp。

9月17日周四
  1. GitHub Blog · AI & ML85

    GitHub 借助 Copilot 将 Copilot agent runtime 重写为超过 800,000 行 Rust

    GitHub 用 Copilot 将 Copilot agent runtime 从 TypeScript/Node.js 重写为超过 800,000 行生产 Rust,大部分代码由 AI 智能体完成,并通过 128 个合入主干的 pull request 增量交付。

    推荐理由:原文写清 Copilot 运行时如何以组件原子替换迁到 Rust 并增量发布,读者可从智能体分工看到大规模改写怎样维持主干持续可交付。

9月16日周三
  1. Google DeepMind76

    Google DeepMind发布Gemini 3.8 Live与3.8 Live Extended Thinking

    Google DeepMind发布Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking,把近实时推理用于语音智能体。

    推荐理由:原文给出了Extended Thinking的语音基准分数,以及两款模型面向开发者、企业和普通用户的不同开放范围。

9月8日周二
  1. Mistral AI67

    Mistral 完成 €3 billion Series D 融资,投后估值超过 €21 billion

    Mistral 宣布完成 €3 billion Series D 融资,投后估值超过 €21 billion,并称这是欧洲科技公司完成过的最大股权融资。Samsung Electronics 领投,由 EQT 管理的 Scaleup Europe Fund 与既有投资人 PSG Equity 联合领投,资金将扩大前沿研究、训练算力、基础设施以及商业增长和国际布局。

    推荐理由:这笔融资将显著扩大 Mistral 的前沿研究、训练算力与基础设施投入,并加快开源权重主权全栈的商业增长与国际布局。

9月3日周四
  1. Google DeepMind73

    Google DeepMind与Google Research发布全球天气模型WeatherNext 3

    Google DeepMind与Google Research发布WeatherNext 3,可每小时生成最高5公里分辨率的全球天气预报。相较25公里网格、6小时更新的WeatherNext 2,新模型的全球天气画面约锐利5倍;中期预报早期时效的CRPS相对IMERG最高改善60%,相对MRMS为30%,相对雨量计为10%。

    推荐理由:WeatherNext 3将WeatherNext 2的25公里、6小时改为5公里与每小时更新,并接入Search、Gemini和Maps。

  2. Google DeepMind77

    Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber

    Google DeepMind 今日发布 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber。3.8 Flash 沿用 3.7 Flash 的入门价格,输入每百万 token 为 $0.75、输出每百万 token 为 $3.75,并提升软件工程、智能体任务与多步推理,HLE-Verified 达到 54.9%。

    推荐理由:3.8 Flash以与3.7相同的价格加强长程编码和多步推理,网络安全变体仅经Fairwind向政府、关键基础设施和软件维护方开放。

8月20日周四
  1. Mistral AI60

    Mistral推出Agentic Search,提升复杂文档检索准确率并降低延迟

    Mistral推出Agentic Search,让模型通过search、open、navigate、read和grep五个工具,在现有索引上多步查找、打开并核对长文档与多来源信息。

    推荐理由:Mistral把一次取块改成可导航核对的多步检索,使FinanceBench正确率从26.7%升至86%并降低延迟与token。

8月4日周二
  1. Microsoft Research60

    微软研究院发布开源框架 Orchard,约 3B 模型在 SWE-bench Verified 达 69.7%

    微软研究院发布开源框架 Orchard,用 Kubernetes 环境服务 Orchard Env 在 Codex、OpenClaw、ZeroClaw 等真实框架中训练软件工程、网页与助手智能体。

    推荐理由:微软研究院的 Orchard 用可复用环境让智能体在真实部署框架中训练,约 3B 激活参数的开放模型因而在 SWE-bench Verified 上达到 69.7% 并在价值模型重排后升至 73.0%。

已经到底了