Grok 4.7 现已在 Amazon Bedrock 上线
Grok 4.7 现已在 Amazon Bedrock 上线,上下文窗口为 500K token,面向编码、长时智能体和知识工作。
Grok 4.7 现已在 Amazon Bedrock 上线,上下文窗口为 500K token,面向编码、长时智能体和知识工作。
OpenAI 就涉及澳大利亚政府网站的事件致歉,并概述更强的防护措施与支持,以加强澳大利亚的网络防御。
OpenAI 提出面向前沿 AI 训练安全论证的早期指南,覆盖技术防护措施、运营实践和错位事件调查。
Claude Sonnet 5.5 今日登陆 Amazon Bedrock,Claude Platform on AWS 在北美提供。它适合范围明确的编码与知识工作,多数工作的单任务成本更低、速度更快。数据留在 AWS 内并支持区域数据驻留,可配合 IAM 与 Amazon Bedrock Guardrails。
Mistral在慕尼黑开设德国中心,组建Physics AI与工业AI团队并直接服务企业。2026年5月收购Emmi AI后逾30人加入,与BMW做碰撞仿真、与Siemens Energy做工业AI,并与慕尼黑工业大学合作汽车空气动力学数字孪生。到2030年建1 GW欧洲算力,开放权重在客户基础设施运行且数据不出组织。
H 公司发布智能体模型系列 Holo4,提供 27B 稠密与 35B-A3B Mixture of Experts 两个尺寸,并推出 Holotron4 Nano。
推荐理由:同一模型同时覆盖屏幕操作、代码执行和工具调用,公开轨迹则让桌面长流程上的成本与得分可以直接对照。
Lenfest Institute 正借助 OpenAI 扩大的支持,扩展 Lenfest AI Collaborative and Fellowship Program。OpenAI 将提供 $5 million 资金,以及最高 $5 million 的软件额度与工程支持。
Basis 用 GPT-6 Astra 完成一份含 50 个标签页的税务工作簿,速度达到 GPT-5.6 Sol 的 2 倍。GPT-6 Astra 对用户意图的理解更强,让 Basis 对真实场景使用更有信心。
OpenAI 正在征集建造者、动手实践者、研究者和创作者用 Codex 做出了不起之事的真实故事。想成为 Codex Originals 计划下一章的一员,可在下方介绍自己的故事与项目。
Proaction 借助 Codex 将销售额提升 60%,并节省 75+ 小时。结合 GPT-Live-1 与 GPT-6 Astra,Proaction 能更快地构建、运营并销售现代车队管理。
在 GitHub Copilot app 的智能体会话里输入 /create-canvas,用自然语言写清工作流、界面中可做的操作和智能体可做的事,即可得到双方共享的 canvas。
Amazon EKS结合EFA与DeepEP扩展MoE强化学习训练,吞吐量提升40%。该方案面向RLHF与GRPO,协调rollout生成和策略训练,并由DeepEP优化EFA上的Expert Parallelism通信。MoE更稀疏后训练更受跨节点通信而非计算制约,还需同时平衡加速器算力、内存与网络带宽。
可从 Amazon SageMaker JumpStart 将公开的 Qwen3-TTS-12Hz-1.7B-Base 部署到全托管实时推理端点,用短参考录音及其转写克隆说话人声音来合成新文本,无需重新训练。
Google Research 介绍基于 Gemini 与 Veo 的 AI 视频协同导演,用多智能体编排规划多镜头长视频的视觉连续性。该套件包括将于 COLM 2026 发表的 Co-Director、将于 EMNLP 2026 发表的 CANVAS,以及 A²RD 与 VQQA,分别处理创意配置、持久视觉记忆、分段生成和提示词闭环修正,并继承 SynthID 水印。
GitHub Security Lab 的 Fuzzing Taskflow 是面向 C/C++ 的自主模糊测试流水线,指向 GitHub 仓库后会识别入口、编写 harness、运行 AFL++、改进覆盖率,并为每个独立缺陷写出漏洞报告。
Gemini 3.8 Live 即日起在 Gemini Enterprise 提供 Live Avatar,把近实时视频生成与语音结合,为对话带来可听、可看、可说的动态视觉形象。
推荐理由:Live Avatar 把近实时视频形象接到 Gemini 3.8 Live 语音对话中,使企业能在不中断交流的情况下后台调用工具并跨 97 种语言同步口型与表情。
Liquid AI 发布 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,用投机解码加速推理且输出质量不变。设备端解码最高 3.13x、H100 最高 2.66x,端到端最高 2.62x 与 2.27x,参数多 280M(8.9%)。首日支持 llama.cpp、MLX-VLM、SGLang,提供开放权重。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 公开超过 2800 种病毒蛋白复合物的预测三维结构,供各地科学家为未来疫情提前积累结构知识。
GitHub Copilot 应用重建 PR 视图后,含 2,200 文件、逾百万行改动和超 400 条行内评论的 diff 仍能流畅滚动。纯代码行在绘制前即可确定高度,虚拟化后同时大约只挂载 100 行。评论高度要到渲染时才知道,因此总高度拆成确定性代码高度与懒测量的动态块,修正则锚定在用户正在看的位置。
Microsoft Research 发现,把物理 AI 推理卸载到边缘或云端 GPU 可提升任务表现。在内存足够时,建图与规划比 A100 最多慢 383%,较轻 GPU 使障碍及时检测降 30%,较小 GPU 使 VLA 准确率降 50%。Jetson Thor 等较大机载 GPU 可使耗电增加最多 160%。
Google 将为 Private AI Compute 增加可跨设备的服务端持久记忆,并维持通常限于设备端的严格隐私标准。数据封存在专用加密存储,解锁密钥仅在个人设备上,连 Google 也无法访问。设备发送个人数据前可核验服务器软件真实且未被篡改。
OpenAI Academy 迎来两周年,并把 AI 技能带给更多社区。
Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS,前者侧重用自然语言从零设计角色声线,后者面向高用量、低成本的配音与语音代理。
推荐理由:Gemini 3.8 的两款新语音模型可用自然语言设计角色声线,并公开基准名次与各端入口,方便对照现有配音和语音代理流程。
Sakeena Fiza 担任 NVIDIA 验证工程师,在量产前把数据中心系统从托盘测到客户 AI 工厂,抢在客户之前发现问题。她见证 NVIDIA Rubin GPU 首次在系统级枚举,显示为 “NVIDIA Corporation Device”。单块板卡可含数万个元件,一个机架接近 50 万个,这些部件必须在压力和多种 AI 工厂配置下协同工作。
OpenAI 向乌克兰政府扩展 Daybreak 计划的访问权限,以支持民用基础设施的网络防御。
NVIDIA与合作伙伴在AI Day Singapore展示东南亚AI进展。泰国iApp Technology用NeMo微调Nemotron 3 Nano并开源,法律助手Thanoy已服务约43,000名用户。越南Viettel AI广泛微调Nemotron 3 Super,该模型在VMLU与内部产品基准中排名最高。
Hugging Face transformers 现可在 main 分支高效运行 GGUF,用户用 from_pretrained 加载 Hub 检查点后即可在本机生成。
推荐理由:GGUF 现在能直接进 transformers 做检查和自定义生成,Apple Silicon 上速度接近 llama.cpp。
NVIDIA 推出 DSX Ready,认证符合 NVIDIA DSX AI 工厂参考设计的电池储能与冷却产品。已认证 BESS 来自 Hitachi Energy、LG Energy Solution 和 Tesla,CDU 来自 LG Electronics、LiquidStack 和 Vertiv。基础设施与软件等更多类别将逐步推出。
埃及 AI 生态已从赋能走向执行并达到生产规模,开发者、初创与企业正跨行业构建应用。Hassan Allam Utilities 与 A15 同意在埃及新建数据中心,投资估约 4 亿美元。非洲一年内已宣布或上线四座 AI 工厂,另有 656 兆瓦新产能正在推进。
RetroChimera 融合 R-SMILES 2 与 NeuralLoc,用学习排序整合互补预测,提出优于任一子模型的小分子合成路线。盲测中博士级化学家更偏好其单步反应预测,而非先前模型与文献记录反应;10 个高难度目标成功 9 个,高于从头模型 5 个、编辑模型 4 个和 NeuralSym 2 个。
Multiverse 把大语言模型的块移除写成 Ising glass 上的受约束二元优化,Llama-3.3-70B-Instruct 在 50% 压缩时 MMLU 比最佳同类块移除方法高出近 23 个百分点。
Google Research 推出 C++ 实例生成器 MilleMiglia,为中程配送问题生成真实、保护隐私的基准数据。中程物流被建模为时空图上的多商品流,不同于首末程的车辆路径问题。源代码与文档已在 GitHub 公开,用以弥补该领域缺少高质量公开数据的不足。
GitHub Podcast最新一集认为,开发者仍须阅读并负责AI生成代码,RAG并未消亡,Skills也没有杀死MCP。MCP给智能体提供连接工具和数据的标准方式,Skills常以Markdown说明流程与约定,RAG检索训练数据之外的信息。审查应直到能解释并承担结果,不必对每行生成代码投入同等注意力。
Google Research 分享一项研究实验,让教育者用面向学习优化的生成式用户界面,按课程与教学目标动态生成定制的互动教学模拟。示例库放出超过 30 个英语 STEM 学习互动,覆盖物理、化学、生物和数学,面向初中与高中,均由 AI 生成并经教师审核。
GitHub 用 Copilot 将 Copilot agent runtime 从 TypeScript/Node.js 重写为超过 800,000 行生产 Rust,大部分代码由 AI 智能体完成,并通过 128 个合入主干的 pull request 增量交付。
推荐理由:原文写清 Copilot 运行时如何以组件原子替换迁到 Rust 并增量发布,读者可从智能体分工看到大规模改写怎样维持主干持续可交付。
Mistral 与 Mozilla 合作,Firefox Smart Window(beta)现由 Mistral 模型驱动。该功能先覆盖法国与北美用户,英国和德国预计今年晚些时候跟进。对话默认不保存在 Mozilla 服务器,Mistral 承诺零数据留存,并针对地区语言、方言和文化语境微调模型。
Google Research的Retrieve-for-Train将查询扇出蒸馏为53.9M扩散检索器,单次推理免去思考token。框架以集合级奖励对Gemma3-4B与Qwen3-4B做离线RL微调,并由冻结模型合成无需人工标注的监督数据。扩散检索器以一次非自回归前向,把查询嵌入直接映射为完整目标嵌入集合。
Google DeepMind发布Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking,把近实时推理用于语音智能体。
推荐理由:原文给出了Extended Thinking的语音基准分数,以及两款模型面向开发者、企业和普通用户的不同开放范围。
负责 GitHub 日本和韩国市场的 Tomoko Tanaka 用 GitHub Copilot、Issue 和 Actions 自动化活动运营,过去要手工处理一两天的搭建现在从单条 Issue 开始,系统每天早上筛查报名者,并在结束后自行收尾。
GitHub Copilot app 内置并排的 diff、终端和浏览器面板,审阅、运行和预览都不用离开应用。diff 新增为绿、删除为红,可接受、评论或让 Copilot 再改。终端可通过 Run 按钮运行脚本,浏览器用 Pick & Polish 选元素交给智能体调整,然后接受改动并创建 pull request。