AMD 以约 $8.2 billion 全股票收购李飞飞联合创立的 World Labs
AMD 宣布以约 $8.2 billion 的全股票交易收购李飞飞联合创立的 AI 研究实验室 World Labs。World Labs 于 2024 年成立,数月内估值达到 $1 billion,并于 2025 年推出可根据提示词生成交互式 3D 世界的世界生成模型 Marble,交易预计年底前完成。
AMD 宣布以约 $8.2 billion 的全股票交易收购李飞飞联合创立的 AI 研究实验室 World Labs。World Labs 于 2024 年成立,数月内估值达到 $1 billion,并于 2025 年推出可根据提示词生成交互式 3D 世界的世界生成模型 Marble,交易预计年底前完成。
美国国防部拟在未来五年投入3030万美元建设Polygraph+(Polygraph Next),用人工智能和机器学习改进测谎评分,并发展无需接触受试者的生理测量。项目由DCSA运行,计划用于准员工审查和内部威胁检测,相关预算尚未获国会批准。受访学者认为说谎没有稳定统一的生理标志,人工智能即使发现新模式,也难以确认这些反应是否真正对应说谎。
Runway 的 GWM Worlds 2 研究预览用自回归扩散模型,把高保真视频和音频生成变成实时交互模拟,并用 WorldPrompt 指定世界与其中的时间戳动作。
Google Research 介绍基于 Gemini 与 Veo 的 AI 视频协同导演,用多智能体编排规划多镜头长视频的视觉连续性。该套件包括将于 COLM 2026 发表的 Co-Director、将于 EMNLP 2026 发表的 CANVAS,以及 A²RD 与 VQQA,分别处理创意配置、持久视觉记忆、分段生成和提示词闭环修正,并继承 SynthID 水印。
Gemini 3.8 Live 即日起在 Gemini Enterprise 提供 Live Avatar,把近实时视频生成与语音结合,为对话带来可听、可看、可说的动态视觉形象。
推荐理由:Live Avatar 把近实时视频形象接到 Gemini 3.8 Live 语音对话中,使企业能在不中断交流的情况下后台调用工具并跨 97 种语言同步口型与表情。
Liquid AI 发布 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,用投机解码加速推理且输出质量不变。设备端解码最高 3.13x、H100 最高 2.66x,端到端最高 2.62x 与 2.27x,参数多 280M(8.9%)。首日支持 llama.cpp、MLX-VLM、SGLang,提供开放权重。
Meta把AI助手放到钥匙扣上。周三,Zuckerberg发布无摄像头、仅音频交互的Ray-Ban,以及明年春季上市、售价1300美元、比上一代Quest 3轻五倍的虚拟现实眼镜。Muse助手即将登陆眼镜,佩戴者可借全息技术以超写实数字分身参加视频通话。
NVIDIA与合作伙伴在AI Day Singapore展示东南亚AI进展。泰国iApp Technology用NeMo微调Nemotron 3 Nano并开源,法律助手Thanoy已服务约43,000名用户。越南Viettel AI广泛微调Nemotron 3 Super,该模型在VMLU与内部产品基准中排名最高。
Google DeepMind发布Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking,把近实时推理用于语音智能体。
推荐理由:原文给出了Extended Thinking的语音基准分数,以及两款模型面向开发者、企业和普通用户的不同开放范围。
MindTopo 基准显示,多模态模型识别静态拓扑关系的表现明显强于交互规划,且两者都远低于人类。它按连续性、分离、顺序、包围和结五类,分别测试推理与规划;规划错误常出现在理解场景之后,模型会丢失结构关系或提出违反环境动态的动作。图像生成只在关系可见于单帧时偶尔有帮助,视频推演则经常改变拓扑或违反任务动态。