OpenAI 将如何为澳大利亚做得更好
OpenAI 就涉及澳大利亚政府网站的事件致歉,并概述更强的防护措施与支持,以加强澳大利亚的网络防御。
OpenAI 就涉及澳大利亚政府网站的事件致歉,并概述更强的防护措施与支持,以加强澳大利亚的网络防御。
OpenAI 提出面向前沿 AI 训练安全论证的早期指南,覆盖技术防护措施、运营实践和错位事件调查。
Lenfest Institute 正借助 OpenAI 扩大的支持,扩展 Lenfest AI Collaborative and Fellowship Program。OpenAI 将提供 $5 million 资金,以及最高 $5 million 的软件额度与工程支持。
Basis 用 GPT-6 Astra 完成一份含 50 个标签页的税务工作簿,速度达到 GPT-5.6 Sol 的 2 倍。GPT-6 Astra 对用户意图的理解更强,让 Basis 对真实场景使用更有信心。
OpenAI 正在征集建造者、动手实践者、研究者和创作者用 Codex 做出了不起之事的真实故事。想成为 Codex Originals 计划下一章的一员,可在下方介绍自己的故事与项目。
Proaction 借助 Codex 将销售额提升 60%,并节省 75+ 小时。结合 GPT-Live-1 与 GPT-6 Astra,Proaction 能更快地构建、运营并销售现代车队管理。
开发者可以用开源终端智能体 OpenCode 调用 Amazon Bedrock 上的开放权重模型,把推理留在自有 AWS 账号并按消耗计费。
OpenAI Academy 迎来两周年,并把 AI 技能带给更多社区。
OpenAI 向乌克兰政府扩展 Daybreak 计划的访问权限,以支持民用基础设施的网络防御。
ALTK-Evolve在AppWorld test_normal上对照八个模型发现,自蒸馏记忆的合适剂量取决于模型能力。强模型DeepSeek-V3.2注入全量指南后TGC提升9.5个百分点,弱模型gpt-oss-120b用精选检索提升16.1个百分点且token仅增5%,饱和模型GLM-5增益为0。这些指南从智能体过往轨迹蒸馏,推理时注入,不更新模型权重,也不需要人工标注。
Google Research 提出知识画像,发现前沿大语言模型的许多事实错误是召回失败,而不是事实未被编码。基于 2,150 条维基事实的 WikiProfile 显示,Gemini-3-Pro 和 GPT-5 已编码 95–98% 的事实,但仍有 26–34% 无法直接召回,开启思考后失败比例为 11–12%。
推荐理由:用知识画像同时衡量事实的编码和召回后,前沿模型的事实性短板更集中于已经写入参数却难以稳定取出的知识。