跳到正文
原文
TechCrunch · AI· Aisha Malik·· 3 小时前精选AI 评分77

OpenAI发布GPT-6.1 Sol,称接近GPT-6 Astra且token价格仅五分之一

OpenAI launches GPT-6.1 Sol, says it nearly matches GPT-6 Astra and costs less

AI 导读

OpenAI在周二的DevDay发布GPT-6.1 Sol,称其在智能体编码、计算机使用和专业工作上接近GPT-6 Astra,标准输入和输出token价格只有五分之一,即日起向ChatGPT Work和Codex的Plus、Pro、Business、Enterprise与Edu用户开放,但尚未进入Chat。

推荐理由

该公司称GPT-6.1 Sol用于智能体编码、计算机使用和专业工作时接近GPT-6 Astra的智能水平,标准输入和输出token价格则只有五分之一。

正文 · AI 翻译

在周二的 OpenAI DevDay 活动上,该公司展示了 GPT-6.1 Sol,距其推出 GPT-6 Sol仅一周。OpenAI 表示,新模型在智能体编程、计算机使用和专业工作方面,提供了与 GPT-6 Astra 几乎相同水平的智能,而标准输入和输出 token 价格仅为五分之一。

值得注意的是,该公司并未如最初预期那样推出 GPT-6.1 Astra。《华尔街日报》本周报道称,OpenAI 因安全顾虑取消了此次发布:研究人员在内部测试中发现,该模型表现出更高程度的欺骗性,并倾向于在未征得用户许可的情况下推进任务。

OpenAI 表示,GPT-6.1 Sol 在复杂任务上相较前代 GPT-6 Sol 有显著提升,包括编程与调试、理解文档以及执行多步骤工作流。该公司称,在其中若干方面,该模型的表现接近 GPT-6 Astra。

OpenAI 还表示,新模型在面对困难提示时提高了事实准确性。在这方面相对 GPT-6 Sol 的最大提升出现在低推理强度下,含有事实错误的回答比例从 11.4% 降至 7.7%。该公司称,在所有推理设置下,新模型的错误率与 GPT-6 Astra 的差距保持在 1.9% 以内。

此外,该公司表示,GPT-6.1 Sol 会更坦率地说明自身局限,并在遵循用户意图和安全约束方面更加可靠。在具有挑战性的评估中,据称它在标记失效的搜索工具、遵守明确限制以及在任务中避免未经授权的结果方面,失败次数少于 GPT-6 Sol。OpenAI 称,未观察到任何试图绕过自动安全审查器的行为,这与 GPT-6 Astra 和 GPT-6 Sol 一致。

GPT-6.1 Sol 即日起向 ChatGPT Work 和 Codex 中的所有 Plus、Pro、Business、Enterprise 和 Edu 用户开放。OpenAI 指出,该模型尚未在 Chat 中提供。

当您通过我们文章中的链接购买时,我们可能会获得少量佣金。这不会影响我们的编辑独立性。

Aisha 是 TechCrunch 的消费新闻记者。在 2021 年加入该媒体之前,她曾是 MobileSyrup 的电信记者。Aisha 拥有多伦多大学荣誉学士学位和西安大略大学新闻学硕士学位。

您可以通过发送电子邮件至 aisha@techcrunch.com,或在 Signal 上向 aisha_malik.01 发送加密消息,联系或核实来自 Aisha 的联络。

查看简介

来源:TechCrunch · AI · techcrunch.com