AIGC宇宙 AIGC宇宙

OpenAI公开了大模型o3-mini的推理思维链

2月8日消息,据外媒报道,OpenAI更新了o3-mini AI模型的“思维链”功能,让用户可以看到模型的思考过程。 这是在DeepSeek-R1发布之后发生的,DeepSeek-R1是一个竞争对手的推理模型,也显示了其反应背后的思维过程。 推理模型旨在逐步分解其决策过程,因此需要更长的时间来生成响应。

OpenAI公开了大模型o3-mini的推理思维链

2月8日消息,据外媒报道,OpenAI更新了o3-mini AI模型的“思维链”功能,让用户可以看到模型的思考过程。这是在DeepSeek-R1发布之后发生的,DeepSeek-R1是一个竞争对手的推理模型,也显示了其反应背后的思维过程。

推理模型旨在逐步分解其决策过程,因此需要更长的时间来生成响应。这样的解释可以更容易地理解为什么给出了特定的响应,允许用户看到为什么他们的提示可能会或可能不会产生期望的答案。它们还允许人工智能研究人员识别潜在的偏见或错误,并提高其推理能力。

OpenAI在一篇文章中表示,该公司已经为免费和付费用户发布了“更新的OpenAI o3-mini思维链”,并为付费用户发布了o3-mini-high思维链。“o3-mini-high是o3-mini的付费版本,具有更深入的推理能力和更详细的思维过程,但代价是反应时间较慢。

在此更新之前,OpenAI模型o3-mini、o1和o1-mini只能让用户访问思想链摘要,而不是完整的推理;该公司表示,这是为了“在速度和准确性之间提供一个平衡的权衡”,尽管它过去也提到“竞争优势”是决定的一个因素。

然而,由于DeepSeek的开源R1展示了其反应背后的整个过程,OpenAI决定将该过程公布。在更新中,“模型的原始(思维链)仍然隐藏,因为它很难理解”,但以一种“易于阅读”的方式呈现。

新的、更深入的推理总结将经过后处理步骤,简化任何过于复杂的解释,删除任何“不安全”的推理解释,并将其翻译成用户的母语。

OpenAI的首席产品官Kevin Weil表示:“展示所有的思维链会带来竞争的升华,但我们也知道人们需要它,所以我们会找到平衡它的正确方法。”这就是这种平衡的结果。

相关资讯

DeepSeek-R1 登顶 Hugging Face:以10000 赞力压 150 万个模型

今日凌晨,全球最大开源平台之一 Hugging Face 的首席执行官 Clement Delangue 在社交平台发文宣布,DeepSeek-R1在 Hugging Face 上获得了超过10000个赞,成为该平台近150万个模型中最受欢迎的大模型。 这一里程碑式的成就标志着 DeepSeek-R1在全球 AI 社区中的广泛认可与影响力。 DeepSeek-R1的崛起速度令人瞩目。
2/24/2025 9:30:00 AM
AI在线

腾讯云上线DeepSeek全系API接口并打通联网搜索

腾讯云宣布完成对深度求索(DeepSeek)大模型的深度整合——正式上线DeepSeek-R1和V3原版模型的API接口,并创新性接入自研大模型知识引擎,同步开放联网搜索能力。 凭借腾讯云在推理并发和生成速率等方面的优化,用户可以获得更加稳定、安全、低门槛的使用体验。 开发者只需在云上简单三步即可实现API接口调用,并通过大模型知识引擎提供的文档解析、拆分、embedding、多轮改写等能力,灵活构建专属的AI服务。
2/8/2025 2:09:00 PM
AI在线

微信搜索接入DeepSeek大模型 称AI不会使用朋友圈聊天等信息

近日,微信宣布其搜索功能接入 DeepSeek-R1模型,目前处于灰度测试阶段。 部分用户在微信搜索框选择 AI 搜索时,可体验到 DeepSeek-R1提供的深度思考功能。 微信方面表示,引入大模型旨在提升搜索的智能化和精准度,更好地理解用户搜索意图,分析处理复杂查询。
2/19/2025 11:18:00 AM
AI在线
testab