H-CoT

OpenAI破大防，拒绝率从98%骤降2%！陈怡然团队提出全新思维链劫持攻击

随着通向通用人工智能（AGI）的进展，大语言模型正进化出复杂推理能力，衍生出所谓「大型推理模型」（Large Reasoning Models, LRMs）。 OpenAI 的o系列模型凭借接近人类的推理水准刷新了诸多基准，另一边新的模型DeepSeek-R1也以更低成本实现了与o系列相当的性能。这些模型不仅能逐步推理复杂问题，还开始将思维链（Chain-of-Thought, CoT）用于安全审查，在回答用户请求前通过内部推理判断内容是否违规，这种思路其实为平衡实用性和安全性提供了一个很有前景方向。

3/28/2025 11:59:10 AM

新智元

资讯热榜

苹果发布全新Xcode 26开发者工具：内置ChatGPT先进AI功能 DeepSeek前高管秘密创业，新AI Agent项目已获顶级VC押注支持MCP！开源智能体开发框架 Rowboat：打造你的智能助手只需几分钟苹果将 ChatGPT 和其他 AI 模型引入 Xcode 消息称 OpenAI 已同谷歌敲定一份云 AI 算力交易，减少对微软依赖 OpenAI年化收入突破100亿美元过去一年亏损约50亿美元 “程序员炸锅”！Claude一夜撤离 Windsurf，OpenAI 收购遭"精准狙击" 多模态推理模型（LMRM）：从感知到推理的演变

标签云

人工智能 AI OpenAI AIGC 模型 ChatGPT DeepSeek AI绘画谷歌数据机器人大模型 Midjourney 用户智能开源微软 GPT Meta 学习图像技术 AI创作 Gemini 论文马斯克 Stable Diffusion 算法英伟达代码 Anthropic 芯片开发者生成式蛋白质腾讯神经网络训练 3D 研究生成智能体苹果计算机器学习 Sora Claude AI设计 AI for Science GPU AI视频人形机器人搜索华为百度场景大语言模型 xAI 预测伟达深度学习 LLM 字节跳动 Transformer Agent 模态具身智能神器推荐工具文本视觉 LLaMA 算力 Copilot 驾驶大型语言模型 API RAG 应用架构