大模型

RAG与微调，大语言模型的“大脑升级”，该选哪条路？（小白科普）

最近在做项目时，我发现有些甲方对RAG和模型微调分区的不太清楚，明明大语言模型（LLM）加挂RAG就可以解决的问题，却坚持要微调，但是具体沟通后发现，其实只是不太了解二者的实际用途。其实，Retrieval-Augmented Generation (RAG) 和微调 (Fine-Tuning) 是两种最常用的LLM的“大脑升级”技术，虽然它们都能提升模型的性能，但工作原理和适用场景却大相径庭。今天，我就来深入聊聊这两种技术，弄清楚在不同情况下，到底该选 RAG 还是微调。

5/21/2025 3:00:00 AM

贝塔街的万事屋

蚂蚁武威：下一代「推理」模型范式大猜想

R1 之后，长思维链成为研究下一代基础模型中 “推理”（Reasoning）能力的热门方向。一方面，R1 证明了大模型深度思考的可行性；与此同时，尽管 R1 展现出了强大的性能，大模型推理的序幕实则才刚刚拉开。此外，R1 在海外掀桌也给国内人工智能的研究带来一个显著影响，即：越来越多的研究者敢于站在更高视角思考，提出前瞻引领的技术思想。

5/21/2025 12:10:00 AM

陈彩娴

60+头部企业关于AI的思想碰撞，都在这场大会里

最近由150位全球顶尖AI创始人参与的红杉资本AI峰会刷爆AI产业圈，关于大热的智能体经济、大模型、机器人商业化...来自OpenAI、英伟达、谷歌等公司的AI大佬们给出了他们的洞察——AI不再卖工具，而是卖收益。它正在从“技术产品”进化为一种新的经济运行方式。这一观点通俗来讲，就是客户不会因为你的AI产品功能好不好来买单，他们只为能帮他挣钱的产品买单。

5/20/2025 3:36:54 PM

火山引擎推出开源 MCP Servers，助力大模型应用开发

近日，火山引擎宣布推出一款名为 MCP Servers 的大模型生态平台，并将其开源。这一举措使得企业可以轻松将自研工具按照 MCP 协议进行封装并上传共享，形成一个良性的 “用生态” 与 “建生态” 的循环。火山引擎MCP Servers 可被视为一个 “大模型工具超市”，集成了大量高质量的 MCP 协议适配工具，涵盖了搜索、数据库和业务系统 API 等多个高频场景。

5/20/2025 12:00:55 PM

AI在线

火山引擎发布大模型生态广场 MCP Servers

火山引擎正式发布了其大模型生态广场——MCP Servers，这一创新平台的推出标志着AI开发进入了一个全新的模块化组装时代。通过“MCP Market（工具广场）火山方舟(大模型服务) Trae(应用开发环境)”的深度协同，MCP Servers实现了从工具调用、模型推理到应用部署的全链路开发闭环，极大地简化了开发流程，让开发者能够以更高效的方式构建AI应用。 MCP Servers被形象地称为“大模型工具超市”，它集成了众多高质量的MCP协议适配工具，覆盖了搜索、数据库、业务系统API等高频应用场景。

5/20/2025 9:00:56 AM

AI在线

深度解析大模型技术演进脉络：RAG、Agent与多模态的实战经验与未来图景

作者 | jaymie大模型作为产业变革的核心引擎。通过RAG、Agent与多模态技术正在重塑AI与现实的交互边界。三者协同演进，不仅攻克了数据时效性、专业适配等核心挑战，更推动行业从效率革新迈向业务重构。

5/20/2025 8:30:00 AM

腾讯技术工程

Transformer 模型结构详解及代码实现!

一、Transformer简要发展史以下是Transformer模型发展历史中的关键节点：Transformer架构于2017年6月推出。原本研究的重点是翻译任务。随后推出了几个有影响力的模型，包括：时间模型简要说明2017 年 6 月「Transformer」Google 首次提出基于 Attention 的模型，用于机器翻译任务2018 年 6 月「GPT」第一个使用 Transformer 解码器模块进行预训练的语言模型，适用于多种 NLP 任务2018 年 10 月「BERT」使用 Transformer 编码器模块，通过掩码语言建模生成更强大的句子表示2019 年 2 月「GPT-2」更大更强的 GPT 版本，由于潜在风险未立即发布，具备出色的文本生成能力2019 年 10 月「DistilBERT」BERT 的轻量化版本，在保留 97% 性能的同时，速度更快、内存占用更低2019 年 10 月「BART、T5」使用完整的 Encoder-Decoder 架构，在各种 NLP 任务中表现优异2020 年 5 月「GPT-3」超大规模语言模型，支持“零样本学习”，无需微调即可完成新任务这个列表并不全面，只是为了突出一些不同类型的 Transformer 模型。

5/20/2025 8:15:00 AM

郭小喵玩AI

使用 Unsloth 高效微调 Qwen3，国产大模型的轻量化和部署实践

近年来，大语言模型在自然语言处理任务中取得了显著进展。然而，对于开发者和中小型企业，模型微调的资源需求仍是一个挑战。本文将讨论如何利用 Unsloth 框架，在有限的硬件资源下完成 Qwen3-14B 的高效微调，并支持后续部署。

5/19/2025 9:32:06 AM

口袋数据

向量存储瘦身术：智能问答系统的空间优化革命

在AI智能问答系统中，向量数据库的存储压力越来越大。随着知识库规模扩大，如何高效压缩存储空间正在被大家所关注。本文将介绍一种方案，实现节省知识库占用空间，避免数据量无限制的增长。

5/16/2025 10:01:31 AM

贝塔街的万事屋

高考AI志愿规划师之争：靠谱AI指责优志愿虚假宣传

靠谱AI近日发布声明，指责竞争对手优志愿的升学规划大模型存在虚假宣传行为。这场 “高考 AI 志愿规划师” 的争夺战引起了广泛关注。据靠谱 AI 透露，自2024年4月28日以来，优志愿通过其官方公众号及 “优家 SaaS 平台” 声称其大模型是 “全行业首个通过工信部备案” 的升学规划工具，并自称为 “国内首发”。

5/15/2025 4:00:55 PM

AI在线

腾讯宣布混元图像2.0将于5月16日全新发布

今日，腾讯混元大模型团队今日正式宣布，其新一代多模态图像生成工具——混元图像2.0将于5月16日上午11时通过全球直播发布。这是继去年混元大模型升级后，腾讯在AI视觉领域的又一次重大突破，以“更智能、更开放、更中国”为核心理念，赋能创作者与企业用户迈向AI驱动的视觉生产新阶段。

5/15/2025 4:00:30 PM

AI在线

32B 稠密模型推理能力超越 R1？秘密 AI 团队发布推理小模型 AM-Thinking-v1

在大模型竞速进入推理能力深水区的 2025 年，一支神秘的团队悄然登场。他们不是来自一线大厂的 AI Lab，也没有高调预热和融资造势，而是在 Hugging Face 低调开源了一款 32B 的推理模型：AM-Thinking-v1。令人惊讶的是，这个中等规模的稠密模型，在多个关键推理评测中击败了 DeepSeek-R1，并与超大规模的 MoE 模型Qwen3-235B-A22B、Seed1.5-Thinking 不相上下。

5/15/2025 2:39:00 PM

郑佳美

首次披露！DeepSeek V3 发布软硬一体协同训练论文，公开“降成本”秘诀

就在刚刚，DeepSeek团队发布最新论文《洞察 DeepSeek-V3：规模的挑战和对AI架构硬件的思考》。论文链接：，论文采用了双重视角——跨越硬件架构和模型设计，通过研究这种协同作用，探索 DeepSeek-V3 如何实现经济高效的大规模训练和推理。随着 OpenAI o1/o3、DeepSeek-R1、Claude-3.7 Sonnet 等先进模型的出现，大规模架构和上下文推理的进步强调了对更快、更高效推理的需求。

5/15/2025 2:32:00 PM

郑佳美

新一代开源3D模型 Step1X-3D 亮相，AI行业新动向引关注

近日，科技领域迎来了一款全新的开源3D 大模型 —— 阶跃星辰 Step1X-3D。该模型的发布，标志着 AI 技术的又一次重大进步，尤其是在3D 建模和推理能力方面。该模型不仅开源，且针对开发者提供了多种实用的功能，极大地促进了创新和研究的可能性。

5/15/2025 11:02:25 AM

AI在线

AI+数据智能体的三大支点：数据治理、知识库和大模型

当销售部喊出"业绩增长15%"，财务部却坚称"只有8%"。会议室里争论不休，时间流逝，竞争对手已经抢占先机。你不禁自问：明明砸了千万建设数据系统，为何企业依然深陷数据内耗？

5/15/2025 9:56:32 AM

大数据AI智能圈

昆仑万维推出开源Matrix-Game大模型，推动游戏世界的智能生成

近日，昆仑万维正式宣布开源其最新的 Matrix-Game 大模型，这一模型以其超过10亿参数的规模，成为了工业界首个开源的空间智能大模型，标志着交互式世界生成技术的重大突破。 Matrix-Game 不仅支持知名游戏《我的世界》，还专为开放式环境中的高质量生成和精确控制而设计。 Matrix-Game 大模型的核心在于其三大组成部分。

5/13/2025 12:00:52 PM

AI在线

合合信息推出 MCP 服务，助力大模型高效智能文档处理

在人工智能和大模型技术飞速发展的今天，如何高效调用外部工具已成为开发者们面临的新挑战。不同大模型的调用结构和参数格式各不相同，导致开发者不得不为每种模型单独编写工具调用逻辑，进而影响了集成的效率。为了解决这一难题，合合信息近日推出了文档处理领域首批 MCP（Model Context Protocol）服务，为企业和开发者提供了一个 “万能接口”。

5/13/2025 9:00:52 AM

AI在线

国产大模型「五强争霸」，决战AGI！

DeepSeek的横空出世，已经彻底改变了全球的AI局势。从此，不仅中美大模型竞争格局改变，国产大模型的产业版图，也被一举打破！纵观中国基础大模型的市场，可以看到，如今的基础大模型版图已然改天换地，演变为全新的五强格局——字节、阿里、阶跃星辰、智谱，以及DeepSeek。

5/13/2025 2:00:22 AM

新智元

资讯热榜

苹果发布全新Xcode 26开发者工具：内置ChatGPT先进AI功能首月 1 美元，ChatGPT Team 会员美区 / 英区 / 欧洲区 / 澳洲区迎优惠 DeepSeek前高管秘密创业，新AI Agent项目已获顶级VC押注那个男人回来了！Ilya现身多伦多大学毕业典礼：AI 像是用数字方式复制出来的大脑！不管你愿不愿意，AI都将深刻影响你的一生！ ChatGPT 语音功能升级，实时翻译对话更自然流畅支持MCP！开源智能体开发框架 Rowboat：打造你的智能助手只需几分钟长文本理解新王者?Gemini2.5Pro 击败 o3领跑 Fiction.Live 基准测试谷歌 Gemini 应用月下载量超越 ChatGPT，用户活跃度仍显不足

标签云

人工智能 AI OpenAI AIGC 模型 ChatGPT DeepSeek AI绘画数据谷歌机器人大模型 Midjourney 用户智能开源微软 GPT 学习 Meta 图像技术 AI创作 Gemini 论文马斯克 Stable Diffusion 算法代码英伟达 Anthropic 芯片生成式开发者蛋白质腾讯神经网络研究 3D 生成训练苹果计算智能体 Sora 机器学习 AI设计 AI for Science Claude GPU AI视频人形机器人华为搜索场景百度大语言模型 xAI 预测伟达深度学习 Transformer 字节跳动 Agent 模态具身智能神器推荐 LLaMA 文本视觉 Copilot 算力工具 LLM 驾驶 API 大型语言模型应用 RAG 亚马逊