大模型

快手All in AI视觉！成立可灵AI事业部，加速大模型商业化

4 月 30 日，快手发布组织架构调整公告，宣布正式成立可灵AI事业部，进一步强化其在人工智能领域的战略布局。公告显示，新成立的可灵AI事业部下设可灵AI产品部、运营部和技术部，全面负责包括可灵、可图在内的系列大模型业务。快手高级副总裁盖坤将出任可灵AI事业部负责人，并继续兼任社区科学线负责人。

4/30/2025 6:00:51 PM

AI在线

中国开源大模型新成员：小米推理大模型首秀！

编辑 | 云昭进入2025以来，中国大模型的开源力量一骑绝尘，甚至盖过了Llama的势头。今天，中国开源大模型，迎来新成员！ 4月30日，赶在五一前，一条“为Reasoning而生”的Xiaomi Mimo开源模型的发布消息不胫而走，发布渠道是小米6天前新注册的公众号Xiaomi Mimo。

4/30/2025 4:48:07 PM

云昭

真假难辨!腾讯混元Turbo S助《太空杀》AI玩家智商飙升

社交推理游戏《太空杀》正迎来一场人和AI推理水平的大PK。巨人网络旗下这款风靡全球的手游，通过接入腾讯混元新一代旗舰快思考模型Turbo S，使其AI玩家的智能水平实现了高度拟人化。腾讯混元Turbo S能够同时驱动八名AI玩家参与游戏，凭借其强大的推理能力和仿真的文字对话能力，与真人玩家展开智力较量。

4/30/2025 2:00:41 PM

AI在线

蚂蚁数科发布金融智能体开发平台 Agentar，推动 AI 技术在金融领域应用

在数字中国建设峰会期间，蚂蚁数科正式推出了智能体开发平台 Agentar。该平台旨在为金融机构提供一站式、全栈的智能体开发工具，帮助它们高效地打造具备自主决策能力、可信赖的金融智能体应用。此次发布标志着 AI 技术从 “辅助工具” 转变为推动金融服务变革和效率提升的 “生产力引擎”。

4/30/2025 12:00:40 PM

AI在线

加速追赶！腾讯拆分AI团队，豪掷研发资源

据央广网消息，4月29日，公司对其混元大模型研发体系进行全面重构，聚焦算力、算法和数据三大核心，调整团队部署并加大研发投入。此次调整的核心是成立两个新的部门:大语言模型部和多模态模型部，分别负责探索前沿技术、迭代基础模型。同时，腾讯加强了底层支撑，设立数据平台部和机器学习平台部，专注于数据管理和AI平台建设，为混元大模型的研发提供全面支持。

4/30/2025 11:00:50 AM

AI在线

Qwen3来了！新一代高性能与混合推理能力兼备的大语言模型！

阿里云正式发布通义千问Qwen3系列大模型，这一里程碑式更新在性能、训练规模和推理能力等多个维度实现重大突破。作为国产大模型的领军者，Qwen3不仅以2350亿参数的MoE架构刷新性能记录，更通过创新的"混合思考模式"和360万亿token的超大规模训练，成为当前性能领先的开源大语言模型。 1、Qwen3的性能表现Qwen3系列包含多个版本，涵盖MoE混合专家模型和Dense稠密模型。

4/30/2025 10:59:04 AM

万兴科技与华为云携手推进 AI 大模型技术创新

近日，万兴科技集团股份有限公司（以下简称 “万兴科技”）与华为云计算技术有限公司(以下简称 “华为云”)在深圳签署了战略合作协议。此次合作旨在结合双方的优势，共同推动 AI 大模型的技术和应用创新，进一步开拓数字创意领域的潜力。根据协议，万兴科技将充分发挥其在音视频大模型和 AI 应用方面的专业能力，而华为云则将利用其强大的云基础设施和市场拓展优势，建立深度合作关系。

4/30/2025 10:00:50 AM

AI在线

AI知识库的真相，你知道吗？

很多人对AI知识库的想象是这样的，他们以为只需将所有资料一股脑地拖进AI客户端，比如 Cherry Studio 内。图片这样，AI就会认真阅读所有内容，并自动生成完美结论。然而，实际体验后，许多人发现AI知识库的效果远没有想象中理想，经常遇到各种奇怪的问题。

4/30/2025 9:06:23 AM

程序员NEO

2024 年中国 MaaS 与 AI 大模型解决方案市场迎来爆发式增长

根据国际数据公司（IDC）发布的最新报告，2024年中国模型即服务(MaaS)及 AI 大模型解决方案市场将迎来显著增长，全年市场规模预计达到7.1亿元人民币，相较于2023年实现215.7% 的同比激增。其中，2024年下半年市场规模将达到4.6亿元人民币。展望未来五年，这一市场将以66.1% 的年均复合增长率继续扩张，预计到2029年市场规模将达到90亿元人民币。

4/29/2025 6:00:40 PM

AI在线

蚂蚁数科发布金融智能体开发平台Agentar 内测上线超百个金融MCP服务

4月29日，在数字中国建设峰会期间，蚂蚁数科正式对外发布智能体开发平台Agentar，为金融机构提供一站式、全栈的智能体开发工具，助力金融机构高效打造能够自主决策、可信可靠的金融智能体应用，加速AI技术从“辅助工具”真正成为驱动体验变革、效率跃升的“生产力引擎”。随着生成式AI的快速发展，行业大模型及智能体应用正在重塑金融服务。然而，大模型训练成本高昂难以在普惠场景中规模化复制;金融行业数据的高敏感性与安全合规要求;以及金融核心场景数据样本量较小、通用模型在金融专业场景中泛化能力不足等问题都在制约大模型技术在金融行业应用的深度与广度。

4/29/2025 4:00:40 PM

AI在线

52页PPT，谷歌Gemini预训练负责人首次揭秘！扩展定律最优解

谷歌凭借Gemini 2.5 Pro在激烈的大模型竞争中一举翻盘。近日，Geimini Flash预训练负责人Vlad Feinberg在普林斯顿大学分享了相关内容。他深入分析了Gemini预训练的方法、挑战以及方向，如何在模型大小、算力、数据和推理成本间取得平衡。

4/29/2025 9:16:00 AM

新智元

深夜突袭，阿里Qwen3登顶全球开源王座！暴击DeepSeek-R1，2小时狂揽17k星

就在今天凌晨，备受全球期待的阿里新一代通义千问模型Qwen3开源！一经问世，它立刻登顶全球最强开源模型王座。它的参数量仅为DeepSeek-R1的1/3，但成本大幅下降，性能全面超越R1、OpenAI-o1等全球顶尖模型。

4/29/2025 8:14:14 AM

新智元

“大模型失联”的凌晨，我靠这四个配置救了全组！LangChain4j API 进阶指南

1.引言大家好，我是小米，一个31岁、依然热爱编码的程序员大哥哥～今天给大家分享一个我最近在项目里踩坑无数、最后“高光时刻”拯救全组的进阶配置经验——LangChain4j 的 API 进阶配置四大件：日志、监控、重试、超时。你以为 LangChain4j 就只是个 Java 包装器？配置对了，它能稳定、健壮、可观测，能用得安心、跑得漂亮！

4/29/2025 3:40:00 AM

软件求生

阿里 AI 工程师余亮荣获 “全国劳动模范” 称号

在 “庆祝中华全国总工会成立100周年暨全国劳动模范和先进工作者表彰大会” 上，阿里巴巴的员工余亮荣获 “全国劳动模范” 荣誉称号，这也是阿里 AI 工程师首次获得这一殊荣。余亮是一位专注于大数据和智慧城市领域的杰出工程师，他的贡献在行业内得到了广泛认可。余亮毕业于武汉大学，曾在浙江大学及海外顶尖高校和研究机构进行博士后研究，并担任研究员和科学家等职务。

4/28/2025 3:00:50 PM

AI在线

字节跳动启动 “Top Seed” 计划，面向 2026 届博士生招募 AI 人才

字节跳动近日宣布正式启动2026届 “Top Seed” 大模型顶尖人才校招计划，计划招募约30位优秀博士生。这一项目专注于前沿的人工智能领域，涵盖大语言模型、机器学习算法与系统、多模态生成与理解、语音处理等研究方向。字节跳动希望通过此举，吸引那些在大模型研究领域具备极强潜力和热情的年轻才俊。

4/28/2025 12:00:40 PM

AI在线

ICLR 2025：顶尖科学家最关心的 AI 趋势有哪些？丨GAIR Live

自 GPT-4 发布至今已有两年，但对大语言模型的研究并没有放缓，我们仍处在一个技术进步涌现的时代。 Anthropic 于 2024 年11月发布 MCP，成为接通 AI 生态的桥梁，自主的 Agent 工作流距我们更进一步。 GPT-4o、GPT-4.1时隔仅一个月先后发布，实现上下文处理能力八倍提升。

4/28/2025 11:19:00 AM

郑佳美||梁丙鉴

大模型重复生成内容：根因剖析与优化策略

前言最近在调试大模型应用过程中，遇到了如下问题：复制大模型首次生成内容与「重新生成」两次返回的内容近乎完全相同，几乎没有体现出任何差异性。面对这种情况，造成大模型输出高度相似的原因是什么呢？我们又该采取怎样的调整策略，才能使重新生成的内容与前次存在明显差异，提升输出的多样性呢？

4/28/2025 2:22:00 AM

张张

Encoder-free无编码器多模态大模型EVEv2模型架构、训练方法浅尝

基于视觉编码器的MLLM的基本构成：MLLM通常由预训练的模态编码器、预训练的LLM和一个连接它们的模态接口三个模块组成。模态编码器(如：CLIP-ViT视觉编码器、Whisper音频编码器等)将原始信息（如图像或音频）压缩成更紧凑的表示。预训练的LLM则负责理解和推理处理过的信号。

4/28/2025 2:03:00 AM

余俊晖

资讯热榜

最具争议性研究：大模型中间层输出可 100% 反推原始输入 Wan2.2-Animate又火了！5分钟让抠脚大汉秒变高冷女神奥特曼回应一切：重组后仍需微软支持，不相信OpenAI的欢迎做空 OpenAI 或将于明年上市，估值可达万亿！亚马逊股价暴涨 13%，人工智能推动云计算迎来多年最快增长 Bevel 获得 1000 万美元 A 轮融资，致力于 AI 健康助手创新「套壳」的最高境界：OpenAI揭秘Atlas浏览器架构OWL OpenAI更新ChatGPT规则：10月29日起禁止医疗、法律与财务建议

标签云

AI 人工智能 OpenAI AIGC 模型 ChatGPT DeepSeek 谷歌 AI绘画大模型机器人数据 Midjourney 开源 Meta AI新词微软智能用户 GPT 学习技术智能体马斯克 Gemini 图像 Anthropic 英伟达 AI创作训练 LLM 论文代码算法 Agent AI for Science 芯片苹果 Claude 腾讯 Stable Diffusion 蛋白质开发者生成式神经网络 xAI 机器学习 3D RAG 人形机器人 AI视频研究大语言模型生成具身智能 Sora 工具 GPU 百度华为计算字节跳动 AI设计大型语言模型 AGI 搜索视频生成场景深度学习架构生成式AI DeepMind 编程视觉 Transformer AI模型预测亚马逊特斯拉 MCP

大模型

快手All in AI视觉！成立可灵AI事业部，加速大模型商业化

中国开源大模型新成员：小米推理大模型首秀！

真假难辨!腾讯混元Turbo S助《太空杀》AI玩家智商飙升

​蚂蚁数科发布金融智能体开发平台 Agentar，推动 AI 技术在金融领域应用

加速追赶！腾讯拆分AI团队，豪掷研发资源

Qwen3来了！新一代高性能与混合推理能力兼备的大语言模型！

万兴科技与华为云携手推进 AI 大模型技术创新

AI知识库的真相，你知道吗？

​2024 年中国 MaaS 与 AI 大模型解决方案市场迎来爆发式增长

蚂蚁数科发布金融智能体开发平台Agentar 内测上线超百个金融MCP服务

52页PPT，谷歌Gemini预训练负责人首次揭秘！扩展定律最优解

深夜突袭，阿里Qwen3登顶全球开源王座！暴击DeepSeek-R1，2小时狂揽17k星

“大模型失联”的凌晨，我靠这四个配置救了全组！LangChain4j API 进阶指南

​阿里 AI 工程师余亮荣获 “全国劳动模范” 称号

字节跳动启动 “Top Seed” 计划，面向 2026 届博士生招募 AI 人才

ICLR 2025：顶尖科学家最关心的 AI 趋势有哪些？丨GAIR Live

大模型重复生成内容：根因剖析与优化策略

Encoder-free无编码器多模态大模型EVEv2模型架构、训练方法浅尝

蚂蚁数科发布金融智能体开发平台 Agentar，推动 AI 技术在金融领域应用

2024 年中国 MaaS 与 AI 大模型解决方案市场迎来爆发式增长

阿里 AI 工程师余亮荣获 “全国劳动模范” 称号