大模型
真假难辨!腾讯混元Turbo S助《太空杀》AI玩家智商飙升
社交推理游戏《太空杀》正迎来一场人和AI推理水平的大PK。 巨人网络旗下这款风靡全球的手游,通过接入腾讯混元新一代旗舰快思考模型Turbo S,使其AI玩家的智能水平实现了高度拟人化。 腾讯混元Turbo S能够同时驱动八名AI玩家参与游戏,凭借其强大的推理能力和仿真的文字对话能力,与真人玩家展开智力较量。
4/30/2025 2:00:41 PM
AI在线
蚂蚁数科发布金融智能体开发平台 Agentar,推动 AI 技术在金融领域应用
在数字中国建设峰会期间,蚂蚁数科正式推出了智能体开发平台 Agentar。 该平台旨在为金融机构提供一站式、全栈的智能体开发工具,帮助它们高效地打造具备自主决策能力、可信赖的金融智能体应用。 此次发布标志着 AI 技术从 “辅助工具” 转变为推动金融服务变革和效率提升的 “生产力引擎”。
4/30/2025 12:00:40 PM
AI在线
加速追赶!腾讯拆分AI团队,豪掷研发资源
据央广网消息,4月29日,公司对其混元大模型研发体系进行全面重构,聚焦算力、算法和数据三大核心,调整团队部署并加大研发投入。 此次调整的核心是成立两个新的部门:大语言模型部和多模态模型部,分别负责探索前沿技术、迭代基础模型。 同时,腾讯加强了底层支撑,设立数据平台部和机器学习平台部,专注于数据管理和AI平台建设,为混元大模型的研发提供全面支持。
4/30/2025 11:00:50 AM
AI在线
Qwen3来了!新一代高性能与混合推理能力兼备的大语言模型!
阿里云正式发布通义千问Qwen3系列大模型,这一里程碑式更新在性能、训练规模和推理能力等多个维度实现重大突破。 作为国产大模型的领军者,Qwen3不仅以2350亿参数的MoE架构刷新性能记录,更通过创新的"混合思考模式"和360万亿token的超大规模训练,成为当前性能领先的开源大语言模型。 1、Qwen3的性能表现Qwen3系列包含多个版本,涵盖MoE混合专家模型和Dense稠密模型。
4/30/2025 10:59:04 AM
万兴科技与华为云携手推进 AI 大模型技术创新
近日,万兴科技集团股份有限公司(以下简称 “万兴科技”)与华为云计算技术有限公司(以下简称 “华为云”)在深圳签署了战略合作协议。 此次合作旨在结合双方的优势,共同推动 AI 大模型的技术和应用创新,进一步开拓数字创意领域的潜力。 根据协议,万兴科技将充分发挥其在音视频大模型和 AI 应用方面的专业能力,而华为云则将利用其强大的云基础设施和市场拓展优势,建立深度合作关系。
4/30/2025 10:00:50 AM
AI在线
AI知识库的真相,你知道吗?
很多人对AI知识库的想象是这样的,他们以为只需将所有资料一股脑地拖进AI客户端,比如 Cherry Studio 内。 图片这样,AI就会认真阅读所有内容,并自动生成完美结论。 然而,实际体验后,许多人发现AI知识库的效果远没有想象中理想,经常遇到各种奇怪的问题。
4/30/2025 9:06:23 AM
程序员NEO
2024 年中国 MaaS 与 AI 大模型解决方案市场迎来爆发式增长
根据国际数据公司(IDC)发布的最新报告,2024年中国模型即服务(MaaS)及 AI 大模型解决方案市场将迎来显著增长,全年市场规模预计达到7.1亿元人民币,相较于2023年实现215.7% 的同比激增。 其中,2024年下半年市场规模将达到4.6亿元人民币。 展望未来五年,这一市场将以66.1% 的年均复合增长率继续扩张,预计到2029年市场规模将达到90亿元人民币。
4/29/2025 6:00:40 PM
AI在线
蚂蚁数科发布金融智能体开发平台Agentar 内测上线超百个金融MCP服务
4月29日,在数字中国建设峰会期间,蚂蚁数科正式对外发布智能体开发平台Agentar,为金融机构提供一站式、全栈的智能体开发工具,助力金融机构高效打造能够自主决策、可信可靠的金融智能体应用,加速AI技术从“辅助工具”真正成为驱动体验变革、效率跃升的“生产力引擎”。 随着生成式AI的快速发展,行业大模型及智能体应用正在重塑金融服务。 然而,大模型训练成本高昂难以在普惠场景中规模化复制;金融行业数据的高敏感性与安全合规要求;以及金融核心场景数据样本量较小、通用模型在金融专业场景中泛化能力不足等问题都在制约大模型技术在金融行业应用的深度与广度。
4/29/2025 4:00:40 PM
AI在线
52页PPT,谷歌Gemini预训练负责人首次揭秘!扩展定律最优解
谷歌凭借Gemini 2.5 Pro在激烈的大模型竞争中一举翻盘。 近日,Geimini Flash预训练负责人Vlad Feinberg在普林斯顿大学分享了相关内容。 他深入分析了Gemini预训练的方法、挑战以及方向,如何在模型大小、算力、数据和推理成本间取得平衡。
4/29/2025 9:16:00 AM
新智元
深夜突袭,阿里Qwen3登顶全球开源王座!暴击DeepSeek-R1,2小时狂揽17k星
就在今天凌晨,备受全球期待的阿里新一代通义千问模型Qwen3开源! 一经问世,它立刻登顶全球最强开源模型王座。 它的参数量仅为DeepSeek-R1的1/3,但成本大幅下降,性能全面超越R1、OpenAI-o1等全球顶尖模型。
4/29/2025 8:14:14 AM
新智元
“大模型失联”的凌晨,我靠这四个配置救了全组!LangChain4j API 进阶指南
1.引言大家好,我是小米,一个31岁、依然热爱编码的程序员大哥哥~今天给大家分享一个我最近在项目里踩坑无数、最后“高光时刻”拯救全组的进阶配置经验——LangChain4j 的 API 进阶配置四大件:日志、监控、重试、超时。 你以为 LangChain4j 就只是个 Java 包装器? 配置对了,它能稳定、健壮、可观测,能用得安心、跑得漂亮!
4/29/2025 3:40:00 AM
软件求生
阿里 AI 工程师余亮荣获 “全国劳动模范” 称号
在 “庆祝中华全国总工会成立100周年暨全国劳动模范和先进工作者表彰大会” 上,阿里巴巴的员工余亮荣获 “全国劳动模范” 荣誉称号,这也是阿里 AI 工程师首次获得这一殊荣。 余亮是一位专注于大数据和智慧城市领域的杰出工程师,他的贡献在行业内得到了广泛认可。 余亮毕业于武汉大学,曾在浙江大学及海外顶尖高校和研究机构进行博士后研究,并担任研究员和科学家等职务。
4/28/2025 3:00:50 PM
AI在线
字节跳动启动 “Top Seed” 计划,面向 2026 届博士生招募 AI 人才
字节跳动近日宣布正式启动2026届 “Top Seed” 大模型顶尖人才校招计划,计划招募约30位优秀博士生。 这一项目专注于前沿的人工智能领域,涵盖大语言模型、机器学习算法与系统、多模态生成与理解、语音处理等研究方向。 字节跳动希望通过此举,吸引那些在大模型研究领域具备极强潜力和热情的年轻才俊。
4/28/2025 12:00:40 PM
AI在线
ICLR 2025:顶尖科学家最关心的 AI 趋势有哪些?丨GAIR Live
自 GPT-4 发布至今已有两年,但对大语言模型的研究并没有放缓,我们仍处在一个技术进步涌现的时代。 Anthropic 于 2024 年11月发布 MCP,成为接通 AI 生态的桥梁,自主的 Agent 工作流距我们更进一步。 GPT-4o、GPT-4.1时隔仅一个月先后发布,实现上下文处理能力八倍提升。
4/28/2025 11:19:00 AM
郑佳美||梁丙鉴
大模型重复生成内容:根因剖析与优化策略
前言最近在调试大模型应用过程中,遇到了如下问题:复制大模型首次生成内容与「重新生成」两次返回的内容近乎完全相同,几乎没有体现出任何差异性。 面对这种情况,造成大模型输出高度相似的原因是什么呢? 我们又该采取怎样的调整策略,才能使重新生成的内容与前次存在明显差异,提升输出的多样性呢?
4/28/2025 2:22:00 AM
张张
Encoder-free无编码器多模态大模型EVEv2模型架构、训练方法浅尝
基于视觉编码器的MLLM的基本构成:MLLM通常由预训练的模态编码器、预训练的LLM和一个连接它们的模态接口三个模块组成。 模态编码器(如:CLIP-ViT视觉编码器、Whisper音频编码器等)将原始信息(如图像或音频)压缩成更紧凑的表示。 预训练的LLM则负责理解和推理处理过的信号。
4/28/2025 2:03:00 AM
余俊晖
字节跳动启动 Top Seed 大模型顶尖人才计划 2026 届校招,计划招募 30 位顶尖博士
字节跳动正式启动2026届Top Seed校招,计划招募30位顶尖博士,研究方向涵盖大语言模型、多模态生成等前沿领域。不限专业背景,更看重研究潜力与热情。#字节跳动校招# #大模型人才#
4/27/2025 5:56:06 PM
远洋
答对有资格入职特斯拉?马斯克这道数学题,我们用七大 AI 模型测了一遍
此前,马斯克在社交平台 X 上贴出了一道数学题,并表示如果有人解开这个问题,就有资格在特斯拉公司工作,引起了很多网友的讨论
4/27/2025 2:57:01 PM
汐元
资讯热榜
标签云
人工智能
OpenAI
AIGC
AI
ChatGPT
AI绘画
DeepSeek
数据
模型
机器人
谷歌
大模型
Midjourney
智能
用户
开源
学习
GPT
微软
Meta
图像
AI创作
技术
论文
Stable Diffusion
马斯克
Gemini
算法
蛋白质
芯片
代码
生成式
英伟达
腾讯
神经网络
研究
计算
Anthropic
3D
Sora
AI for Science
AI设计
机器学习
开发者
GPU
AI视频
华为
场景
人形机器人
预测
百度
苹果
伟达
Transformer
深度学习
xAI
模态
字节跳动
Claude
大语言模型
搜索
驾驶
具身智能
神器推荐
文本
Copilot
LLaMA
算力
安全
视觉
视频生成
训练
干货合集
应用
大型语言模型
科技
亚马逊
智能体
DeepMind
特斯拉