大模型 方向最近有哪些内容值得看
今日资讯 大模型
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,442
正文图片
13,916

JetBrains 开源 Mellum2 模型:12B 参数,升级 AI 智能体编程
IT之家 6 月 2 日消息,JetBrains 昨日(6 月 1 日)发布博文, 宣布开源 Mellum2 模型,这是面向软件工程系统的新机器学习模型。 官方表示相比原版 Mellum,它从代码补全模型升级为完整编码助手,并把上下文窗口从 8192 Token 扩到 13107...

手机上跑MoE?Meta提出MobileMoE,iPhone 16 Pro提速3.8倍
近年来, 混合专家模型(MoE) 已广泛用于云端大模型。但在手机端, 大语言模型(LLM) 仍以稠密架构为主。过去,手机设备对内存、算力和时延的约束更严苛,子十亿活跃参数范围内的端侧 MoE 一直缺少系统研究。如今,随着移动设备 DRAM 容量提升,MoE 也开始有机会部署到智能...

字节开源统一框架Bernini:给DiT配个“大模型军师”,AI视频编辑先理解再动手
梦瑶 发自 凹非寺 量子位 | 公众号 QbitAI 大家都懂,视频生成这件事,最让创作者头疼的,不一定是画面不够清晰。 而是模型常常 听不懂人话 !!!(扎心.jpg) 想把晴天改成雪天,它可能只会往画面上撒雪花;想把一段动画植入商场LED大屏,它可能边界乱飘、透视不稳。 于是...

最高狂降97.5%!腾讯云大模型全面降价,彻底持平官方原厂价
为了进一步降低企业与开发者的创新门槛,腾讯云智能体开发平台于周二正式宣布了一项重大的价格调整举措。平台将于北京时间 6 月 3 日零时起,对深度求索(DeepSeek)旗下的 V4 系列大模型进行全面大幅度降价。 核心模型价格全线跳水 在本次价格调整中,主力模型 DeepSeek...

牧原股份与阿里云签署养猪大模型协议
IT时代网6月2日消息,6月1日,牧原食品集团股份有限公司与阿里云计算有限公司正式签署养猪大模型战略合作协议,推动人工智能与养猪业的深度融合,为养猪产业转型升级注入新动能。 阿里云智能集团公共云事业部副总裁高飞,牧原股份养猪生产首席运营官李彦朋代表双方签署协议。 牧原:30余年养...

滴普科技赵杰辉:企业 AI 技术生态,正在被重构
(本文作者为 滴普科技赵杰辉,钛媒体经授权发布) 在AI Agent 浪潮席卷产业的当下,企业级 AI 落地的核心诉求已从“模型性能突破”转向“实际价值落地”,而如何让AI真正转化为企业可感知、可量化的生产力,成为行业共同面临的核心课题。 为此,滴普科技(1384.HK)创始人、...

字节AI大牛顾全全宣布离职,或投身AI4S创业
机器之心编辑部 刚刚,顾全全发文告别字节 Seed 团队。在此之前,他是 Seed 旗下聚焦科学智能领域的 AI4S 团队核心成员。 他在告别贴文中写道: 今天是我在 ByteDance Seed 的最后一天。 过去三年里,我有幸同时耕耘于人工智能领域两个最激动人心的前沿方向:A...

黄仁勋、Marvell CEO同台对谈:未来AI拼的不是算力是连接,“能用铜就用铜,必须用光才用光”!
随着AI模型走向庞大的“智能体(Agent)”时代,数据中心的算力瓶颈正逐渐向“连接”转移,一场由铜缆向光纤跨越的底层基础设施革命正在全面引爆。 在中国台北Computex大会的第二天,AI定制芯片、光通信与数据中心互联龙头Marvell董事长兼CEO Matt Murphy发表...

国内首个 Frontier 三件套开源大模型:MiniMax M3 完整技术拆解
刚刚,MiniMax M3 正式官宣发布。 根据官方介绍,MiniMax M3 是国内首个同时具备 「Coding Frontier+ 1M 上下文窗口 + 原生多模态」 三个核心能力的开源模型,同时还推出了配套代码智能体产品 MiniMax Code。不过,开发者体验下来,M3...

特斯拉车主狂喜!官方高调预热车载 AI 语音,传将首度接入国产双大模型
特斯拉在华的车载语音交互体验或许很快就将迎来颠覆性的蜕变。今日,特斯拉中国官方突然发布了一段围绕“语音助手控制”展开的宣传视频,全方位展示了全新车载语音助手的智能化表现与新功能。这一举动立刻引发了汽车科技圈的广泛关注,被外界视为其车载语音系统大升级的强烈信号。 一直以来,由于缺乏...

微软首个自研推理模型 MAI-Thinking-1、新 Copilot 超级应用曝光
IT之家 6 月 2 日消息,科技媒体 The Verge 昨日(6 月 1 日)发布博文,报道称北京时间明日(6 月 3 日)凌晨 0 点 30 分召开的 Build 2026 大会上, 微软将发布 MAI-Thinking-1,这是其首个自研推理模型,且未用其他模型输出蒸馏训...

双料齐发!明略科技 Cider 端侧推理加速框架与 Mano-P 端侧模型
近日,明略科技正式开源自研 Cider 推理加速 SDK(软件开发工具包),以及端侧 GUI 智能体模型 Mano-P。继此前开源的 Mano-CUA skill 之后,本次 Mano-P 模型的开源直观展现了端侧模型在真实业务闭环中的巨大潜能。而 Cider 框架则从计算算子与...

Step 3.7 Flash发布:Flash价格和效率,Pro级别的Agent能力
专注AIGC技术的专业社区,关注大语言模型(LLM)的发展和应用落地,聚焦LLM及AI技术的市场研究和开发者生态,欢迎关注! 模型竞争,正在从更聪明转向更实用。 模型能不能独立干活,活干得好不好,干活的成本能不能承受,出了岔子能不能自己兜回来,这些都是用户真正在乎的。 阶跃星辰发...

牛津、英伟达等提出记忆压缩新范式:训练时让模型学会断舍离
编辑|Panda 2026 年初,各大 AI 厂商在上下文窗口长度上展开激烈角逐。Google 的 Gemini 3 Pro 已支持 100 万级 token 上下文,Meta 的 Llama 4 Scout 更宣称可处理 1000 万 token。GPT-5 系列也在快速推进长...
国产具身智能迎突破!越疆发布“空弈”大模型,标准任务成功率超99%
具身智能领域迎来重要技术突破。机器人企业越疆正式发布了其自主研发的世界动作模型——“空弈DobotWAM”具身大模型,标志着该品牌在推动机器人理解与执行复杂现实任务方面迈出了关键一步。 作为评估该模型核心能力的重要指标,“空弈”具身大模型在业内公认的具身智能标准评测基准 LIBE...

2026 年大模型选型指南:从技术到应用,一篇看懂避坑与选品
一、摘要 随着人工智能技术持续发展,大模型已经从早期的文本问答工具,逐步扩展到文本、图片、音频、视频、代码、办公自动化和智能硬件联动等多类场景。对于企业和开发团队而言,大模型选型已经不再只是比较“回答是否流畅”,而是要综合考察多模态能力、长文本处理、复杂推理、部署成本、行业适配、...

智谱深夜公告,大模型双子星抢滩A股
昨晚,智谱在港交所发布公告称,公司董事会已通过建议A股发行议案,拟向中国相关监管机构申请配发及发行A股,并向上海证券交易所申请A股在科创板上市交易。 这意味着,继2025年4月首次办理A股上市辅导、2026年2月重新备案后,智谱正式披露了港股上市后的A股发行方案。 几天前,Min...
阿里巴巴云计算团队如何让AI“边探索边利用”,彻底告别训练失控的烦恼?
这项由阿里巴巴云计算集团主导的研究,发表于2026年第43届国际机器学习大会(ICML 2026),会议地点为韩国首尔,收录于PMLR第306卷。有兴趣深入研究的读者可通过论文编号arXiv:2605.28109查询完整论文。 一个让AI学会"刚好好奇"的问题 每当我们教一个孩子...

免费时代终结:豆包收费,3.45亿用户的历史性转折
作者:快思慢想研究院 田丰,中国青年报 贾骥业 编者按:当海量用户的算力账单烧穿"免费"神话,中国AI大模型商业化的历史性转折开始了。 一、天下没有免费的午餐 2026年暮春,一则悄然更新在苹果App Store的订阅声明,在中国互联网掀起了一场久违的舆论风暴。 AI助手豆包宣布...