重构腾讯 AI 之后,姚顺雨交出入场后的第一份答卷
极客一问:你看好接下来的混元大模型吗? 头图来源:GPT生成 姚顺雨交出了加入腾讯后的第一份模型答卷。 4 月 23 日,腾讯混元 Hy3 preview 语言模型发布并开源。这是一款主打快慢思考融合的 MoE 语言模型,总参数 295B,激活参数 21B,最大支持 256K 上...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,492
正文图片
14,137
极客一问:你看好接下来的混元大模型吗? 头图来源:GPT生成 姚顺雨交出了加入腾讯后的第一份模型答卷。 4 月 23 日,腾讯混元 Hy3 preview 语言模型发布并开源。这是一款主打快慢思考融合的 MoE 语言模型,总参数 295B,激活参数 21B,最大支持 256K 上...

作者|桦林舞王 编辑| 靖宇 4 月 9 日,一篇来自 Anuttacon 团队的论文悄悄出现在 arXiv 上。论文展示了一个叫 LPM 1.0 的视频模型——全称 Large Performance Model,注意,是 Performance(表演)...

4 月 22 号,拉斯维加斯,Google Cloud Next 2026 正在如火如荼地举行。 了解 Google 每年产品发布节奏的人都知道,I/O 是讲手机、讲安卓、讲各种新产品如何改变人类世界。而 Next 的画风完全不同,它一上来就直奔企业客户,聚焦在云基础设施怎么搭,...

作者| Moonshot 编辑| 靖宇 试想一个场景。 你在闲鱼上挂出了一辆吃灰两年的旧自行车,并在后台设定了 300 元的心理底价。十分钟后,手机弹出通知,你的专属 AI 助手已经与另一位买家的 AI 助手,完成了三轮讨价还价,最终以 400 元的价格将自行车卖出,快递正在上门...

作者| Li Yuan 编辑|靖宇 机器人终于开始学做西红柿炒鸡蛋了。 过去几年,人形机器人行业最擅长的事情,是跳舞、翻跟头、搬箱子,以及在视频里越走越像人。但普通人对机器人的期待,往往还是会回到一个很朴素的问题:它到底什么时候能帮我做家务? 这件事一直很难。 家务不是一套标准动...

极客一问:你怎么看这次 DeepSeek V4 的更新? 头图来源:GPT生成 万众期待中,DeepSeek V4,终于发布了! 就在刚刚,被期待已久的DeepSeek V4 预览版正式登场。两个版本—— V4-Pro 和 V4-Flash,全系标配 1M...

作者|汤一涛 编辑| 靖宇 Opus 4.7 刚发布那几天,X 上怨声载道。有人说一次对话就把她的 session 额度用光了,有人说同一段代码跑完的成本比上周翻了一倍多;还有人晒出自己 200 美元 Max 订阅不到两小时就触顶的截图。 独立开发者 BridgeMind 承认 ...

编者按:本文来自微信公众号 “卫夕指北”(ID:weixizhibei) ,作者:卫夕, 创业邦经授权转载。 我最近买了一个这样的键盘—— 为什么要买这个键盘呢? 原因在于现在各种 AI 的快捷键实在是太多了,原来键盘的组合键不够用了。 有了这个东西,我就可以放飞地设置了。 比如...

在深度求索发布的DeepSeek V4技术报告中,一份近300人的「研究与工程」作者名单引发外界关注,因为名单中的10人被标注「已离职」。 具体来看,DeepSeek V4核心开发团队成员中,王炳宣(Bingxuan Wang)、阮肿(Chong Ruan)、郭达雅(Daya G...

编者按:本文来自微信公众号 “锦缎”(ID:jinduan006) ,作者:海星 ,创业邦经授权转载。 从报纸到电视,从PC互联网到移动互联网,每一次媒介形态的跃迁都伴随着价值链的重新洗牌。 其中最重要的启示在于:旧秩序中的王者未必能延续辉煌,而抓住新媒介红利的挑战者往往能实现弯...

5 月 8 日,中国移动在 2026 移动云大会上,抛出了一个 AI 时代的新命题—— Token,不仅推出万亿级词元(Token)服务体验包和升级后的移动模型服务平台 MoMA,更重要的还是全新发布的 Token 运营生态体系,将 Token 打造成连接算力、模型、应用与用户的...
编者按:本文来自微信公众号 “硅基星芒” ,作者:穆阳 ,创业邦经授权转载。 在硅谷漫长的造富史里,还没有哪家公司在上市前让如此多的员工一次性套现如此巨额的财富。 据《华尔街日报》5月10日报道,2025年10月,超过600名OpenAI现任及前任员工通过二级市场出售了总计66亿...

不是哥们,这年头AI也溜冰了? 就在这几天,Github上出现了一篇名为《AI Wellbeing: Measuring and Improving the Functional Pleasure and Pain of AIs》的论文,论文主题就是,如何量化与提升AI的功能性愉...

作者|Cynthia 编辑| 郑玄 最近有一个感受,AI 营销工具越来越多,但企业获客的成本分文未减;用户刷到的广告越来越多,但想买的东西却越来越少。 尤其是营销端, 如果一个企业突然决定增大投放力度,通常不是因为找到了什么更优的投放链路,更大概率是对手投流增加了。 于是,投流就...

头图来源:吉利汽车 触目所及,满眼都是绿色。围绕着展览馆区域,整个圣何塞市中心,包括人们胸前的证件,充满了硅谷特有的「赛博绿」。 这是英伟达 GTC2026 大会的现场,全球超过 3 万人,来到这里,希望能更贴近快速进化的 AI 的最前沿。仿佛受到人们热情的感染,加州今年的天气反...

对创业者来说,「命」这个东西由天也由己。而所有的胜利,最终都是世界观的胜利。 对话|张鹏 编辑| Li Yuan 今天,群核上市了。 按常理说,到了这个节点,CEO 往往会被资本市场、投资人、媒体、路演塞满日程,整个人都处在一种高度紧绷的状态里。 但有点出乎我意料的是,可能是因为...

作者 | 黄昱 4月23日,腾讯正式揭开了Hy3 preview (混元3.0预览版)的神秘面纱,并开源。 Hy3 preview 是一个快慢思考融合的 MoE 语言模型,总参数 295B,激活参数 21B,最大支持 256K 上下文长度。 不难发现,Hy3 preview并没有...

近日,AMD 正式发布了名为 vLLM-ATOM 的全新插件。这款工具的核心使命是在维持现有工作流不变的前提下,显著榨取硬件潜能,为 DeepSeek-R1、Kimi-K2以及 gpt-oss-120B 等主流大语言模型的推理过程实现大幅提速。 对于开发者而言, vLLM 是一套...

近日,稀宇科技(MiniMax)发布了一份技术报告,详细剖析了其 M2系列模型为何无法准确输出“马嘉祺”等特定人名的深层原因。这起看似偶然的错误,实际上揭示了当前大模型训练中普遍存在的一个隐蔽缺陷。 词元偏移:被“挤压”的向量空间 问题的核心源于大模型处理文本的基本单位——分词器...