
阿里云灵骏真武M890超节点上线乌兰察布:64卡800GB/s互联,国内首跑2万亿参数大模型
ITCOW牛新网 8月12日消息,阿里云今日把灵骏真武 M890 超节点实例推上云市场,首站开在内蒙古乌兰察布地域,企业客户不用碰自建机房,直接在云上租一个 64 卡高速互联单元,就能跑十万亿参数量级的 MoE 大模型推理。 这颗超节点是国内第一个实跑过超 2 万亿参数大模型的同...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,507
正文图片
14,213

ITCOW牛新网 8月12日消息,阿里云今日把灵骏真武 M890 超节点实例推上云市场,首站开在内蒙古乌兰察布地域,企业客户不用碰自建机房,直接在云上租一个 64 卡高速互联单元,就能跑十万亿参数量级的 MoE 大模型推理。 这颗超节点是国内第一个实跑过超 2 万亿参数大模型的同...

OpenAI旗舰模型GPT-5.6 Sol在两个第三方平台迎来大幅折扣,但这场看似实惠的促销背后,正引发业界对其真实动机的质疑。 8月17至18日, OpenAI与OpenRouter及Vercel AI Gateway合作,在两个平台上对GPT-5.6 Sol提供50%限时折扣...

8月20日消息,据《读佳》获悉,阿里旗下的虎鲸文娱集团已自研完成“虎鲸AI大模型”,并且正在内测一款全新的AI视频内容创作工具“虎鲸AI”。 据了解,虎鲸AI部分功能需要充值才能使用,整个项目的研发测试至少已有半年以上。目前该工具无法直接登录使用,仅供受邀用户使用。 结合虎鲸文娱...

昨天,宇树科技刚刚登陆科创板,王兴兴身家飙升至千亿,成为科创板最耀眼的90后首富。 今天一早,他就出现在WRC世界机器人大会。没有演讲稿,没有PPT封面,穿着一件白衬衫,开口后也没提上市,而是直面行业灵魂拷问: 机器人到底什么时候才能真正走进 家庭 ?也坦承 “ 过去很多动作演示...

每经记者|岳楚鹏 高涵 每经编辑|王嘉琦 高涵 近日,OpenAI和Anthropic的首次公开募股(IPO)有了新进展。 Anthropic最快将于8月底递交IPO文件,并有望打破SpaceX的最大IPO纪录;OpenAI高管表示公司将在2027年IPO。 但在此时, 有分析师...

杨植麟也是 Jeff Dean PPT 中列出的谷歌系创始人名单中的一位。 作者丨高允毅 郑佳美 编辑丨岑 峰 聚是一团火,散是满天星,这句话用在谷歌当年的核心实验室 Google Brain 最合适不过。 今早,谷歌传奇人物,首席科学家兼 Google Brain 创始人之一 ...

从异常激活到专家拥堵,拆解超大模型训练难点。 作者丨郑佳美 编辑丨岑 峰 这几天,Kimi 研究员、RoPE 提出者苏剑林发布了一篇名为《简单谈谈 K3 的 MoE 和 Attention》的文章,集中讨论了 Kimi K3 在专家架构、训练稳定性、负载均衡和注意力设计上的几项关...

张一鸣要的是,下一轮竞争中,Seed模型能力跻身世界第一梯队 作者丨高允毅 编辑丨岑 峰 近日,The Information爆出,在两周前的 Seed 全员会上,张一鸣罕见发声,明确拒绝以蒸馏手段追赶前沿大语言模型。他的态度很坚决:“字节跳动应该愿意为了长远目标牺牲一些短期利益...
继此前财报会议公开预告后,腾讯新一代大模型Hy4 的内部测试界面近日正式曝光,这意味着其距离正式发布已为期不远。从泄露的模型选择界面来看,腾讯延续了“自研模型与集成优秀开源方案并行”的既定战略,共提供了三项核心选择:定位为专家级大模型的Hy4、标注为新升级且适用大部分场景的Hy3...
8 月 20 日, 2026 全球数字经济大会拉萨分会场“数启纳金·智汇高原”主题论坛在拉萨盛大举行。在本次活动现场,拉萨市纳金数智研究院正式揭牌成立,备受瞩目的“阳光清言”通用藏语大模型也同步迎来了正式发布。 据了解,“阳光清言”通用藏语大模型的研发成果最早于 2025 年 1...

商汤科技正式宣布开源全新的轻量级、原生统一多模态大模型 SenseNova U1.5Lite。作为一款参数量为8B 的轻量化模型,它在多项核心视觉任务中展现出了超越同量级模型的实力,甚至在部分复杂排版与文字渲染上达到了媲美超大规模商业模型的交付水平。 SenseNova U1.5...
8 月 21 日下午,科大讯飞在 2026 年半年度业绩说明会上释放了一个重磅消息:公司总裁吴晓如透露,科大讯飞将在今年全球 1024 开发者节上,正式推出基于全国产算力的全新主力通用大模型。 作为行业备受瞩目的技术演进节点,这一全新大模型的落地节奏已经明确。按照规划,科大讯飞将...

8月以来,腾讯混元多模态团队接连发生多起人事变动。 据多家媒体报道,原xAI多模态理解负责人蔺旭东已离开xAI,加入腾讯混元担任多模态内容生成算法负责人。 与此同时,混元文生视频和文生图片算法负责人钟钊被曝已离职。混元多模态业务原负责人薄列峰也可能发生变动。 蔺旭东2018年毕业...
8月21日清晨,北京中关村国际创新中心畅春厅座无虚席。这场首次由官方主办的2026科学智能大会,迎来了近50位院士、80余位青年学者和2000多名参会者。鄂维南开场的一句话耐人寻味——“科学智能大会办了好几年,过去是民办的,这是第一次官办。” 从“民办”到“官办”的一字之变,背后...

最能动手折腾模型的开源社区开发者,往往也是最会玩梗造概念的一群人。最近半年,他们最爱的一个概念是“斩杀线”。 这个词借自游戏,后来在更广泛的场合里变得更加流行。它原指血量落到某个数字以下,对手下一回合就能把你带走,比赛实际上已经提前结束。 把它套到模型上,过往一段时间人们指代的是...

大模型圈流传着一句话,参数越多,模型越强。智谱创始人唐杰近日在X平台发布长文,对这句话提出了质疑。 文章题为《Thoughts About Scaling Law》(关于 Scaling Law 的一些思考)。开篇先抛出发布会上最常见的那个问题,Scaling 还在继续,但 Sc...
苹果正在中国市场走一条前所未有的AI路径。 据路透社14日援引知情人士透露, 苹果已针对中国市场单独训练了一款大语言模型,并在阿里巴巴的支持下完成开发 ——这标志着苹果在华AI战略的重大转变,也将使其成为首家获北京批准、在中国推出自有专属AI模型的外国企业。 据路透社报道,三名知...

近期,Hugging Face发布了最新报告《开源模型现状:2026年夏季观察报告》。 报告中指出,2026年以来,中国实验室在前沿开放模型的参数规模上持续领先,美国的竞争重心则逐渐从Meta、谷歌等模型实验室转向英伟达、AMD等芯片和基础设施公司。 更值得注意的是,中国模型正在...

7月27日晚,月之暗面宣布Kimi K3模型正式开源,同步发布模型文件及技术报告,并开源三项基础设施技术。开发者可通过Hugging Face社区下载模型进行本地部署和二次开发。 Kimi K3是一款混合专家架构大语言模型,总参数规模2.8万亿,采用896个路由专家,每个Toke...

7月29日,月之暗面完成超35亿美元F轮融资,投后估值350亿美元,因认购金额超出原定目标三倍有余,该轮提前关闭。原定8月启动的Pre‑IPO轮(G轮)已提前开始,投前估值喊至500亿美元。 从2025年底的43亿美元到眼下500亿美元的投前估值,这家成立仅三年多的AI创业公司,...