国产大模型再迎重磅升级,科大讯飞即将发布全新主力通用大模型
8 月 21 日下午,科大讯飞在 2026 年半年度业绩说明会上释放了一个重磅消息:公司总裁吴晓如透露,科大讯飞将在今年全球 1024 开发者节上,正式推出基于全国产算力的全新主力通用大模型。 作为行业备受瞩目的技术演进节点,这一全新大模型的落地节奏已经明确。按照规划,科大讯飞将...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,516
正文图片
14,308
8 月 21 日下午,科大讯飞在 2026 年半年度业绩说明会上释放了一个重磅消息:公司总裁吴晓如透露,科大讯飞将在今年全球 1024 开发者节上,正式推出基于全国产算力的全新主力通用大模型。 作为行业备受瞩目的技术演进节点,这一全新大模型的落地节奏已经明确。按照规划,科大讯飞将...

8月以来,腾讯混元多模态团队接连发生多起人事变动。 据多家媒体报道,原xAI多模态理解负责人蔺旭东已离开xAI,加入腾讯混元担任多模态内容生成算法负责人。 与此同时,混元文生视频和文生图片算法负责人钟钊被曝已离职。混元多模态业务原负责人薄列峰也可能发生变动。 蔺旭东2018年毕业...
8月21日清晨,北京中关村国际创新中心畅春厅座无虚席。这场首次由官方主办的2026科学智能大会,迎来了近50位院士、80余位青年学者和2000多名参会者。鄂维南开场的一句话耐人寻味——“科学智能大会办了好几年,过去是民办的,这是第一次官办。” 从“民办”到“官办”的一字之变,背后...

最能动手折腾模型的开源社区开发者,往往也是最会玩梗造概念的一群人。最近半年,他们最爱的一个概念是“斩杀线”。 这个词借自游戏,后来在更广泛的场合里变得更加流行。它原指血量落到某个数字以下,对手下一回合就能把你带走,比赛实际上已经提前结束。 把它套到模型上,过往一段时间人们指代的是...

大模型圈流传着一句话,参数越多,模型越强。智谱创始人唐杰近日在X平台发布长文,对这句话提出了质疑。 文章题为《Thoughts About Scaling Law》(关于 Scaling Law 的一些思考)。开篇先抛出发布会上最常见的那个问题,Scaling 还在继续,但 Sc...
苹果正在中国市场走一条前所未有的AI路径。 据路透社14日援引知情人士透露, 苹果已针对中国市场单独训练了一款大语言模型,并在阿里巴巴的支持下完成开发 ——这标志着苹果在华AI战略的重大转变,也将使其成为首家获北京批准、在中国推出自有专属AI模型的外国企业。 据路透社报道,三名知...

近期,Hugging Face发布了最新报告《开源模型现状:2026年夏季观察报告》。 报告中指出,2026年以来,中国实验室在前沿开放模型的参数规模上持续领先,美国的竞争重心则逐渐从Meta、谷歌等模型实验室转向英伟达、AMD等芯片和基础设施公司。 更值得注意的是,中国模型正在...

7月27日晚,月之暗面宣布Kimi K3模型正式开源,同步发布模型文件及技术报告,并开源三项基础设施技术。开发者可通过Hugging Face社区下载模型进行本地部署和二次开发。 Kimi K3是一款混合专家架构大语言模型,总参数规模2.8万亿,采用896个路由专家,每个Toke...

7月29日,月之暗面完成超35亿美元F轮融资,投后估值350亿美元,因认购金额超出原定目标三倍有余,该轮提前关闭。原定8月启动的Pre‑IPO轮(G轮)已提前开始,投前估值喊至500亿美元。 从2025年底的43亿美元到眼下500亿美元的投前估值,这家成立仅三年多的AI创业公司,...

编者按:本文来自微信公众号 壹览商业,创业邦经授权转载。 今天是什么日子啊?MiniMaxH3、Seedance 2.5、DeepSeekV4-Flash都发布了! 先是MiniMax发布首款开源多模态生成模型H3,直接把视频生成、编辑和多模态理解装进同一个模型,再是字节跳动推出...

编者按:本文来自微信公众号凤凰网科技(ID:ifeng_tech),作者:Dale,编辑:董雨晴,创业邦经授权转载。 八月的一级市场,罕见的燃了一下。 据《财经》杂志报道,DeepSeek第二轮融资已重启,本轮计划募资500亿元,投前估值约5000亿元。另有参与交易的人士称,首轮...

文 | 字母榜 字节正在重新组织自己的AI数据团队。 据《智能涌现》报道,字节跳动近期成立AI数据与安全部门,与Seed、Flow、抖音等一级部门平行,负责为字节旗下大模型提供跨模态的数据服务。 此前负责字节AI数据体系建设的傅越(Yuyi)被曝将于近日离职,新部门的负责人王赢磊...

本文来自微信公众号: AIX财经 ,作者:AIX财经团队,编辑:魏佳,原文标题:《Grok 4.6上了牌桌,马斯克还差一部《奥德赛》》 Grok4.6,追平第一梯队。 AIX财经(AIXcaijing)原创 马斯克想让Grok在今年年底前拍完一部《奥德赛》。 这听起来像一个典型的...

文 | 新立场Pro 8月11日,成立四年的面壁智能开始为 IPO 以及一套新的计分方式做准备。 《36氪》8月12日报道,面壁智能已在北京证监局办理辅导备案。此前,面壁智能刚刚经历了一轮快速融资,其一季度连续完成两轮融资,累计融资超过10亿元;到7月,媒体披露其2026年上半年...

文 | AIX财经,作者 | 陈丹,编辑 | 魏佳 马斯克想让Grok在今年年底前拍完一部《奥德赛》。 这听起来像一个典型的马斯克式Flag:用AI挑战诺兰、好莱坞和2.5亿美元制作预算。但真正值得关注的,并不是Grok能不能在五个月里生成几千个镜头,而是它是否已经拥有把一项复杂...

ITCOW牛新网 8月13日消息,微信团队在海外社交平台 X 上首度披露自研大语言模型 WeLM 的规格与落地进展,这套以“资源效率优先”为设计原点的系列模型,正把微信生态里的对话、搜索与小程序调度收进同一套推理内核。 已亮相的两个档位里,WeLM-80B 走 800 亿总参、3...

ITCOW牛新网 8月13日消息,阿里 Qwen 团队昨夜通过魔搭 ModelScope 社区放出 Qwen3.8-2.4T-A95B 的开放权重,这是 Qwen-Max 量级模型第一次把完整权重交到开源侧,总参 2.4T、单 token 激活 95B,原生上下文 262144 ...

本文来自微信公众号: 硅谷101 ,作者:硅谷101 8月13日凌晨,DeepSeek V4 Pro正式登场,给开源模型生态又添一把猛火。从Kimi K3到MiniMax H3,再到DeepSeek V4 flash、DeepSeek V4 Pro,在中国开源模型的猛攻之下,美国...
腾讯内部大模型布局再现关键调整。据《智能涌现》报道,原腾讯混元资深研究员徐灿已正式转岗至微信事业群(WXG),加入WeLM大模型团队,重点参与后训练与Agent研发。徐灿是微软亚洲研究院背景的AI专家,曾以第一作者身份创建WizardLM项目并提出Evol-Instruct方法,...
近年来在激烈的中国市场中面临销量承压与份额挑战的苹果,正在悄然调整其在华的人工智能布局策略。知情人士透露,苹果已经专门针对中国市场训练了一款专属的大语言模型,而这一突破性进展背后,是苹果与阿里巴巴展开的深度合作,依托后者的技术支持完成了核心模型的训练工作。 在此之前,外界普遍预计...