
中国大模型简史01:模型越做越大,却没人知道它该变成什么
该图片使用了AI生成技术 本文来自微信公众号: AI资本观 ,作者:邵神 2026年夏末,AI早已无处不在。 站在今天回头看,很多事情已经显得顺理成章。大模型当然要越做越大,公司当然要抢算力、做产品、争用户;模型越来越便宜以后,当然会有人做开放生态、做Agent,再把AI带进真正...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,488
正文图片
14,123

该图片使用了AI生成技术 本文来自微信公众号: AI资本观 ,作者:邵神 2026年夏末,AI早已无处不在。 站在今天回头看,很多事情已经显得顺理成章。大模型当然要越做越大,公司当然要抢算力、做产品、争用户;模型越来越便宜以后,当然会有人做开放生态、做Agent,再把AI带进真正...

快科技9月2日消息,全球AI竞争中,美国与中国是实力最雄厚的两家,欧盟一直不甘心被中美甩开,但此前并没有拿得出手的大模型,直到Quasar 438B出现。 欧洲之前出名的大模型公司是法国Mistral公司,不过这次的Quasar 438B是西班牙公司Multiverse推出的, ...
韩国正将人工智能上升为国家战略,押注规模之大令市场侧目。但在这场举国竞赛中,谁将真正受益,答案远比表面复杂。 韩国政府今年7月宣布,计划投资9190亿美元、到2029年建成8.4吉瓦数据中心算力,最终在2035年将总规模扩张至18.4吉瓦。 这一计划将为英伟达打开庞大的主权AI市...

不管哪个时代,人都会遇到同一道题:无论宏大叙事还是人生决策,面前问题太复杂,资源和时间却不够,必须决定先做哪个、放弃哪个。(雷峰网(公众号:雷峰网)) 从 1812 年黑格尔的辩证法,到马克思、列宁,再到 1915 年毛泽东在延安写下的《矛盾论》,一百多年里,这套思想最终落到了一...

Max长程Agent能力的背后,是精雕细琢的典范,还是算力黑洞的失控? 作者丨李娜 编辑丨岑峰 我让Qwen 3.8-Max从零搭建了一个3D大模型演进宇宙网站,又和GPT-5.6做了迭代对比。 (Qwen3.8-Max运行成果截图) 效果上限方面,Qwen 3.8-Max 展现...
国产大模型商业化落地正在开辟全新的大众消费场景。国产大模型头部厂商智谱近日宣布正式入驻天猫平台,开设官方旗舰店。即日起,普通消费者可以直接在淘宝App内搜索相关店铺并在线下单购买大模型订阅服务,标志着大模型商业订阅正式从传统的官网直销模式延伸至主流电商生态。 此次在天猫旗舰店上架...

图片来源:unsplash 2026年年中以来,越来越多独立模型厂商传出将下场"亲手"打造AI芯片。 6月末,起步最早的OpenAI已经拿出了首款自研AI推理芯片Jalapeño,这款芯片从架构设计到流片仅耗时9个月,创下了专用集成电路(ASIC)领域最短开发周期纪...

在一家航空企业的现场,工程师们接到一个任务:分析某架飞机的飞行姿态,锁定重点工况。提需求的人觉得这事不难,把各类数据按时间轴对齐就行,业内叫"时标对齐"。在数据库工程师的教科书里,这甚至算不上一道难题:按时间列做个连接,完事。 但真到了现场,事情立刻变了味道。需要对齐的不只是气压...

图片来源@unsplash 本体(Ontology),让大模型在制造业的落地告别了黑箱操作,这在ChatGPT刚出现的头一两年还不敢想象。 在今年创新奇智的制造业案例演示现场,一则聚焦玻璃纤维行业拉丝开机率异常根因分析的场景引起了我们的注意。简单来讲,玻璃纤维生产是将配置好的原料...
本文来自微信公众号: 硅基观察Pro ,作者:硅基君,原文标题:《从40亿到130亿美元!中国大模型这波增长,可能和你想得不一样》 过去半年,国内大模型商业化开始突然爆发。 2025年12月,中国主要AI模型公司的年化收入还只有40亿美元,而如今已经接近130亿美元。尤其6月以后...

Meta Platforms近日正式发布了迄今为止最强大的AI模型Muse Spark1.3,该模型专注于延长智能体工作流与增强编码能力。Meta首席AI官Alexandr Wang表示,该模型在核心编程能力上已经超越了OpenAI的GPT-5.6Sol,并与Anthropic的...

家人们,听说了么? OpenAI下一代Astra采用了一种「循环深度」(recurrent depth)全新推理方法。 思考Token大幅减少,性能反而直线拉爆! 怪不得灰测的Astra实力那么强,原来OpenAI手握了一张真正的技术王牌。 但是代价是,Astra的思考过程完全「...

广发证券认为AI投研的核心在于能否最大化还原真实投研生产链路,策略团队系统性阐述了AI投研系统的构建逻辑与进阶优化路径,为业内提供了一套从底层原理到工程实践的完整框架。 8月28日,广发证券刘晨明团队发表报告,指出 主观研究员和基金经理的核心工作流是捕捉信息差、形成认知差,并最终...

8月26日晚间,智谱正式上线并开源轻量旗舰多模态模型GLM-5.3-Flash。这款模型正是此前一周在海外开发者社区引发热议的匿名模型Ox Alpha,中文社区将其戏称为“牛来”。 这场“身份猜谜”始于8月20日。当晚,Ox Alpha以“隐身模型”身份悄然登陆全球头部AI模型聚...

图片不只被编码,还直接参与 Attention、MoE 与 Agent 推理。 作者丨郑佳美 编辑丨岑 峰 这不是一个全新的模型突然出现。早在 8 月 21 日,DeepSeek 就已经把它接入 API,当时外界只能看到结果:V4 开始能处理图片,而且在 ApexBench、Ag...

本期速览: 1. 腾讯WorkBuddy开放平台上线; 2. 传钉钉创始人无招将加入蚂蚁集团; 3. 前搜狗市场负责人董璐加盟百川智能; 4. 豆包腾讯千问,AI办公月活1.02亿; 5. 腾讯发布混元Hy4 preview轻量版; 6. Manus正式恢复独立运营。 1.腾讯W...

头图来源:视觉中国 两家中国大模型公司,在五天里先后交出了上市后的首份中报。 MiniMax 先出:上半年收入 1.17 亿美元,同比增长 283%;8 月 ARR 超过 8 亿美元。智谱随后公布:上半年收入 9.54 亿元人民币,同比增长近 400%;8 月 ARR 达到 16...

近期DeepSeek多位核心研发人员相继离职,去向陆续明确。据科技博主“申妈的朋友圈”透露,原DeepSeek研究员魏浩然已转任百度文心大模型多模态算法负责人,其带领的团队转入百度基础模型研发部。 魏浩然今年初加入百度,在百度期间主导Unlimited OCR模型的研发工作,该模...

©有界UnKnown原创 作者丨山茶 编辑|钱江 9月1日,李飞飞创办的World Labs发布了下一代世界模型Atlas。 在大多数媒体的报道中,Atlas被定义为一个颠覆之作,比如称其为全球首个多模态世界模型,认为它让世界模型进入新时代、打开了通往“空间智能”大门等等。 当然...

状态校验、权限路由、异步调度,撑起一套可持续执行的运行时。 作者丨郑佳美 编辑丨岑 峰 刚刚,Anthropic 更新了 Claude 5.1,一口气推出 Fable 5.1 和 Mythos 5.1。 这两个名字看起来像两档模型,实际上底层用的是同一套模型。区别在于 Anthr...