
大模型厂商,正忙着自备“干粮”
图片来源:unsplash 2026年年中以来,越来越多独立模型厂商传出将下场“亲手”打造AI芯片。 6月末,起步最早的OpenAI已经拿出了首款自研AI推理芯片Jalapeño,这款芯片从架构设计到流片仅耗时9个月,创下了专用集成电路(ASIC)领域最短开发周期纪录。 7月上旬...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,478
正文图片
14,073

图片来源:unsplash 2026年年中以来,越来越多独立模型厂商传出将下场“亲手”打造AI芯片。 6月末,起步最早的OpenAI已经拿出了首款自研AI推理芯片Jalapeño,这款芯片从架构设计到流片仅耗时9个月,创下了专用集成电路(ASIC)领域最短开发周期纪录。 7月上旬...

智猩猩AI整理 编辑:知知 9 月,迈特芯将亮相于智猩猩在上海举办的 2026 全球 AI 芯片峰会(GACS 2026),并介绍迈特芯大模型芯片(LPU)基于张量脉动 TPU 的实现技术路线图。 自 2023 年成立以来,迈特芯一直在行业引领低功耗(<10W)、高带宽(~600...

AIPress(AI普瑞斯) 9月3日消息,据申妈朋友圈消息,百度基础模型研发部(BMU)负责人孙天祥在内部宣布,从 北美某Frontier Lab引入大模型研究员武钦(花名) 。 消息称武钦将与团队一起提升文心大模型的预训练能力。 此外, 年初加入百度的原DeepSeek研究员...

Hi,我是洛小山,你学习 AI 的搭子。 这是小山学堂的课程,今天的主题是: AI 概念介绍。 我们经常会看到一些 AI 相关的概念:Token、上下文窗口、推理模型、深度思考、参数、微调、知识库等等。 这些概念都好眼熟,但或许挺难记。 不用担心,接下来,我会用最通俗易懂的话,来...

编辑|杜伟 生成答案正在成为 AI 的基础能力,而推演现实世界,才是下一阶段更难的命题。 真实决策不是一道静态问答。它发生在一个持续变化、多主体同时行动、信息不完备且充满不确定性的世界里。 比如一个新开源模型突然把成本打下来,头部模型公司会不会跟进降价,云厂商、开发者和应用公司又...

2026年8月20日至21日,集成电路设计创新会议暨应用展(ICDIA 2026)在南京扬子江国际会议中心盛大召开。本届会议以“AI赋能·智创芯未来”为主题,由集成电路设计创新联盟、原“核高基”国家科技重大专项总体专家组指导,汇聚了来自国内外集成电路产业链上下游的顶尖专家、领军企...

过去一个多月,机器人学习的风向正在发生一些微妙的变化。 7 月,英伟达 GEAR 实验室、斯坦福和 UT Austin 联合发布 RoboTTT,把机器人的上下文利用拉到更长时间尺度;同期,自变量联合北京理工大学、清华大学推出 HOST,展示机器人从一次人类演示中快速获得新技能;...

广发证券认为AI投研的核心在于能否最大化还原真实投研生产链路,策略团队系统性阐述了AI投研系统的构建逻辑与进阶优化路径,为业内提供了一套从底层原理到工程实践的完整框架。 8月28日,广发证券刘晨明团队发表报告,指出 主观研究员和基金经理的核心工作流是捕捉信息差、形成认知差,并最终...
【TechWeb】9月3日消息,据多家媒体援引知情人士透露,百度基础模型研发部(BMU)负责人孙天祥在内部宣布两项重要人事任命:从北美某Frontier Lab引入资深研究员武钦(花名),以强化文心大模型预训练能力建设;同时,原DeepSeek研究员魏浩然正式转岗至BMU,担任文...

编译 | 程茜 编辑 | 心缘 智东西9月2日消息,今日,据外媒The Information爆料,OpenAI即将推出的Astra模型采用了一种名为“ 循环深度(Recurrent Depth) ”的技术,这项技术可以 隐藏部分或全部的模型推理过程 。 知情人士称,这种方式的好...

导语: 一个较为诚实的表述是,中国大模型的第一梯队是Kimi K3与Qwen3.8-Max组成的双雄格局。前者赢在国际验证,后者赢在中文综合与生态。 陈凯/作者 砺石商业评论/出品 当前,中国大模型行业出现了一个奇观,几乎每一家头部公司,都声称自己的模型是“中国第一”甚至“全球前...
韩国正将人工智能上升为国家战略,押注规模之大令市场侧目。但在这场举国竞赛中,谁将真正受益,答案远比表面复杂。 韩国政府今年7月宣布,计划投资9190亿美元、到2029年建成8.4吉瓦数据中心算力,最终在2035年将总规模扩张至18.4吉瓦。 这一计划将为英伟达打开庞大的主权AI市...
IT之家 9 月 1 日消息,科大讯飞旗下词元星火今日宣布推出并开源星火 X2.5-4B 和星火 X2.5-1.7B 两款端侧通用大模型。 据介绍,两款模型原生支持最长 100 万 Token 上下文窗口,是目前端侧模型中唯一支持该量级上下文的产品。 两款模型采用混合注意力架构,...

编辑|山辉 OpenAI 最强新模型 Astra,可能明天就要来了! 这是 OpenAI 第一个达到「关键级」网络安全能力门槛的模型。 Astra 在纳入 2026 年 6 月至 8 月披露的 20 个 V8 高危漏洞的内部测试集上, 取得了 100% 的任意代码执行成功率,而 ...

其实是几个月之前的项目了。 这两天做了一波大更新,调整架构提高了稳定性,改善了消息丢失或重启导致的重复请求 API 计费的情况,正式发布一下。 Vibe Coding 开发,项目开源。 其中浏览器媒体嗅探来自 猫抓 ,音频处理使用了 Webffmpeg ,字幕处理参考了 Whis...
IT之家 9 月 1 日消息,由中国科学院大连化学物理研究所(以下简称“大连化物所”)联合科大讯飞股份有限公司(以下简称“科大讯飞”)、阿里云计算有限公司(以下简称“阿里云”)等共同研发的 智能化工大模型 3.0 Pro (以下简称“3.0 Pro”)于 8 月 31 日正式发布...

作者:田小幺 编辑:李宝珠 转载请联系本公众号获得授权,并标明来源 上海交通大学、新加坡国立大学、美团、香港中文大学、上海大学、牛津大学的联合研究团队构建了 URBANGROUND,一个以香港真实地理数据为基础的城市级交互环境,并从局部空间理解、目标导向导航和动态环境适应三个层面...

近期DeepSeek多位核心研发人员相继离职,去向陆续明确。据科技博主“申妈的朋友圈”透露,原DeepSeek研究员魏浩然已转任百度文心大模型多模态算法负责人,其带领的团队转入百度基础模型研发部。 魏浩然今年初加入百度,在百度期间主导Unlimited OCR模型的研发工作,该模...