
10万引普林斯顿刘壮最新访谈:架构没那么重要,数据才是王道
听雨 发自 凹非寺 量子位 | 公众号 QbitAI 引用量超过10万次,清华姚班校友,ConvNeXt、ImageBind、《无归一化的Transformer》……这些论文的作者—— 普林斯顿大学 助理教授 刘壮 ,在学术圈是一个颇为特殊的存在——他的每一篇论文几乎都在质疑某个...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,263
正文图片
13,217

听雨 发自 凹非寺 量子位 | 公众号 QbitAI 引用量超过10万次,清华姚班校友,ConvNeXt、ImageBind、《无归一化的Transformer》……这些论文的作者—— 普林斯顿大学 助理教授 刘壮 ,在学术圈是一个颇为特殊的存在——他的每一篇论文几乎都在质疑某个...

henry 发自 凹非寺 量子位 | 公众号 QbitAI 这两天打开朋友圈,10条里有7条都是GPT-Image-2生的图。 中文海报、复古杂志封面、直播画面、社交截图、连高考试卷都能照着出一张几乎以假乱真的。 对此,大家伙的反应也都出奇的一致—— 专业设计师们完了,我又能行了...

5月14日,针对网传“AI一号位即将离职”并影射腾讯一事,腾讯官方发布严正声明表示,此谣言纯属子虚乌有。腾讯严正辟谣,并保留对相关恶意造谣者追究法律责任的权利。 前OpenAI核心研究员姚顺雨2025年12月加入腾讯,出任CEO/总裁办公室 首席AI科学家 ,同时兼任 AI In...

文 | 字母AI 昨天凌晨,OpenAI发布了三款音频模型:GPT-Realtime-2、GPT-Realtime-Translate和GPT-Realtime-Whisper。 OpenAI官网的表述是,新模型可以让开发者构建能在用户说话时"推理、翻译和转写"的实时语音产品。三...
【TechWeb】5月7日消息, 2026年5月7日凌晨,马斯克投下了一枚重磅炸弹:他于2023年一手创立的大模型企业xAI将被正式解散。 未来,xAI及其旗舰大语言模型Grok将不再作为独立实体运营,而是整体并入SpaceX,成为这家太空巨头旗下的一个子产品。从此,世间再无xA...

在人工智能前沿领域,中国AI实现突破。 11月8日, 阿里巴巴达摩院公布多模态大模型M6最新进展,其参数已从万亿跃迁至10万亿,规模远超谷歌、微软此前发布的万亿级模型,成为全球最大的AI预训练模型。 同时,M6做到了业内极致的低碳高效,使用512 GPU在10天内即训练出具有可用...

感谢IT之家网友 Alita的迷弟 的线索投递! IT之家 5 月 9 日消息,阶跃星辰昨晚发布了新一代实时语音大模型 StepAudio 2.5 Realtime,目前已全量上线,开发者可通过阶跃星辰开放平台接入使用。 该模型定位于打造更具“活人感”的 AI 对话体验,重点围绕...

本文来自微信公众号: 硅谷101 ,编辑:主持|陈茜,作者:硅谷101 在硅谷,有了一种新的炫富方式——每天烧了多少token。 对于这个炫富方式,现在有一个新词叫:Token-maxxing,意思是“把token用量拉到极限”。它变成了公司内外人们攀比的新方式:你每天消耗多少t...

凤凰网科技讯(作者/于雷)5月14日,针对网传“AI一号位即将离职”并影射腾讯一事,腾讯官方发布严正声明表示,此谣言纯属子虚乌有。腾讯严正辟谣,并保留对相关恶意造谣者追究法律责任的权利。 前OpenAI核心研究员姚顺雨2025年12月加入腾讯,出任CEO/总裁办公室 首席AI科学...

品玩4月29日讯,据科创板日报报道,深圳忆纪元科技有限公司(MemoraX AI)宣布完成千万美元种子轮融资,由L2F光源创业者基金、钟鼎资本联合领投。公司由前华为技术大牛、天津大学教授郝建业创立,聚焦于解决大模型“失忆症”痛点。 MemoraX AI 摒弃传统的“外挂检索”模式...

在人工智能竞争白热化的当下,国产大模型再次交出了一份惊艳的答卷。5月9日,百度正式推出了新一代基础大模型——文心大模型5.1。目前,该模型已全面上线百度千帆模型广场及文心一言官网,正式面向企业级用户与开发者开放体验。 本次更新的核心亮点在于其极高的“性价比”与强大的搜索整合能力。...
小米MiMo在全球最大AI模型API聚合平台OpenRouter登顶全球调用量榜首,成为首个在全球调用量维度夺冠的国产大模型。最近一个月,MiMo累计贡献1. 45 万亿Token调用量,在 300 多个模型的激烈竞争中脱颖而出。 MiMo采用端云协同架构设计,主打推理效率高、成...

每经记者|兰素英 每经编辑|王嘉琦 等了15个月,今天(4月24日),DeepSeek-V4(预览版本)终于发布了,而且是在OpenAI发布GPT-5.5几个小时后。 在约1000字的DeepSeek-V4产品介绍文章中, Agent(智能体)一词出现了多达11次。 DeepSe...
本文来自微信公众号: 每日天使 ,作者:每日天使 2024年的AI竞赛,主旋律是"更大":更大的模型、更长的上下文、更海量的数据。但有一群研究者正在从另一个方向突围——不是把模型做大,而是让模型学会"思考"。 Y Combinator合伙人Ankit Gupta与访问合伙人Fra...

感谢IT之家网友 JosephCooper、Saito、小星_14、Alita的迷弟 的线索投递! IT之家 5 月 9 日消息,百度发布了新一代基础大模型 —— 文心大模型 5.1。目前文心 5.1 已在百度千帆模型广场、文心一言官网同步上线,面向企业用户和开发者开放体验。 据...

北京时间5月13日,Apple Silicon 本地 AI 生态迎来重要进展。oMLX 框架0.3.9.dev2版本发布,深度集成多项前沿优化技术,显著提升了本地大模型的图文处理速度与易用性,进一步巩固了苹果端侧 AI 在实际体验上的竞争力。 核心技术升级:Gemma4视觉路径全...

品玩4月29日讯,亚马逊云科技官方近日宣布,大幅扩展与OpenAI的合作伙伴关系,即日起通过Amazon Bedrock提供最新的OpenAI模型、编程助手Codex以及由OpenAI支持的托管智能体服务(均为有限预览版)。此举标志着AWS客户将首次能够在其信赖的云基础设施中,直...

品玩4月29日讯,科大讯飞正式发布星火X2-Flash模型,并同步开放API调用。该模型采用MoE架构,总参数30B,最大支持256K上下文。其在智能体、代码等能力上大幅提升,实测效果接近万亿级参数模型,Tokens消耗成本降至主流大尺寸模型的三分之一。 实测显示,在深度研究报告...