大模型 方向最近有哪些内容值得看
今日资讯 大模型
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,524
正文图片
14,356
华为实验室出手:让AI推理模型在“压缩记忆”下也能保持清醒
这项由华为中央软件院研究团队完成的研究,以预印本形式发布于2026年6月2日,论文编号为arXiv:2606.03458,感兴趣的读者可通过该编号查阅完整原文。 当你和一个健忘的朋友聊天,他每隔几分钟就会忘记你刚说的话,你们的对话会变得越来越混乱。越到后面,他说的话就越没法接上前...

早报|微信朋友圈搜索全面开放/Claude发布「Mythos级」模型/王传福:比亚迪5年后规模要做到全球第一
Anthropic 公开发布「Mythos 级」模型 Claude Fable 5 欧盟:Siri AI 不在欧洲上线是苹果自己的决定 OpenAI 已保密提交 IPO 草案文件 苹果详解第三代基础模型,端侧 200 亿参数模型采用稀疏激活 微信朋友圈搜索功能正式全面开放,朋友圈...

苹果把Siri交给了Gemini
文丨镜相工作室,作者 | 邱庭,编辑丨程述白 2011年10月4日,蒂姆·库克(Tim Cook)第一次以苹果CEO身份主持发布会——这也是Siri在苹果的第一次亮相。 十五年后,2026年6月9日,库克站在WWDC(苹果全球开发者大会)的舞...

库克的“谢幕演出”:苹果放下身段、借力谷歌补课AI,市值却一夜蒸发几千亿
本文来源:时代财经 作者:庞宇 图源:视觉中国 北京时间6月9日凌晨1点,蒂姆·库克(Tim Cook)穿着深色Polo衫,最后一次以CEO身份走上苹果全球开发者大会(WWDC 2026)的舞台,一如多年来的开场,率先欢迎全球开发者来到WWDC,感谢他们围绕苹果平台创造应用,并称...

AI界巨震!Anthropic发布第五代Claude:Fable5狂揽编程榜首,Mythos5跨界攻克科学绝密
AI巨头 Anthropic 今日正式推出了其引以为傲的第五代 Claude 系列两款全新模型:面向通用市场的 Claude Fable5 ,以及专注于特定专业领域的 Claude Mythos5 (现已结束预览阶段)。两款模型均基于同一基础模型构建,但在安全配置和应用场景上各有...

聆讯通过!“AI国家队”中科闻歌冲刺港股,通用决策大模型进入资本市场视野
在港股AI资产热度持续升温、“18C”(港交所《上市规则》第18C章,面向特专科技公司的上市制度)不断为科技企业打开上市通道的背景下,企业级AI赛道迎来新进展。中科闻歌于6月9日更新了聆讯后资料集,意味着公司已通过港交所聆讯,成为近期市场关注的又一家赴港冲刺上市的AI企业。与更多...

OpenAI科学家Noam Brown:AI的真正上限,可能根本没人测得起
机器之心编辑部 随着大语言模型逐步进入复杂推理、自动化研究和网络安全等高难度任务,传统的模型评测方式正在面临新的挑战。 长期以来,模型发布往往伴随着一张由多项基准测试构成的成绩表:数学、编程、科学问答、网络安全、知识推理等能力被压缩为若干分数,并据此与上一代模型进行横向比较。 O...

OneReason:当推荐系统学会思考
机器之心发布 推荐系统的过去十年,本质是把 "用户 - 物料" 的统计共现挖到极致 —— 从协同过滤、深度模型,到生成式 OneRec 系列,每一代都在让 "记忆" 更精细、参数更大、序列更长,也让 Scaling 这件事在工业级推荐系统上跑通,持续释放算力红利。 但走到 LLM...

小米大模型推理速度首次突破每秒1000个token
6月9日,小米MiMo团队与AI编译优化系统组TileRT联合推出MiMo-V2.5-Pro-UltraSpeed推理模式。 该模式在单台标准8卡通用GPU节点上,实现万亿参数混合专家MoE模型生成速度超过1000 tokens/s,峰值接近1200 tokens/s。 技术层面...

有关5款第三代模型,苹果管理层回应一切
从左到右依次为苹果高管阿马尔·苏布拉马尼亚、迈克·洛克威尔、塞巴斯蒂安·马里诺-梅斯以及克雷格·费德里吉,图片经由AI处理 文丨苏扬 编辑丨徐青阳 当地时间6月8日,苹果举办2026年WWDC,除了有关iOS的AI能力集成和独立的Siri两个热点之外,另一个关注点则是这些能力背后...
用AI的成本,比用员工更贵?
越来越多企业高管发现,大规模部署AI的实际成本远高于最初预期,用AI取代员工未必比雇佣员工更便宜。 AI的应用前景也面临严峻挑战。 技术层面,围绕算力、硬件、模型运行与基础设施的整体系统性投入不断攀升,使用AI越来越昂贵;商业层面,大量企业内部出现了关于AI工具“性价比”的讨论与...

云知声U2冲进第一梯队,大模型开始比拼“智能密度”|甲子光年
该图片疑似使用了AI生成技术,请谨慎甄别 智能密度×Token价值,才是下阶段AI的核心竞争力。 作者|麦子 编辑|栗子 AI热身赛已经结束。 过去三年,大模型行业奉行的逻辑简单粗暴,认为参数越大越好,推理链越长越聪明,算力投入越高越能打。千亿、万亿参数的军备竞赛,一度成为衡量一...

仅4B大小可端侧部署!卡帕西预言的「认知模型」被国产做出来了
鹭羽 发自 凹非寺 量子位 | 公众号 QbitAI 好家伙,卡帕西又说对了! 几个月前,这位OpenAI创始成员在访谈中抛出了一个判断: “推理模型要变天了!” 仅需10亿参数,就能构建起非常优秀的 「认知核心」 ——一个剥离了海量事实记忆、只保留思考算法的智能单元。 结果万万...
黄仁勋让出市场,DeepSeek买下昇腾
(本文作者为 AI唱反调,钛媒体经授权发布) 文 | AI唱反调 最近,河套深港科技创新合作区内的联合团队,依托昇腾910C国产AI算力集群,完成1.6万亿参数DeepSeek-V4-Pro全参数后训练。华为提供算力,训练执行方是高校和研究院。 国产算力已经具备了支撑世界级模型的...

苹果把Siri交给了Gemini
文丨邱庭 编辑丨程述白 2011年10月4日,蒂姆·库克(Tim Cook)第一次以苹果CEO身份主持发布会——这也是Siri在苹果的第一次亮相。 十五年后,2026年6月9日,库克站在WWDC(苹果全球开发者大会)的舞台中央,外界普遍认为这是他任内最后一届开发者大会。Siri又...

OneReason:当推荐系统学会思考
机器之心发布 推荐系统的过去十年,本质是把 "用户 - 物料" 的统计共现挖到极致 —— 从协同过滤、深度模型,到生成式 OneRec 系列,每一代都在让 "记忆" 更精细、参数更大、序列更长,也让 Scaling 这件事在工业级推荐系统上跑通,持续释放算力红利。 但走到 LLM...

美团京东滴滴携程集体“上船”!腾讯AI赶进度:云和微信,一个都不能少
不止一家企业官宣了与微信AI生态的合作。6月8日,微信宣布面向开发者提供微信AI生态能力,此后美团、滴滴、京东、途虎养车、携程等宣布与腾讯在AI Agent(智能体)领域达成合作,大概率这个名单还将不断拉长。加上腾讯云在6月5日发布效率智能体工具集等,腾讯AI近期动作频频。 过去...

国产通用大模型第一梯队,来新人了?
一张新面孔,就这样闯入了国产通用大模型第一梯队。 走的还不是行业主流的“堆参数”路径。 这事放今天,谁听了不想火速围观一下?? 我也不例外,而且我还顺便挖了一下这家公司这样做的原因(好奇.jpg)。 结果你猜怎么着?答案居然如此“直击灵魂”—— 再走传统老路,你我的Token钱包...

国产大模型第一梯队迎新势力:云知声发了个原生Agent大模型,再次捅破行业天花板
智东西 作者 | 王涵 编辑 | 漠影 ▲鼠标点击烟花 ▲多摆混沌系统模拟器 以上这些,都是用云知声最新发布的U2大模型做出来的。 智东西6月8日报道,今天, “港股AGI第一股” 云知声发布其最新 通用大语言模型U2 ,该模型是由云知声 自研 的、基于快慢思考融合的MoE(混合...