
毛利率或达90%,中国第一台大模型印钞机启动了
字节在大模型上的第一场翻身仗 采访 | 邓咏仪 肖思佳 李小霞 文 | 张雨忻 邓咏仪 编辑 | 张雨忻 杨轩 2025年底,在一次模型团队的聚餐上,Seedance模型的负责人曾妍向leader提到,她还是想试试训一个更大尺寸的模型,至少达到200B (2000亿参数)。 曾妍...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,516
正文图片
14,308

字节在大模型上的第一场翻身仗 采访 | 邓咏仪 肖思佳 李小霞 文 | 张雨忻 邓咏仪 编辑 | 张雨忻 杨轩 2025年底,在一次模型团队的聚餐上,Seedance模型的负责人曾妍向leader提到,她还是想试试训一个更大尺寸的模型,至少达到200B (2000亿参数)。 曾妍...
文 | 洞见新研社,作者 | 辰纹 过去一年,"世界模型"(World Model)从一个学术黑话迅速膨胀成AI和机器人行业里的关键词,与此同时,VLA(Vision-Language-Action,视觉-语言-动作模型)作为具身智能的主流技术路线,也在这场讨论中被反复推上风口浪...

IT之家 7 月 7 日消息,据 CNBC 报道,随着中国人工智能模型不断缩小与美国头部竞品的性能差距,且使用成本显著更低,这类模型正逐渐获得美国企业的青睐。 DeepSeek、智谱 AI 等中国企业近期推出的多款模型,在许多业内人士看来,综合竞争力足以对标 Anthropic、...

这项由ZooClaw.ai研究团队完成的研究以预印本形式于2026年6月发表,论文编号为arXiv:2606.27708,有兴趣深入了解的读者可通过该编号查询完整论文。 每当你在网购平台上敲下"红色碎花连衣裙",背后负责把你的文字和成千上万件商品图片匹配起来的,是一套叫做"视觉-...

腾讯云开发今日传来重磅消息,微信AI小程序成长计划迎来新一轮的大幅度加码。为了让开发者的好创意不被算力限制,官方决定向全行业开发者免费叠加高达 10 亿的Token大模型额度。 与此同时,备受关注的AI生图免费额度也直接从原先的 1 万张狂飙至 10 万张。这意味着广大开发者在调...

编辑|冷猫 在人工智能这个以「季度」甚至「月度」为单位刷新认知的领域,谈论「十年」是一件十分奢侈的事。 技术发展得越来越快,永远有更新的亮点技术在抓住我们的眼球。也正因如此,当一项成果在提出十年之后被重新拿到聚光灯下,并被郑重授予一枚「WWW 2026 Test of Time ...
这项由意大利摩德纳-雷焦艾米利亚大学联合比萨大学及AMD Silo AI研究机构共同完成的研究,于2026年6月以预印本形式发布,论文编号为arXiv:2606.23885。感兴趣的读者可以通过该编号在arXiv平台上查阅完整论文。 一、AI的"视觉短路":它看见了,却没真正理解...

作者声明:该图片由AI生成 “GPU三十年的仗,TPU十年就想打完? 2026年,中国AI产业最焦虑的事情,可能不是模型能力不够——智谱5.2、DeepSeek V4、MiniMAX轮番上场,模型越来越强。 真正的焦虑是:算力快用不起了。 一个AI智能体处理一次用户请求,输入的上...

本文来自微信公众号: InfoQ ,作者:QCon,原文标题:《可复制的 AI Coding 全栈实战:比 OpenSpec 更轻量、更丝滑》 在大语言模型能力持续跃迁、AI编码工具从Copilot向Agent形态快速演进的当下,一个核心问题逐渐浮出水面:AI写代码很快,但在生产...

从 LLM Wiki 到第二大脑,AI 已经实现持续记忆与自进化。 作者丨樊天骄 编辑丨郑佳美 2026 年 4 月,AI 领域最具影响力的学者之一 Andrej Karpathy 提出了一种名为 LLM Wiki 的个人知识编译系统,用来重构他自己的研究知识管理方式。该帖子一经...

本文来自微信公众号: InfoQ ,编译:宇琪,作者:Tina,原文标题:《“如果你不能用300行代码写个Cursor,这行你就别待了!”Ralph Loop创造者、Claude Code核心技术设计者的暴论》 最近,Ralph Loop的创造者Geoffrey Huntley在...

新智元报道 【新智元导读】r/LocalLLaMA社区一张图刷屏AI圈:Fable 5级AI预计2年后可在笔记本上本地运行。 两年后,Fable 5 级 AI,可能就躺在你的笔记本里。 就在昨天,全球最大的本地大模型社区r/LocalLLaMA,一张图刷屏了整个AI圈—— 标题简...

► 文 观察者网心智观察所 三月底之前,如果你在OpenRouter上搜索一个叫Owl Alpha的模型,大概率不会有人告诉你它是谁做的。 它没有官网,没有发布会,甚至连一句正式的自我介绍都没有。它唯一的身份线索,是一份跑分表格里靠前的名字,以及开发者社区里悄悄流传的一句话:这玩...

在复杂的战场中加速度 Fast Reading ■ 商汤科技,这家曾在人工智能1.0时代依靠资本和技术狂奔的的明星公司,如今正在学习另一门更艰难的课程:如何活下来,并且赚到钱。 ■ 商汤视觉AI业务已经连续两年实现正向现金流,商汤内部将这一阶段称为CV2.0。如果说CV1.0时代...
这项由天津大学人工智能学院与上海人工智能实验室联合发起、香港中文大学参与合作的研究,发表于2026年第43届国际机器学习会议(ICML 2026),论文编号为arXiv:2606.30319,有兴趣深入了解的读者可以通过该编号查询完整论文。 **大脑里藏着一台翻译机** 每当你看...

雕塑家爱上自己刻出的石头,向爱神祈祷让她活过来。2000多年来,人类都希望自己造出来的东西可以变成人,只不过从过去的石头变成了现在的代码。图源: https://www.polytropolis.com/p/behaviourisms-revenge 导读: 教宗为 AI发出历史...

作者声明:该图片由AI生成 图片经由AI工具生成 文|王捷 编辑|博阳 在中国大连举行的夏季达沃斯期间,来自全球的人工智能(包括机器人)行业领袖齐聚一堂,讨论人工智能行业的当前发展,和接下来的重要趋势。其中,中国初代AI投资人,深圳数经院AI经济研究中心联席主任王捷提出,AI行业...

来源:第一财经 7月6日,据“腾讯混元”微信公众号,腾讯正式发布新一代大模型混元Hy3。 腾讯表示,Hy3基于preview版本进一步提升了后训练数据的质量和多样性,扩大了RL算力规模,在推理、智能体、长上下文等任务上显著进步,取得了比肩国内外更大尺寸旗舰模型(参数规模往往是Hy...