
百度开源无限OCR,跑通长程解析,核心作者YY疑是来自DeepSeek
编辑|张倩、陈陈 DeepSeek OCR 留下的一个问题,好像被人接上了。 昨天,我们在 HuggingFace 上刷到一个新开源模型,直接被惊艳到了。 它叫 Unlimited OCR,百度出的 最吸引眼球的地方是,在标准最大上下文长度 32K 的条件下,它让 OCR 模型第...
混元 最近有哪些新动态值得跟进
混元 相关的新功能、版本变化、合作消息和行业讨论,这里会持续汇总。
想快速知道 混元 最近在更新什么、谁在用、市场怎么聊,先看这一页。
混元资讯
121
正文图片
338

编辑|张倩、陈陈 DeepSeek OCR 留下的一个问题,好像被人接上了。 昨天,我们在 HuggingFace 上刷到一个新开源模型,直接被惊艳到了。 它叫 Unlimited OCR,百度出的 最吸引眼球的地方是,在标准最大上下文长度 32K 的条件下,它让 OCR 模型第...

我们最近在重新思考一件事:到底什么样的 Benchmark,才值得今天继续做? 过去几年,大模型的发展几乎一直被 Benchmark 牵引。GLUE/SuperGLUE 推动了 NLP 预训练,MMLU 让“通用知识能力”变成可比较的分数,HumanEval 把代码生成推向主流,...

腾讯混元投稿 智猩猩AI整理 生成式奖励模型(GRM)依托思维链(CoT)提升大模型评估能力,但现有方案存在两大痛点: (1)效率低下:对所有输入强制执行完整CoT推理,简单问题也消耗大量算力; (2)评估不准:依靠多数投票筛选推理结果,无法区分 “逻辑严谨的正确答案” 与 “瞎...

6月11日,腾讯混元AI Infra团队宣布HPC-Ops推理核心算子库完成全面升级,新增五个关键算子,从单点高性能算子扩展为覆盖推理全链路的优化能力集合。 HPC-Ops是腾讯混元团队开源并长期维护的大模型推理底层算子库。首轮开源的算子包括Attention和GroupGEMM...

最近打开腾讯元宝,选择混元模型,有一个感受挺明显:它变得更好用了。不是说突然就“遥遥领先”了,而是从日常使用体验看,它回答问题的稳定性、搜索资料的可用性,以及对复杂问题的拆解能力,确实比之前更像一个成熟AI助手了。 尤其是对普通用户来说,这种感受可能会更明显,比如让它查资料、整理...

事情是这样的,这不这两天正赶上2026年高考嘛,而且Anthropic的Mythos级大模型也在昨天公布,于是我就想着,我能不能让如今几个比较有话题的大模型,来试着写一下今年的高考作文呢? 我在国外和国内大模型中各挑选了两个,分别是GPT-5.5、Fable-5、DeepSeek...

文 | 字母AI 事情是这样的,这不这两天正赶上2026年高考嘛,而且Anthropic的Mythos级大模型也在昨天公布,于是我就想着,我能不能让如今几个比较有话题的大模型,来试着写一下今年的高考作文呢? 我在国外和国内大模型中各挑选了两个,分别是GPT-5.5、Fable-5...

最近打开腾讯元宝,选择混元模型,有一个感受挺明显:它变得更好用了。不是说突然就“遥遥领先”了,而是从日常使用体验看,它回答问题的稳定性、搜索资料的可用性,以及对复杂问题的拆解能力,确实比之前更像一个成熟AI助手了。 尤其是对普通用户来说,这种感受可能会更明显,比如让它查资料、整理...

一、 背景与成果介绍 HPC-Ops 是腾讯混元 AI Infra 团队开源并长期维护的一套工业级、高性能的大模型推理底层算子库。在首轮开源中,HPC-Ops 提供了 Attention、GroupGEMM 等在内多个高性能算子,原生支持 BF16 与多种 FP8 量化方案,针对...
人工智能在音频生成领域已取得显著进展,但“编辑”现有音频的能力仍面临巨大挑战。近日,腾讯混元(Tencent Hy)联合上海交通大学(SJTU)、新加坡南洋理工大学(NTU)、天津大学(TJU)、北京大学(PKU)、复旦大学(FDU)等多家顶尖科研机构,共同推出了 MMAE(Ma...
感谢IT之家网友 江山已旧、Domado 的线索投递! IT之家 6 月 5 日消息,腾讯混元今日宣布提出 Stem 稀疏注意力算法,已被机器学习顶会 ICML-26 收录。 官方表示,Stem 稀疏注意力算法从“因果信息流”重新审视块级稀疏,用 Token 位置衰减(TPD)和...
6月5日,腾讯混元宣布提出Stem稀疏注意力算法,已被机器学习顶会ICML-26收录。根据Stem算法×HPC算子的全栈加速方案,算法层面,Stem通过Token位置衰减(TPD)和输出感知度量(OAM)实现25%预算下的近无损精度;算子层面,HPC开源的Stem+BSA算子将稀...

引言 当你把一篇数万字的长文档丢给大语言模型,点击发送后,是否经历过漫长的等待?光标闪烁,模型却迟迟不吐出第一个字 —— 这段 "等待第一个字" 的过程,就是所谓的 预填充(Prefill)阶段。 它背后的瓶颈,是 Transformer 自注意力的二次方计算复杂度:输入越长,预...
6月5日,腾讯混元宣布提出Stem稀疏注意力算法,已被机器学习顶会ICML-26收录。根据Stem算法×HPC算子的全栈加速方案,算法层面,Stem通过Token位置衰减(TPD)和输出感知度量(OAM)实现25%预算下的近无损精度;算子层面,HPC开源的Stem+BSA算子将稀...

“目前80%的元宝用户开始使用混元大模型。” 腾讯集团高级执行副总裁汤道生。 6月5日,腾讯集团高级执行副总裁汤道生在接受澎湃新闻等媒体采访时表示,目前算力上不太充足,有限的资源会倾斜给内部需求,远远不足以满足客户需求,今年Tokens调用有爆发式增长,非常期待下半年有更多国产算...

6月3日,腾讯云宣布将逐步对旧版本模型进行切换升级调整。根据调整规划,腾讯云智能体开发平台HY 2.0、hunyuan-turbos、hunyuan-t1等9个旧版本模型,将于北京时间2026年6月26日00:00起不再支持调用,届时不再提供上述模型的接入服务。

品玩5月29日讯,腾讯混元团队正式发布专为OpenClaw设计的长期记忆插件Hy-Memory,旨在解决AI代理在长期使用中“记不住、理不清”的核心痛点。该插件通过六层记忆框架与双系统协同机制,让AI真正具备了类似人类“第二大脑”的认知能力。 Hy-Memory创新性地将记忆划分...