
超越 TurboQuant! OSCAR:面向真实 Serving 的 2bit KV Cache量化
作者 | Zhongzhu Zhou, Donglin Zhuang, Jisen Li, Ziyan Chen, Shuaiwen Leon Song, Ben Athiwaratkun, Xiaoxia Wu 从 KV Cache 瓶颈说起 长上下文模型的能力还在往前走,但在...
学术研究 方向最近有哪些内容值得看
学术研究 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
学术研究资讯
1,670
正文图片
8,339

作者 | Zhongzhu Zhou, Donglin Zhuang, Jisen Li, Ziyan Chen, Shuaiwen Leon Song, Ben Athiwaratkun, Xiaoxia Wu 从 KV Cache 瓶颈说起 长上下文模型的能力还在往前走,但在...

本文来自微信公众号: AI前线 ,作者:四月,原文标题:《半数华人、3位亿万富翁:这张十年前的量化实习生合照,藏着 AI 时代的新贵版图》 AI圈里最炙手可热的新贵们,可能一大半都出自量化交易。 这话并不夸张。 故事要从2015年冬天说起。HRT的纽约会议室里,一群年轻人围在桌前...

在现代工业与大型基础设施的“躯体”中,光纤传感器早已成为不可或缺的“神经系统”。无数光子在玻璃纤维中以每秒近 20 万公里的速度穿梭,传递着极其细微的物理变化。然而,但当它抵达终点、被光电探测器转化为电信号之后,一切都慢下来了:数据排队等候处理器,处理器消耗电力,延迟可达微秒量级...

距离"千衍"超大规模宇宙学模拟项目完成已过去一个月,但关于它的讨论仍在发酵。 核心观点围绕一个技术命题展开:在高性能计算与AI领域,存储正从配角变为决定系统性能的瓶颈与关键支点。 此前,"千衍"项目已于今年4月正式发布,简单一点来说,是科学家们一个用超级计算机模拟宇宙演化的科研项...

该图片疑似使用了AI生成技术,请谨慎甄别 距离“千衍”超大规模宇宙学模拟项目完成已过去一个月,但关于它的讨论仍在发酵。 核心观点围绕一个技术命题展开:在高性能计算与AI领域,存储正从配角变为决定系统性能的瓶颈与关键支点。 此前,“千衍”项目已于今年4月正式发布,简单一点来说,是科...

1966 年,美国上映了一部名为《神奇旅程》的科幻电影,影片中被缩小成微米级别的五名医生被注射到患者体内进行血管手术。时至今日,电影中的虚构桥段正在走进现实世界,只不过在体内治疗疾病的是“微型机器人”。 “微型机器人”其实是一个统称,其涵盖了尺寸从 1 微米(约为人类头发丝直径的...
这项由韩国科学技术院(KAIST AI)与Naver AI Lab联合完成的研究,于2026年5月以预印本形式发布,论文编号为arXiv:2605.22718。感兴趣的读者可通过该编号在arXiv平台检索完整论文。 你有没有玩过这样一款游戏——你在一个房间里探索了一番,然后走开去...
这项由威斯康星大学麦迪逊分校与Elorian AI联合完成的研究,以预印本形式于2026年5月16日发布在arXiv平台,论文编号为arXiv:2605.17110v1。感兴趣的读者可通过该编号在arXiv上查阅完整原文。 假设你面前摆着一排厨师,每位都宣称自己擅长不同菜系。你想...

闻乐 发自 凹非寺 量子位 | 公众号 QbitAI AI进军数学界的速度太快了。 OpenAI前脚刚用内部模型突破埃尔德什的80年单位距离问题,谷歌DeepMind后脚就解决一个同样卡了人类 56年 的埃尔德什数学难题—— 最新发布 AlphaProof Nexus ,一套由G...

纵观当前强化学习领域的发展,无论是提升长链路推理中的信用分配能力,增强模型在复杂环境中的自主探索,还是构建具备长期规划与反馈学习能力的智能体系统,其核心目标都指向同一个方向——突破稀疏奖励与静态监督的限制,赋予模型通过交互持续学习与自我进化的能力。 强化学习本质上是一种让智能体通...

梦晨 发自 凹非寺 量子位 | 公众号 QbitAI 数学论文预印本里,悄悄混进了8篇AI作品。 更准确地说,是8篇由同一个系统生成或形式化证明的数学论文。 初创公司Axiom Math宣布,他们从2026年2月开始提交的8篇论文,到5月28日有5篇已经通过同行评审,登上学术期刊...

上海创智学院 LeapQuest 团队 投稿 量子位 | 公众号 QbitAI 医学AI会写解释,但不代表它真的“看到”了关键证据。 过去的医学多模态模型,大多是把一张影像或一段视频编码成视觉特征,然后让大模型生成答案与解释。 但问题在于——一个微小病灶、一个边界变化、一段几秒钟...

5月28日,英伟达(NVIDIA)研究团队正式开源了名为 Polar 的强化学习训练框架。该框架的核心创新在于,它能够让 Codex、Claude Code、Qwen Code 等现有主流代码智能体(Agent)在 不修改任何原生代码 的情况下,无缝接入 GRPO(广义相对策略优...
这项由Stability AI研究团队开发的技术成果以预印本形式发布于2026年5月,论文编号为arXiv:2605.21226,感兴趣的读者可通过该编号检索完整技术文献。 每当你和AI聊天、看AI生成的视频或者听AI创作的音乐时,AI的大脑深处都在飞速运转一套叫做"注意力机制"...

给一辆 100 kWh 的电动汽车在 12 分钟内充满电,需要至少 500 kW 的功率;在主流 1,000 V 以下的车载电压平台上,这意味着充电电流将超过 500 A。如此高的电流流过插头时,焦耳热会集中在接触界面上,这是当前快充技术绕不开的安全瓶颈之一。 从手机 SoC 上...

《2025开放数据现状报告》回顾了十年来研究人员的调研反馈,考察围绕开放数据的态度、行为和政策有何变化。本文从个人经历着手,深入探讨数据共享的影响力。当数据共享的障碍被克服之后会发生什么?共享数据又如何超越研究本身产生影响力? 通过开放和共享数据,研究人员能够为自己的工作赢得更高...

多视角、事件视觉与相机轨迹,共同推动视觉模型走向更强空间推理。 作者丨郑佳美 编辑丨马晓宁 过去几年,计算机视觉行业一直在追求更强的识别、更大的模型和更复杂的生成能力,但真正落到机器人、工业检测、运动分析和空间交互等真实场景时,一个更底层的问题逐渐变得突出:视觉系统到底是在“看图...

IT之家 5 月 28 日消息,科技媒体 Ars Technica 昨日(5 月 27 日)发布博文,报道名为 FROST 的浏览器侧信道攻击, 不需要用户额外操作,网站就能推断用户正在访问哪些其他网站。 IT之家注:FROST 不需要用户额外操作,只要打开承载攻击代码的网站,页...
5 月 27 日,杭州全息智能技术研究院(以下简称“研究院”)产学研融合发布会在大运河数智城智慧网谷小镇举行。现场正式揭牌了首批与六家行业领先企业共建的联合实验室,标志着研究院从“科研成果转化”向“产业协同创新”迈出了系统性的一步。 一、六大实验室:覆盖核心 AI 赛道 此次亮相...