
终极测试成绩创新高,谷歌Gemini 3深度思考模型重大升级,瞄准科研与工程应用
谷歌的深度思考模型Gemini 3 Deep Think迎来重大升级,将其专业推理能力从抽象理论推进至实际应用场景。这一升级聚焦于解决现代科学研究与工程领域的复杂挑战,标志着谷歌在企业级AI市场的战略性押注。 美东时间12日周四,谷歌官宣Gemini 3 Deep Think升级...
学术研究 方向最近有哪些内容值得看
学术研究 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
学术研究资讯
1,552
正文图片
7,630

谷歌的深度思考模型Gemini 3 Deep Think迎来重大升级,将其专业推理能力从抽象理论推进至实际应用场景。这一升级聚焦于解决现代科学研究与工程领域的复杂挑战,标志着谷歌在企业级AI市场的战略性押注。 美东时间12日周四,谷歌官宣Gemini 3 Deep Think升级...

DeepSeek做了件罕见的事情:在终于开始灰测多模态能力后,它放出了一篇解释背后技术的论文,但这篇论文却在发布没多久就又被悄悄撤掉。 4月29日,DeepSeek研究员陈小康在X发布一条推文——现在,我们可以看见你了。配图中,DeepSeek 标志性的鲸鱼 logo 摘下眼罩,...

henry 发自 凹非寺 量子位 | 公众号 QbitAI 何恺明,也下场做语言模型了。 只不过,这次他带队做的不是大家熟悉的、像ChatGPT背后那套 “预测下一个词元”(next token prediction) 的自回归范式。 而是另一条过去几年在图像领域大火、如今正被越...

本文来自微信公众号:字母AI,作者:李熙,原文标题:《怎样防止AI勒索人类?答案是别给它喂坏科幻》,头图来自:AI生成 市场营销和其他基于叙事技术的行业一样,也要讲究叙事闭环。在AI崛起的当下,这种行业基础定律仍然成立。 之前字母AI写过《别告诉AI你出轨了,它很可能会勒索你》,...

市场营销和其他基于叙事技术的行业一样,也要讲究叙事闭环。在AI崛起的当下,这种行业基础定律仍然成立。 之前字母AI写过《别告诉AI你出轨了,它很可能会勒索你》,详述了2025年Anthropic论文《智能体不对齐:大语言模型如何成为内部威胁?》的来龙去脉。在测试的虚拟场景中,An...

2026年,大厂们不再比谁的GPU多,而是比谁的算法更聪明。 作者丨陈淑瑜 编辑丨岑 峰 一个在2026年越来越难以回避的问题是:如果H100全面断供、电费账单直线飙升、训练一次大模型的成本足以买下一家创业公司,大模型的故事还讲得下去吗? 也许顶级学术会议的论文能给大家一个新的启...

腾讯前沿科技论文解读专栏,在代码与商业的交汇处,寻找AI的确定性。 文|博阳 编辑|徐青阳 Anthropic 5月8 日发布了一篇对齐研究《Teaching Claude Why》,讨论的人不多。 我觉得它其实很有启发性。 过去大模型的对齐似乎非常低效。做了一通RLHF,模型依...

西风 发自 凹非寺 量子位 | 公众号 QbitAI AI版权大战,再度升级了。 手握《柳叶刀》《细胞》等顶刊,掌控全球海量核心科研成果的学术出版巨头 爱思唯尔(Elsevier) 正式入局,加入集体诉讼团硬刚Meta—— 控诉Meta非法爬取、复制受版权保护的科研论文,用于训练...

新智元报道 编辑:艾伦 【新智元导读】 微软用一套多 Agent 系统在 AI 漏洞发现的顶级基准测试上拿下第一,超过 Anthropic 最强模型 Mythos 五个百分点。诡异的是,微软自己并没有一个能打的前沿模型。它用别人的模型组了个系统,打败了造出这些模型的公司。这对AI...

现如今,扩散模型已经成为当前图像生成领域的核心技术之一。从文本生成图像到复杂视觉内容合成,这类模型已经能够生成高度逼真的画面。然而,在真实应用场景中,人们对生成模型的要求并不仅仅是“生成逼真图像”,而是希望模型能够严格按照提示完成特定任务。 例如,在要求生成包含指定文字的图像时,...

梦晨 发自 凹非寺 量子位 | 公众号 QbitAI 离职Meta后的田渊栋,现身独角兽联创名单,成了AI创业合伙人。 Recursive Superintelligence (RSI),不到30人,刚从隐身状态走出来,就拿到 6.5亿美元融资 (约44亿元人民币), 估值46....

如果几年前有人告诉我,AI 不仅能写代码、生成论文摘要,还能像一个真正的工程师那样,在实验室里反复寻找可行的策略、持续优化一个方案——我大概会觉得这个人科幻片看多了。 但最近读到一篇论文的时候,我的想法变了。 过去两年,大模型的能力突飞猛进,从写诗到写代码...

5月8日晚的《新闻联播》节目,播出了中共中央政治局常委、国务院副总理丁薛祥到访华为位于上海的华为练秋湖研发中心,与任正非在“芯片基础技术研究实验室”站立交流的画面。 丁薛祥肯定科技领军企业开展基础研究取得的成效。他指出,科技领军企业不仅要擅长“从1到100”的技术创新、成果转化,...
一、凌晨两点的训练Run,和一个没人问的问题 凌晨两点,北京某多模态大模型实验室。大屏上,一个正在进行的预训练Run跑到了第47小时。技术负责人盯着Loss曲线抖了一下,然后把椅子转回来说了一句:“我们缺的不是卡,是干净、对齐、能被复用的多模态语料。” 这不是个例。2026年4月...

听雨 发自 凹非寺 量子位 | 公众号 QbitAI 数学界「悬案簿」Kourovka Notebook,AI取得新突破。 群论领域几十年无解的 第21.10号 问题,被牛津数学家 Marc Lackenby 用谷歌一个新系统破解了。 过程也很有意思:AI第一次给出的证明是错的,...

Jay 闻乐 发自 凹非寺 量子位 | 公众号 QbitAI 如果AI的数学水平继续按目前速度发展,我们(数学研究者)很快会面临一场危机。 数学最高奖菲尔兹奖得主—— Timothy Gowers ,在最新体验到ChatGPT 5.5 Pro后,替学生们拉响了红色警报。 其对博士...

在2026年的今天,人工智能的演进正踩在一个微妙的节点上:一边是递归自我改进可能引爆的经济大爆发,另一边是“神经计算机”概念对传统软件底层的彻底颠覆。本期《Import AI》由Anthropic联合创始人Jack Clark执笔,串联起五条看似独立、实则相互咬合的前沿线索——政...

Jay 发自 凹非寺 量子位 | 公众号 QbitAI 中国AI研究员的性格、魅力和真诚……让人倍感亲切。 这是艾伦研究所(Ai2)的研究员 Nathan Lambert ,在最近结束中国之行后,发自内心的一番感慨。 在Nathan眼里, 国内的LLM圈子简直是天堂 ,大家彼此尊...

今年CVPR,着实有点魔幻了! 先是韩国首尔大学AI团队的Oral,即前4%的优秀论文,被曝出涉嫌抄袭10篇论文。有的地方,连一个单词都没有变。 事发当日即登上韩国头条,国内外网友震惊: 搞到CVPR上也太行了吧 。 更多人爆料,这个团队抄袭已经不止一次,基本操作了属于是。 结果...

朋友,你知道这个英文单词是什么吗? Pneumonoultramicroscopicsilicovolcanoconiosis. 这个世界公认最长——由45个字母组成的单词,意思是"因肺部沉积火山矽质微粒所引起的疾病"(俗称火山矽肺病)。 但如果说,现在不...