Token导航 LogoToken导航TokenDH.com

大模型 方向最近有哪些内容值得看

今日资讯 大模型

大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。

如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。

大模型资讯

3,285

正文图片

13,314

驾驭智能:当AI从“玩具”走向企业级“引擎”

驾驭智能:当AI从“玩具”走向企业级“引擎”

(作者为兆企供应链董事长徐琪;广西铝产品仓储交易中心商品交易首席专家雷震) 2026年,人工智能的落地逻辑正在经历一场静默却深刻的地震。如果说过去两年我们还在热衷于讨论如何调教大语言模型(LLM)以生成更优美的诗句或代码,那么今年,焦点已彻底转向——如何让这些拥有惊人智力但并非绝...

2026-05-16 15:57
AI融资现“马太效应”,少数大模型公司拿走近70%份额

AI融资现“马太效应”,少数大模型公司拿走近70%份额

5月12日,北京第四波科技智库联合中关村天成创新研究中心发布了《中国百家AI企业创始人画像报告》(以下简称“报告”)。报告选取了中国100家具有代表性AI 创业公司,从多维度分析了各家企业及其创始人。 报告指出,头部AI企业融资额远超中小体量企业,呈现出明显的“马太效应”。高融资...

2026-05-16 15:57
智元的唯一赌注

智元的唯一赌注

记者:陆彦君、王杰夫|制图:程星 编辑:王杰夫 Key Points 智元加速拆分为1+5+N,AI模型是核心,5家子公司独立运营并已引入外部资本; 智元的所有商业布局,最终都挂在同一个前提上:母公司的模型要足够好。这个前提有待验证; 4月发布的新模型GO-2研发重心从解决数据短...

2026-05-16 15:57
23k Star!谷歌开源移动端LLM部署工具,手机离线聊天、识图、转写全搞定

23k Star!谷歌开源移动端LLM部署工具,手机离线聊天、识图、转写全搞定

智猩猩AI整理 编辑:没方 过去,想体验大模型,几乎默认要连云端。 无论是聊天、识图、语音转文字,还是让模型根据提示完成任务,大多数应用背后都依赖远程服务器。用户输入的文本、图片、音频需要上传到云端,模型推理完成后再把结果返回手机。 这样做虽然模型能力强,但网络不好时体验会变差,...

暂无图片

加州大学戴维斯分校打造的AI“模型红娘”:从数十万个AI模型中为你找到最合适的那一个

这项由加州大学戴维斯分校联合亚利桑那州立大学、摩根士丹利共同完成的研究,以预印本形式于2026年5月8日发布,论文编号为arXiv:2605.07075,有兴趣深入了解的读者可以通过该编号查询完整论文。 每天都有新的AI模型诞生。HuggingFace这个全球最大的AI模型托管平...

2026-05-16 15:20
暂无图片

阿里巴巴Qwen团队揭秘:如何把一个800亿参数的AI大模型“瘦身”到原来的四分之一却几乎不掉智商?

这项由阿里巴巴Qwen团队与阿布扎比人工智能大学(MBZUAI)、阿卜杜拉国王科技大学(KAUST)联合完成的研究,于2026年5月发布在预印本平台arXiv上,论文编号为arXiv:2605.08738v1。有兴趣深入了解的读者可以通过该编号查询完整论文。 当我们谈到当今最强大...

大模型时代,传统AI教科书正在集体过时?

大模型时代,传统AI教科书正在集体过时?

人工智能相关教科书的演变,展现了该学科数十年的发展脉络。从尼尔森的机器学习先驱著作,到罗素与诺维格那本“不可承受之重”的百科全书式教材,AI教科书记录了不同思想派别的几起几落。然而,面对近年来大模型带来的变革,AI教科书目前仍缺乏第一性原理,这也导致学科内容在飞速发展中显得“飘忽...

2026-05-16 15:00
公司是否正式接入了DeepSeek大模型?久其软件回应

公司是否正式接入了DeepSeek大模型?久其软件回应

有投资者向 久其软件(002279.SZ) 提问,请问国内最强大模型DeepSeekV4即将在本月底发布,贵公司是否正式接入了DeepSeek大模型?有打算与之进行深度合作吗?而月底发布的久其女娲天工AI平台,进行了DeepSeek大模型的接入没有?有无打算基于它开发AI智能体?...

2026-05-16 14:50
阅海信息发布海洋时空智能大模型OceanAI

阅海信息发布海洋时空智能大模型OceanAI

2025年,《国务院关于深入实施“人工智能+”行动的意见》中,明确提出加快探索人工智能驱动的新型科研范式,推动技术研发、工程实现与产品落地一体化协同发展。与此同时,海洋强国战略加速推进,自然资源管理、海上风电、远洋航运、海洋牧场等产业对智能化海洋信息服务的需求正在爆发式增长。 然...

暂无图片

苹果公司研究团队重新定义AI看图说话:当机器不再只会“堆砌词汇”,而是真正学会“指点江山”

这项由苹果公司(Apple)研究团队完成的研究,以预印本形式于2026年5月发布在arXiv平台,论文编号为arXiv:2605.07394v1,研究方向归属计算机视觉领域(cs.CV)。有兴趣深入了解技术细节的读者,可以通过该编号直接检索完整论文。 **一段被忽视的"鸿沟"**...

2026-05-16 14:50
我国具身智能基础模型研究取得系列进展

我国具身智能基础模型研究取得系列进展

【环球网科技综合报道】5月14日消息,据中国科学院官方信息,具身智能作为人工智能向物理世界延伸的关键形态,对推动机器人实现自主理解与行动具有重要意义。当前,“视觉—语言—动作”模型在短任务中表现良好,但在复杂连续任务中易受局部观测、环境扰动及动作累积误差影响,导致阶段性动作合理但...

2026-05-16 14:43
DeepSeek 融资后,大模型领域会有什么新格局?

DeepSeek 融资后,大模型领域会有什么新格局?

预计阅读 10 分钟 最近业界都在传,DeepSeek 进行了目标可能高达 500 亿人民币的首轮融资,将刷新中国大模型公司单轮融资最高纪录。据我了解到的消息,是不是 500 亿的规模虽然无法确定,但其首轮融资金额已打破纪录并严重超募,成功完成首轮融资已成定局。 那么,今天这样的...

2026-05-16 14:43