Token导航 LogoToken导航TokenDH.com

DeepSeek 最近有哪些新动态值得跟进

今日资讯 DeepSeek

DeepSeek 相关的新功能、版本变化、合作消息和行业讨论,这里会持续汇总。

想快速知道 DeepSeek 最近在更新什么、谁在用、市场怎么聊,先看这一页。

DeepSeek资讯

792

正文图片

2,817

DeepSeek V4最大的遗憾

DeepSeek V4最大的遗憾

henry 发自 凹非寺 量子位 | 公众号 QbitAI DeepSeekV4的技术报告里有mHC,有CSA,有HCA,有Muon,有FP4…… 唯独没有 Engram 。 Engram去哪了? 这个话题一度成为网友们讨论的热点。 Engram在今年1月由DeepSeek和北大...

2026-05-15 19:24
DeepSeek首次有了视觉能力,技术论文却被它连夜删掉了

DeepSeek首次有了视觉能力,技术论文却被它连夜删掉了

DeepSeek做了件罕见的事情:在终于开始灰测多模态能力后,它放出了一篇解释背后技术的论文,但这篇论文却在发布没多久就又被悄悄撤掉。 4月29日,DeepSeek研究员陈小康在X发布一条推文——现在,我们可以看见你了。配图中,DeepSeek 标志性的鲸鱼 logo 摘下眼罩,...

2026-05-15 19:22
Hermes团队改写预训练:算力成本降六成,DeepSeek之后提效新路径

Hermes团队改写预训练:算力成本降六成,DeepSeek之后提效新路径

本文来自微信公众号: AI前线 ,作者:四月 模型能力还需往上走,但训练成本却不能再无止境堆砌了——这可能是当前AI行业最强烈的共识。 从开发者到模型公司,大家关心的焦点已经不只是“谁家的模型更强”,而是一个更务实的问题:“同样多的GPU、同样的训练时间,能不能跑出更多有效实验,...

2026-05-15 19:11
DeepSeek 专家模式已无法上传文件,官方提示资源紧张

DeepSeek 专家模式已无法上传文件,官方提示资源紧张

感谢IT之家网友 起个好名真难、新注册的游客、软媒新友2406886、飛翔、花雨龘魔王 的线索投递! IT之家 5 月 14 日消息,据IT之家小伙伴反馈,DeepSeek 的“专家模式”已无法上传文件,官方提示“ 资源紧张,不支持文件上传 ”。 IT之家测试,DeepSeek ...

2026-05-15 17:42
暂无图片

“省钱卷王”DeepSeek拟融资500亿元?业内预测:算力集群与光模块或成资金核心流向

每经记者|赵李南 每经编辑|魏文艺 近期有市场消息称,DeepSeek正在进行高达500亿元(人民币,下同)的新一轮融资。 5月14日,《每日经济新闻》记者(以下简称“每经记者”)致电DeepSeek方面,但电话未能接通。此外,每经记者向DeepSeek方面发送了采访函,但截至发...

DeepSeek专家模式无法上传文件 官方提示:目前资源紧张

DeepSeek专家模式无法上传文件 官方提示:目前资源紧张

快科技5月14日消息, 多位网友今日反馈,DeepSeek的"专家模式"已无法上传文件,官方提示"资源紧张,不支持文件上传"。 经测试,DeepSeek的网页端和App均已下线了"专家模式"的上传文件功能。 目前,DeepSeek的"快速模式"依然可以上传文件、图片等,不过还是仅...

2026-05-15 16:27
暂无图片

DeepSeek 融资后,大模型领域会有什么新格局?

最近业界都在传,DeepSeek 进行了目标可能高达 500 亿人民币的首轮融资,将刷新中国大模型公司单轮融资最高纪录。据我了解到的消息,是不是 500 亿的规模虽然无法确定,但其首轮融资金额已打破纪录并严重超募,成功完成首轮融资已成定局。 那么,今天这样的形势下,中国大模型玩家...

2026-05-15 04:29
DeepSeek掀桌后,大模型厂商应该关注什么?

DeepSeek掀桌后,大模型厂商应该关注什么?

文 | 利昂先生 4月24日,DeepSeek V4 虽迟但到。 1.6T 参数,MIT 协议全量开源,百万级上下文直接拉满。 鼓掌的除了 整个科技圈,还有那些在前一天卖空Minimax和智谱股票的股民们。 但内行人更关注的是, DeepSeek V4创新性地 用了两套全新的底层...

2026-05-13 00:41
灵珠开启第二次内测:取消邀请码、接入DeepSeek V4

灵珠开启第二次内测:取消邀请码、接入DeepSeek V4

【TechWeb】5月11日消息,AI创作平台灵珠宣布第二次内测正式启动。 此次内测最显著的变化,是正式取消邀请码机制。用户可直接登录灵珠官网体验,每日登录即可获得积分用于创作支持。 据悉,在首次内测的三周时间里,平台已经积累了相当活跃的用户行为数据:单日Token消耗量突破50...

2026-05-13 00:41
2.11倍领先!中国AI大模型周调用量再超美国:腾讯Hy3 preview (free)蝉联第一,DeepSeek三款模型上榜,MiniMax M2.7落榜

2.11倍领先!中国AI大模型周调用量再超美国:腾讯Hy3 preview (free)蝉联第一,DeepSeek三款模型上榜,MiniMax M2.7落榜

每经记者:宋欣悦 每经编辑:高涵 《每日经济新闻》根据 OpenRouter 最新数据测算,上周(5月4日至5月10日)全球AI大模型总调用量为25.7万亿 Token ,较此前一周增长7.5%,连续三周上涨。 其中,上榜的AI大模型中,中国AI大模型周调用量达7.941万亿To...

2026-05-13 00:41
究竟该如何给DeepSeek估值

究竟该如何给DeepSeek估值

作者 | 王兆洋 邮箱 | wangzhaoyang@pingwest.com 三周之内,在公开报道里 DeepSeek 的估值四次改写: 4月初约100亿美元“启动融资”,4月22日的报道称其估值超过200亿美元,5月6日传出“ 大基金 ”洽谈领投,估值约450亿美元,而上周最...

究竟该如何给DeepSeek估值

究竟该如何给DeepSeek估值

三周之内,在公开报道里DeepSeek的估值四次改写: 4月初约100亿美元“启动融资”,4月22日的报道称其估值超过200亿美元,5月6日传出“大基金”洽谈领投,估值约450亿美元,而上周最新传出的估值上限是超500亿美元——若成真,这会是中国AI公司有史以来最大的单轮融资。 ...

Redis之父下场,给DeepSeek V4单独造了一台推理引擎

Redis之父下场,给DeepSeek V4单独造了一台推理引擎

henry 发自 凹非寺 量子位 | 公众号 QbitAi DeepSeek V4,已经开始逼着海外开发者为它修专属高速公路了。 发布才两周,开源圈里,第一批V4原生基础设施已经冒了出来。 而且,不是那种在现有框架上套一层壳的“小修小补”。 不是通用GGUF加载器;不是llama...

2026-05-13 00:41