#DeepSeek
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 模型发布2026-08-22 · 周六重要度 3/5深度报告 →
少源|DeepSeek上线视觉实验模型
DeepSeek 8月21日称V4-Flash-Vision-Exp已上线API;非X文档证实接口和限额,benchmark仍待第三方验证。
- 这条更像API能力补齐而非旗舰模型换代。
- 它值得记录,是因为DeepSeek把视觉输入
- 技术研究2026-08-20 · 周四重要度 4/5深度报告 →
LMSYS拆解V4-Pro在H20上的服务优化
LMSYS 8月19日发布DeepSeek-V4-Pro H20服务优化报告,新增内容是推理profile、显存容量和decode吞吐的工程拆解。
- 这条是大模型在受限硬件上继续榨效率的工程样本,而非新模型发布。
- 它说明MoE服务竞争已经从单一benchmark进入profile、KV容量和speculative decode的组合优化。
- 产品上新2026-08-14 · 周五重要度 4/5
DeepSeek补发V4更新日志和峰谷定价
DeepSeek在8月13日更新日志中补充V4系列说明,列出V4-Pro、V4-Flash、Responses API和峰谷定价。新价格将于8月16日16:00 UTC生效,谷时价格较峰时低50%。
- 这是对昨日版本映射缺口的补档,不应写成第二次模型发布。
- 对开发者最实用的是生效时间、峰谷差和Responses API兼容性,能力增幅仍需要独立评测。
- 开源工具2026-08-14 · 周五重要度 4/5深度报告 →
DeepSeek Harness预览开源插件化agent框架
DeepSeek在8月13日开放Harness v0.1开发者预览,并在GitHub公开MIT仓库。同日commit发布dsh@0.1.0-rc.5,仍非GA稳定版。
- DeepSeek从模型API向执行框架外扩。
- 影响力取决于插件生态、沙盒安全和与现有LangChain、Codex类工具的互操作,首日星标只说明开发者关注度。
- 模型发布2026-08-13 · 周四重要度 3/5深度报告 →
DeepSeek V4 Pro API切至0813,变更日志缺席
DeepSeek官方API别名已映射到DeepSeek-V4-Pro-0813,价格页显示当前规格与单价;0813专属能力变更日志与官方新benchmark仍未发布。
- 此条价值在于版本映射与价格可见性,而非已证实的能力升级。
- 调用方应记录版本并回归测试
- 头条2026-08-01 · 周六重要度 5/5深度报告 →
DeepSeek 发布 V4-Flash-0731 权重并开放 API 公测
DeepSeek 于窗口内发布 V4-Flash-0731 的 MIT 权重,并让官方 API 进入公开测试。官方称架构与预览版相同,本次升级仅适用于 Flash API。
- 同日开放权重、API 与 Codex 适配,降低了从评测到部署的距离。
- 厂商 benchmark 与独立指数口径不同,不能直接横向相加。
- 融资动态2026-07-26 · 周日重要度 3/5深度报告 →
单源称|DeepSeek 暂停至少 100 亿元融资计划
Bloomberg 7月25日单源报道称,DeepSeek 原计划在后续融资中至少再募100亿元人民币,但目前已暂停交易;消息来自知情人士,公司尚未公开确认。
- 窗口内新增的是融资流程状态,而不是资本结果。
- 至少100亿元是原计划下限,暂停也不等于取消
- 行业动态2026-07-05 · 周日重要度 4/5深度报告 →
LLM Token 单价 6 月回落,高价闭源模型的定价权拐点
AlphaguyTrading 跟踪的 LLM Token Expenditure Index 从 5 月底近 $2 百万 tokens 跌至 6 月 $1.6–1.7 百万 tokens,首次出现明显回落。背后是 GLM、Qwen、DeepSeek 等低价模型吃掉 70–80% 执行端 token。
- 行业动态2026-06-29 · 周一重要度 4/5深度报告 →
Coinbase 把 GLM 5.2 / Kimi 2.7 设为默认,AI 支出砍近半,LibreChat 缓存命中率 5%→60%
Coinbase CEO Brian Armstrong 6 月 29 日公开一组工程实践数字:在 token 用量持续指数级增长的同时,通过把智谱 GLM 5.2、月之暗面 Kimi 2.7 等开源权重模型设为默认,并叠加 LLM 网关的路由与缓存优化,让 AI 支出砍近半;LibreChat 的缓存命中率从 5% 拉到 60%,91% 的员工从未触及任何用量上限——核心抓手不是「摩擦+限额」,而是「更好的默认值+路由+缓存」。
- 模型发布2026-06-29 · 周一重要度 4/5深度报告 →
DeepSeek V4 7 月中旬出正式版,引入高峰时段 2 倍定价:开源低价的尽头是分场景分层
DeepSeek 权威观察者 teortaxesTex 6 月 29 日披露,V4 正式版将于 7 月中旬发布,不再是 2 个月的预览版;由于预期需求旺盛,DeepSeek 决定引入高峰时段定价——高峰期价格为现行 2 倍,基础价格保持不变。这是国产开源权重派首次对推理供给侧做主动分场景分层。
- 研究论文2026-06-28 · 周日重要度 4/5深度报告 →
DeepSeek 联合北大发布投机解码框架 DSpark,开源全栈代码库 DeepSpec
据 X 用户 @0xLogicrw / @danielhanchen 转述(以官方技术报告为准),DeepSeek 联合北京大学发布投机采样加速框架 DSpark 技术报告,并开源全栈代码库 DeepSpec,DSpark 已部署于 DeepSeek-V4 线上业务。在输出无损前提下,转述称 Flash 版单用户生成速度提升 60%-85%、Pro 版提升 57%-78%,超过原 MTP-1 基线;另一口径(@danielhanchen)称吞吐提升 51% 到 400%——两套数字差异很大,需以官方报告与开源代码实测为准。技术上先用 DFlash 并行主干生成隐藏状态,再追加轻量马尔可夫头(查表+一次矩阵乘)串行注入相邻词关联,配合置信度预测头与异步零开销调度避免高并发下吞吐崩塌。可独立证实的部分:deepseek-ai/DeepSpec 仓库确已开源(MIT,约 1.8k stars),自述为『训练与评估投机解码算法的全栈代码库』,README 列出 DSpark / DFlash / Eagle3 三种 draft model,目标模型支持 Qwen3(4B/8B/14B)与 Gemma,并提供从下载提示词到基准评估的完整 Python 工具链。
- 研究论文2026-06-27 · 周六深度报告 →
DeepSeek 开源 DSpark 全栈 DeepSpec:投机解码从「算法竞赛」走向「可复刻工具链」
DeepSeek 联合北京大学发布投机解码框架 DSpark 并开源全栈训练代码库 DeepSpec(MIT),已部署于 DeepSeek-V4 线上真实流量。在匹配吞吐、输出无损前提下,V4-Flash 单用户生成提速 60%–85%、V4-Pro 提速 57%–78%,超越原 MTP-1 生产基线。DSpark 以 DFlash 并行主干(3 层 MoE)生成隐藏状态,再追加低秩马尔可夫头注入相邻词关联,配合置信度预测头与后验校准(STS),用「两步前预测」的异步调度避免高并发下吞吐崩溃。DeepSpec 内置 DSpark/DFlash/Eagle3 三种草稿器,支持 Qwen3、Gemma4,提供从数据准备到基准评估的完整 Python 工具链。论文登上 Hacker News 首页(约 716 分、近 300 评论)。
- 研究论文2026-06-26 · 周五深度报告 →
DeepSeek 上线 DSpark:把投机解码做成「系统调度问题」,V4 推理再提速 80%
DeepSeek 发布投机解码框架 DSpark(半自回归草稿 + 置信度调度验证),并已部署到 DeepSeek-V4 Flash/Pro 真实线上流量。在匹配吞吐下,相比上一代 MTP-1 生产基线,V4-Flash 单用户生成速度提升 60%–85%、V4-Pro 提升 57%–78%。论文登上 Hacker News 首页(逾 600 分/230 评论),与同期 JetSpec 等工作共同把推理效率推向新前沿。