DeepSeek
-
DeepSeek 将缓存价格压到 0.02 元:一次面向推理成本的结构性调整
DeepSeek 新模型 V4.1 Flash 将 KV Cache 内存占用压缩到前一代的 1/4,并将缓存命中价格降至 0.02 元。这次调价背后,是推理成本结构的变化。
-
Anthropic 公布蒸馏攻击报告:2 亿次交互指向五场针对 Claude 的能力提取行动
Anthropic 披露五场蒸馏攻击行动,涉及近 2 亿次交互,其中一场被归因于阿里巴巴,另一场与 Moonshot AI 有关。报告将模型思维链提取、批量提示词工程和训练材料生产联系在一起,也把前沿模型安全与知识产权问题推到台前。
-
DeepSeek 推出开源 Agent 运行时 Harness:以插件化架构补齐工程化短板
DeepSeek 开源 Agent 运行时框架 Harness,以“一切皆插件”的方式整合模型调用、工具执行、会话、权限和沙箱能力,试图解决 Agent 从本地原型走向生产部署的问题。
-
DeepSeek V4.1 Flash 即将上线:过渡期请求自动切换,Flash 价格下调 60%
DeepSeek 开放平台宣布将于 2026 年 9 月 10 日前后发布 V4.1 Flash,并在过渡期将 V4 Pro 请求路由至新模型。同日中午起,Flash 系列降价约 60%,缓存命中价格降至 0.04 元。
-
DeepSeek视觉新模型逼近Opus 4.8:多模态Agent竞赛进入工程验证期
DeepSeek-V4-Flash-Vision-Exp 在多个多模态 Agent 基准测试中逼近 Opus 4.8,但榜单分数之外,真正决定落地效果的是工具调用链路、Token 预算与工程架构设计。
-
DeepSeek 多模态 API 新模型上线:V4-Flash-Vision-Exp 补齐视觉 Agent 场景
DeepSeek-V4-Flash-Vision-Exp 上线 API 平台,在 V4-Flash 文本能力基础上增强视觉理解,并面向 Agent 工具链提供多模态调用能力。
-
DeepSeek 的条件内存技术:解决大语言模型无声资源浪费与 GPU 周期损耗问题
在大语言模型(LLM)的运行过程中,无声资源浪费以及 GPU 周期损耗成为了亟待解决的关键问题。DeepSeek 推出的条件内存技术,为这一困境提供了创新性的解决方案,有望显著提升…
-
全新DeepSeek R1T2 Chimera模型问世,速度提升200%
在人工智能领域,模型的效率与速度一直是研究者们追求的关键指标。近日,来自德国的TNG Technology Consulting GmbH实验室宣布推出了一种全新的DeepSeek…
-
德国要求苹果与谷歌下架中国AI应用DeepSeek
近日,德国数据保护机构对一款名为DeepSeek的中国人工智能应用发出了严厉警告,并要求苹果和谷歌两大应用商店立即将该应用从其德国区的平台上移除。这一决定背后,涉及对用户数据安全的…
-
AI领域的颠覆者:DeepSeek如何以低成本重塑AI开发范式
今年1月,当DeepSeek发布其R1模型时,这不仅仅是一次普通的AI公告,而是一次震撼整个科技行业的里程碑事件,迫使行业领袖重新审视他们对AI开发的基本方法。 DeepSeek的…