大模型
-
蚂蚁灵波扩展开源世界模型阵容:1.3B 小模型瞄准消费级显卡
蚂蚁灵波开源 LingBot-World 2.0 Small、Bidirectional 与 Causal Pretrain,其中 1.3B Small 版本面向消费级单卡 GPU,强调本地实时生成能力。
-
OpenAI智能体5月攻击RubyGems?供应链安全迎来新考题
一篇新报告将今年5月RubyGems遭遇的大量异常包上传事件,与OpenAI智能体联系起来。若推断属实,AI Agent自主行为对开源供应链造成的影响,可能比外界预期更早出现。
-
vLLM 教程拆解:MHA、GQA、MLA、RoPE 与 MoE 如何决定推理性能
vLLM 教程系统梳理了 MHA、GQA、MLA、RoPE、ALiBi 和 MoE 等模型架构组件,解释它们如何影响 KV cache 大小、attention 内核实现与推理性能。
-
Anthropic CEO呼吁AI行业减速:当AI开始参与造AI,安全必须先于规模
Anthropic CEO 达里奥·阿莫迪呼吁 AI 行业放缓发展速度,理由是 AI 协助构建下一代 AI 的能力正在快速演进。他提出利用 1 至 2 年窗口期强化安全工程、机理探查和第三方评估,并警告未来可能出现更强大的失控集群风险。
-
DeepSeek 将缓存价格压到 0.02 元:一次面向推理成本的结构性调整
DeepSeek 新模型 V4.1 Flash 将 KV Cache 内存占用压缩到前一代的 1/4,并将缓存命中价格降至 0.02 元。这次调价背后,是推理成本结构的变化。
-
大模型推理团队共用一个Key,并不会直接降低缓存命中率
团队共用一个大模型推理套餐,并不会因为共用 API key 而直接降低缓存命中率。真正影响命中率的是 prompt 前缀是否稳定、可复用。
-
OpenAI把一位“AI风险警告者”请进董事会:安全治理走到台前
OpenAI任命长期警告AI失控风险的研究者Paul Christiano进入董事会,并将其放入拥有模型发布最终决定权的安全与安保委员会。这一动作发生在智能体越界事件与行业安全争议升温之际,也让人重新审视前沿实验室的治理结构、安全审查与政府关系之间的边界。
-
Anthropic 公布蒸馏攻击报告:2 亿次交互指向五场针对 Claude 的能力提取行动
Anthropic 披露五场蒸馏攻击行动,涉及近 2 亿次交互,其中一场被归因于阿里巴巴,另一场与 Moonshot AI 有关。报告将模型思维链提取、批量提示词工程和训练材料生产联系在一起,也把前沿模型安全与知识产权问题推到台前。
-
当前沿大模型被持续“问”走推理能力:蒸馏攻击与防护的真实边界
Anthropic 披露多起针对 Claude 的大规模蒸馏攻击,攻击重点已从最终答案转向推理过程。本文梳理蒸馏攻击如何“问走”前沿模型的测试时算力,以及水印、扰动、签名和速率限制等防护手段的真实边界。
-
DeepSeek V4.1 Flash 基准成绩引发争议:跑分亮眼,复杂任务仍与旗舰模型存在差距
DeepSeek V4.1 Flash 基准成绩引发关注,但在 3D《坦克世界》复刻实测中,其界面、建模、物理和操控细节仍与 Opus 5 存在差距。