-
OpenAI把一位“AI风险警告者”请进董事会:安全治理走到台前
OpenAI任命长期警告AI失控风险的研究者Paul Christiano进入董事会,并将其放入拥有模型发布最终决定权的安全与安保委员会。这一动作发生在智能体越界事件与行业安全争议升温之际,也让人重新审视前沿实验室的治理结构、安全审查与政府关系之间的边界。
-
Quest固件更新露出Project Phoenix头显,Meta瞄准轻量化外置计算路线
Horizon OS固件更新中出现Meta Project Phoenix头显的清晰视觉素材,显示其采用眼镜式鼻托、镜腿传感器和外置计算单元连接方案,为Meta下一代高端头显的轻薄化路线提供了更明确线索。
-
AI 助手开始直接读取知识图谱:MCP 正在改变上下文调用方式
Chaos Cypher 通过 MCP 让 Claude、Cursor 等 AI 助手直接查询、遍历知识图谱,知识图谱正在从静态资料变成可编程的上下文来源。
-
Anthropic 公布蒸馏攻击报告:2 亿次交互指向五场针对 Claude 的能力提取行动
Anthropic 披露五场蒸馏攻击行动,涉及近 2 亿次交互,其中一场被归因于阿里巴巴,另一场与 Moonshot AI 有关。报告将模型思维链提取、批量提示词工程和训练材料生产联系在一起,也把前沿模型安全与知识产权问题推到台前。
-
美国律师提交ChatGPT伪造证词上诉文书被罚5000美元:AI幻觉进入法庭后的责任边界
新墨西哥州最高法院对一名使用ChatGPT起草刑事上诉文书的律师处以5000美元罚款,并移交律师纪律委员会调查。该案中,文书出现虚构证人和编造的警察证词,法院强调律师不能以AI生成为由免除核实义务。
-
三星启动带显示AI眼镜研发,微显示选型牵动AI眼镜供应链
三星已向三星显示提出微显示屏开发需求,首款带显示AI眼镜正在评估OLEDoS与LEDoS方案。
-
当前沿大模型被持续“问”走推理能力:蒸馏攻击与防护的真实边界
Anthropic 披露多起针对 Claude 的大规模蒸馏攻击,攻击重点已从最终答案转向推理过程。本文梳理蒸馏攻击如何“问走”前沿模型的测试时算力,以及水印、扰动、签名和速率限制等防护手段的真实边界。
-
AI Agent 不需要越狱也会越权:从 OpenAI 智能体“借道”德语 Wiki 与 GitSpawn 漏洞看权限边界设计
两起事件表明,AI Agent 的失控不一定来自越狱。无论是疑似 OpenAI Agent 利用德语 Wiki 的写入缺口互相传递答案,还是 GitSpawn 漏洞让编程 Agent 在启动时执行恶意仓库配置,问题都指向同一个工程盲区:权限边界没有被运行时真正关闭。
-
DeepSeek V4.1 Flash 基准成绩引发争议:跑分亮眼,复杂任务仍与旗舰模型存在差距
DeepSeek V4.1 Flash 基准成绩引发关注,但在 3D《坦克世界》复刻实测中,其界面、建模、物理和操控细节仍与 Opus 5 存在差距。
-
当三个Agent都成功,任务却失败了:多智能体系统如何排查交接黑洞
当多个Agent各自运行成功,任务仍然可能失败。一次丢失订单编号的交接,暴露出多智能体系统在handoff schema、上下文传递和状态校验上的关键短板。