Agent
-
Meta 新模型把第一梯队 AI 推理成本压到八分之一:Agent 应用迎来成本拐点
Meta Muse Spark 1.3 以 62 分进入 Artificial Analysis 第一梯队,同时把输入输出成本大幅压低。对 Agent 应用来说,前沿模型的竞争开始从“谁更聪明”转向“谁更值得调用”。
-
不靠“看片”剪视频:video-use 把视频编辑变成一道文本处理题
video-use 没有选择让大模型逐帧观看视频,而是将视频转成带时间戳的文本,再交给 Agent 做剪辑决策。这一思路延续了 browser-use 的结构化文本优先哲学。
-
DeepSeek视觉新模型逼近Opus 4.8:多模态Agent竞赛进入工程验证期
DeepSeek-V4-Flash-Vision-Exp 在多个多模态 Agent 基准测试中逼近 Opus 4.8,但榜单分数之外,真正决定落地效果的是工具调用链路、Token 预算与工程架构设计。
-
Agent 反复失败,问题可能不在技能:工程实践中被低估的记忆层
Agent 反复失败时,开发者常习惯继续加工具、改提示词、补 few-shot。但 Dev.to AI 一篇工程文章结合 WikiSkill 论文指出,真正被低估的是记忆层:技能决定当下能做什么,记忆决定能否从经验中学习。
-
Codex 底层换到 Rust:OpenAI 开源 Agent 运行时,重写了 AI 编程工具的基础设施
OpenAI 开源 Codex Agent Harness,并将其底层从 TypeScript 重写为 Rust。本文梳理其三层接口设计、性能收益与 Agent 运行时工程化意义。
-
MCP 公布新路线图:Agent 工具链协议开始走向更轻、更标准的基础设施
MCP 团队发布更新路线图,围绕无状态服务器、Agent 身份、工具发现和 SDK 体验等方向,勾勒 Agent 工具链协议生态的下一步发展。
-
DeepSeek 多模态 API 新模型上线:V4-Flash-Vision-Exp 补齐视觉 Agent 场景
DeepSeek-V4-Flash-Vision-Exp 上线 API 平台,在 V4-Flash 文本能力基础上增强视觉理解,并面向 Agent 工具链提供多模态调用能力。
-
可信任的AI Agent是通向智能应用的必经之路
生成式人工智能浪潮下,软件应用正逐渐从以往促进流程、工作流和任务的工具,转变为能够代表终端用户开展工作的智能系统,特别是在企业级市场,软件应用将从仅仅支持业务流程的执行,逐步演变为…