OpenAI
-
OpenAI 称自研 Jalapeño 芯片可带来更低延迟推理,但并非替代英伟达
OpenAI 公布自研推理芯片 Jalapeño 的基准测试结果,称其在每瓦 AI 工作量和端到端延迟上优于英伟达 GB200 / GB300 对照成绩。但该芯片短期内不会取代英伟达,更像是 OpenAI 为自身推理负载补上一层算力控制能力。
-
OpenAI 首次公布 Jalapeño 推理芯片成绩:以更省电方式追赶英伟达 GB300
OpenAI 在 Hot Chips 大会上首次披露 Jalapeño 推理系统基准成绩。在 InferenceX 测试中,其每瓦完成工作量为对比系统的 1.5 至 1.9 倍,端到端延迟约为 28% 至 59%。
-
Codex 底层换到 Rust:OpenAI 开源 Agent 运行时,重写了 AI 编程工具的基础设施
OpenAI 开源 Codex Agent Harness,并将其底层从 TypeScript 重写为 Rust。本文梳理其三层接口设计、性能收益与 Agent 运行时工程化意义。
-
llm 0.33 发布:统一密钥配置与模板系统,进一步降低多模型调用门槛
llm 0.33 发布,统一嵌入模型密钥配置、增强模板系统,并支持 Responses API 的 reasoning_summary 参数,为开发者调用多模型和兼容端点提供更一致的 CLI 体验。
-
ChatGPT青少年版上线:年龄识别与人工审核能否真正兜底
OpenAI 上线 ChatGPT 青少年版,但年龄识别准确性、人工审核能力和家长绑定机制都受到儿童安全专家质疑。未成年人版大模型的关键不只是功能限制,而是能否提供透明数据和可验证的安全执行。
-
官方终端 Agent 空降榜首,但仍是 alpha:OpenAI Codex CLI 的机会与疑虑
OpenAI 的 Codex CLI 以高存量空降 GitHub Trending 第一,但最新版本仍是 alpha。官方编码 Agent 进入终端工作流的机会与风险同时存在。
-
OpenAI警告:AI网络攻击能力正在增强,前沿模型开发为何按下暂停键?
OpenAI高管警告,前沿AI模型已开始具备规划和发动复杂网络攻击的能力,公众与企业需提前防御。公司也因此暂停部分最先进模型开发,以强化安全防护。
-
OpenAI 正在企业市场追回 Anthropic:Ramp 数据揭示 B 端用户低忠诚度
Ramp 最新数据显示,Anthropic 仍在付费企业用户份额上领先 OpenAI,但 OpenAI 第三季度至今增长更快。企业客户随模型发布不断切换,大模型 B 端市场的忠诚度仍然不高。
-
OpenAI 开源 Codex Harness:AI Agent 竞争,正在从模型走向底层执行框架
OpenAI 开源 Codex Harness,将智能体执行框架、CLI、SDK 与 app-server 一并开放。AI Agent 竞争正从模型能力转向底层基础设施。
-
全球AI模型密集上新:从通用大模型向多模态智能体加速演进
2025年以来,人工智能(AI)技术在大语言模型和多模态领域持续突破,全球科技巨头密集推出新一代AI模型,不仅在理解与生成能力上实现飞跃,更在实用性与效率层面迈上新台阶,标志着AI…