信信号图谱
日报2026-09-30·覆盖 22 条情报·生成于 2026/9/30 09:41:13
简洁版 高层快读详细版 完整分析

2026-09-30 日报 AI 行业竞争情报

执行摘要

本日 AI 行业竞争情报聚焦于 OpenAI DevDay 2026 后的密集产品与定价更新,以及 Gemini Enterprise Agent Platform 的企业级功能落地。OpenAI 发布了 dots 主动助手和 Agents API 的 Computer Use 功能,推动 Agent 向持续自主和浏览器操作演进;同时推出 GPT-6.1 Sol 模型并新增 Ultrafast 低延迟服务层级,通过大幅降价和性能分层调整定价策略。Gemini 平台方面,Memory Bank 记忆配置文件正式 GA,语义治理功能增强。此外,智谱和 DeepSeek 在 HuggingFace 上移除了部分模型版本,进行仓库资产清理。

关键事件

OpenAI 发布 dots 主动助手与 Agents API Computer Use 功能 OpenAI 推出 dots 主动助手,定位为可在复杂项目和日常任务中持续自主工作的工具,允许用户在保持控制的同时让工作自主推进。同时,OpenAI 在 Agents API 中新增 computer use 工具,Agent 现可在 OpenAI 托管的浏览器中执行任务,网站访问审批和登录流程由应用端控制。这两项更新标志着 OpenAI 在 Agent 运行时能力上的重大扩展。

OpenAI 推出 GPT-6.1 Sol 模型及 Ultrafast 服务层级 OpenAI 发布 GPT-6.1 Sol 模型,提供接近旗舰模型 Astra 的编码和计算机使用能力,但其 API 输入和输出 token 价格仅为 Astra 的五分之一。在定价策略上,gpt-6.1-sol 的缓存输入价格较 gpt-6-sol 降低 50%。此外,OpenAI 新增 Ultrafast 服务层级,首个支持模型为 gpt-6-astra,通过 service_tier 参数降低输出延迟,价格为 Standard 模式的 6 倍,目前仅支持美国数据驻留。

Gemini Enterprise Agent Platform 记忆与治理功能更新 Google Cloud 宣布 Gemini 平台的 Memory Bank 记忆配置文件功能正式 GA。该功能通过 LLM 维护结构化数据模式,使 Agent 能够低延迟访问动态信息,无需在会话中进行昂贵的搜索操作。同时,语义治理策略新增自定义拒绝消息功能,支持配置最多 1000 字符的固定提示,以替代底层策略拒绝理由。

主要趋势

Agent 执行范式从被动响应向持续自主与计算机操作扩展 OpenAI 发布 dots 主动助手(事件 1)与 Agents API 的 Computer Use 功能(事件 8),表明 Agent 产品正在从单轮或短时任务响应,转向跨任务的持续自主执行和直接操作图形用户界面(GUI)。托管浏览器方案的引入降低了开发者自建自动化基础设施的门槛,确立了浏览器自动化作为 AI Agent 关键交互范式的地位。

模型推理服务通过价格分层与缓存优化争夺开发者市场 OpenAI 通过发布 GPT-6.1 Sol(事件 2)和降低其缓存输入价格(事件 4),以显著降低的成本提供接近旗舰模型的性能,直接针对高频调用和价格敏感型场景。同时,新增的 Ultrafast 服务层级(事件 5、6)将推理速度作为独立的高溢价付费维度。这种“基础性能降价+极致性能溢价”的组合策略,反映了推理市场正在从单一价格战转向基于延迟和缓存命中率的多维精细化定价。

企业级 Agent 平台的记忆管理与合规治理进入生产就绪阶段 Gemini 平台的 Memory Bank 记忆配置文件正式 GA(事件 12),解决了长会话中检索成本高和延迟大的问题;语义治理支持自定义拒绝消息(事件 19)以及预置吞吐量支持自助更改订单(事件 11),表明企业级 Agent 平台正在完善生产环境所需的结构化记忆、品牌化合规交互和灵活的容量采购能力,以满足金融、医疗等合规敏感行业的需求。

公开模型仓库进行实验性与旧版模型的清理 智谱从 HuggingFace zai-org 组织下架了 GLM-4.6 模型(事件 3),DeepSeek 移除了 DeepSeek-V3.2-Exp 和 V3.2-Exp-Base 两个实验性模型(事件 22)。这表明中国头部大模型厂商在开源和公开模型发布上正在进行版本迭代与仓库清理,将开发者流量引导至更新的正式版或特定优化版模型。

用户与市场影响

Agent 开发者与知识工作者 需要长时间跨任务自动化执行的用户(如项目经理)获得了 dots 这一新的生产力工具范式。Agent 开发者无需自行搭建浏览器基础设施即可实现网页操作,降低了集成复杂度,但需自行处理登录和审批流程。

价格敏感型与低延迟需求企业 高频使用缓存输入的开发者可获得约 50% 的缓存读取成本下降,适合大规模重复查询场景。对延迟极度敏感的场景(如实时对话、交易系统)获得了 Ultrafast 选项,但需承担 Standard 模式 6 倍的成本,且欧洲客户因数据驻留限制目前无法使用该低延迟层级。

企业采购与合规管理员 OpenAI 将 FedRAMP 和区域处理的 10% 附加费说明整合至页面底部(事件 13、14),并新增 Cloud platforms 章节引导至 AWS 和 Azure 定价页(事件 16),简化了多云分发和企业合规采购的定价查阅流程。Gemini 的语义治理自定义消息功能使企业管理员能够以品牌化方式呈现合规拦截信息,改善终端用户体验。

证据与不确定性

证据说明 本报告事实基于 OpenAI 官方博客、开发者 Changelog 和定价页面 diff,Google Cloud 官方发布说明(Release Notes),以及 HuggingFace API 的模型列表 diff。GPT-6.1 Sol 的定价比例、Ultrafast 的价格倍数、Memory Bank 的 GA 状态均有官方文档直接确认。

不确定性

  • 产品机制与 SLA:dots 主动助手的具体工作机制、权限边界及与现有产品的关系未披露;Ultrafast 模式的具体延迟 SLA、性能指标及速率限制数值未在定价页和 Changelog 中说明。
  • 区域与合规限制:GPT-6 Astra 的 Ultrafast 模式不支持 EU 数据驻留,其在欧洲企业市场的采用率可能受限;OpenAI 对澳大利亚政府网站安全事件的具体改进措施和时间表未披露(事件 21)。
  • 模型下架原因:智谱 GLM-4.6 和 DeepSeek V3.2 实验版从 HuggingFace 移除的具体原因(如许可变更、仓库重组或临时问题)不明,是否迁移至其他平台未披露。
  • 别名与功能弃用:OpenAI 移除了 Daybreak 模型别名说明(事件 15)和图像输入成本计算器链接(事件 17),这些功能是被彻底弃用还是仅进行文档简化尚不明确。

数据来源

  • OpenAI 官方博客与新闻 RSS (openai.com/news/rss.xml)
  • OpenAI 开发者文档与定价页 (developers.openai.com/api/docs/pricing.md, changelog.md)
  • Google Cloud Gemini Enterprise Agent Platform 发布说明 (docs.cloud.google.com/feeds/gemini-enterprise-agent-platform-release-notes.xml)
  • HuggingFace API 模型列表 (huggingface.co/api/models)
  • Microsoft Foundry 开发者博客 (devblogs.microsoft.com/foundry/feed/)
  • Anthropic Claude Code 文档更新日志 (code.claude.com/docs/en/changelog/rss.xml)

报告引用的事件(16)

点击可查看该事件的完整来源证据。