ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

OpenAI一夜发25项更新:常驻Agent Dots和降价版GPT-6.1 Sol

OpenAI一夜发25项更新:常驻Agent Dots和降价版GPT-6.1 Sol 9月30日凌晨OpenAI在旧金山开了DevDay 2026一口气公布25项更新。据量子位等媒体报道这次最受关注的是三样东西常驻智能体Dots、新模型GPT-6.1 Sol以及被搬到云端的Codex。把这些放一起看主线其实很清楚——让Agent能长时间干活同时把长时间运行的成本压下来。这次更新的技术本质是什么以前我们说的Agent大多是跑一次任务给个指令它干完会话结束。Dots想改的就是这一点。它是一类常驻型智能体always-on Agent用户可以设定一个长期目标Dots记住上下文、跨会话持续跟进任务拖几天、几周也能接着往下走。它还能主动汇报、调用浏览器和应用界面并且可以同时接几个项目出现在ChatGPT、Slack、Microsoft Teams里。不过权限卡得很紧。据报道Dots后台主动工作时默认只能通过只读工具获取信息不能自己发消息、改应用内容或控制电脑涉及外部操作时要按用户设置决定自动执行、请求批准还是禁止改密码这类敏感操作始终由用户自己完成。目前它已向Pro和Business Premium用户开放企业版需要管理员手动开Beta。再看GPT-6.1 Sol。官方口径是智能水平接近旗舰GPT-6 Astra但标准API价格只有后者的五分之一——每百万Token输入2美元、缓存输入0.1美元、输出10美元。据报道在考察真实代码库长流程任务的DeepSWE v1.1上它能匹配Astra比GPT-6 Sol最高成绩高6.4个百分点在OSWorld 2.0的Computer Use测试里比GPT-6 Sol高7个百分点。这里有个背景值得记一笔旗舰GPT-6.1 Astra因安全问题被暂停对外发布所以6.1 Sol顺理成章成了新主力。官方benchmark终究是官方口径这点后面还会说。配套的还有两块。一是Codex云端化任务可以丢到云端电脑休眠也能继续跑命令行新增/agents界面一个任务拆给多个Agent并行处理代码评审也成了正式功能还推出Codex Security Cloud按需扫描GitHub仓库。二是Agents API加入Computer Use能力并把multi-agent、tool search、context compaction等搬进API。其中context compaction主要解决长任务里的上下文膨胀——压缩历史、只保留关键状态、降低Token消耗让Agent能跑得更久。变了什么没变什么这次真正变化的不是模型又强了多少而是补上了Agent长时间工作的三件套工作周期拉长Dots、单位成本降低GPT-6.1 Sol、执行环境补齐Codex Cloud Agents API。翻译成大白话——Agent从跑一次任务变成扛一段职责。没变的是老问题权限边界、幻觉、以及长时任务里不断累积的Token账单。Astra被暂停发布本身就是AI容易编造内容这件事的提醒。对普通开发者意味着什么第一成本直接决定落地。常驻Agent最大的敌人是账单。价格砍到五分之一才谈得上让它在后台7×24小时跑。第二执行环境开始被托管。以前自己写session管理、上下文压缩、任务恢复、沙箱那一堆胶水代码现在Agents API提供托管的Codex harness你主要负责提供工具和运行环境。第三速度开始单独卖。OpenAI推出Ultrafast档位Codex里最高约300 tokens/s官方称最高提速8倍API最高约6倍——连快都成了付费项。给几条实在的建议做AI应用和自动化的重点看Agents API的托管harness和context compaction能省掉不少自建工作但务必先把权限模型想清楚别让Agent在无人监督下碰生产环境。只是想日常用Dots的先当它是帮你盯长期、重复事项的助手。默认只读这个设定是有意为之涉及发消息、改数据、付款这类动作一定走人工审批。别被接近旗舰冲昏头。官方benchmark跑得好看不代表你的业务场景好看尤其是computer use这类任务真实失败率往往比基准测试难看上手先做小样本对比。Agent从工具箱变成工位方向已经很明确了。但决定它能不能进你工作流的从来不是发布会多热闹而是账单和事故率。你会把什么样的活儿交给一个7×24小时在线的Agent评论区聊聊。
返回列表