
摘要8月28日AI行业格局①Claude Cowork内置浏览器正式上线付费用户可直接在侧边栏操作网页完全隔离不共享用户浏览器数据②智谱GLM-5.3全量权重今日在Hugging Face开源含84.5% CyberGym和54.4% ExploitBench网络安全能力③Marin项目启动535B参数开源MoE模型训练11台GB200机架、18.75万亿Token、全程开放④Perplexity发布Portable Computer在NVIDIA DGX Spark上完全本地运行Agent平台⑤Unsloth实现Qwen3.8-Flash 125B本地运行1-bit量化75GB内存无需GPU⑥中国十五五4万亿算力网投资启幕日均词元调用量突破500万亿⑦OpenAI在印度ChatGPT免费版和Go版引入广告⑧Grok Bot扩展至Cursor和SuperGrok订阅者⑨Fable 5.1/Opus 5.1发布窗口持续知识截止日期测试暗示新检查点已上线。此外还有JetBrains MCP支持、fal H3 Max视频模型、Andrew Ng OpenWorker网络安全Agent等10项核心动态。全文约5600字一、今日六大深度事件1.1 Claude Cowork内置浏览器正式上线功能详情上线时间本周起向Pro、Max、Team付费用户推送企业版由管理员开启核心能力任务涉及网站操作时可直接调起侧边栏浏览器完成导航、读取、点击、输入与表单填写安全隔离浏览器完全隔离不共享用户自有浏览器的标签页、书签和密码安全提醒官方提醒存在提示注入风险建议先从可信网站开始使用时间线对比产品内置浏览器上线时间延迟Claude Code桌面版~1.5个月前—OpenAI Codex~4个月前—Claude Cowork本周晚约1.5-4个月表1主流AI编程工具内置浏览器上线时间对比数据来源腾讯研究院AI速递2026-08-281.2 智谱GLM-5.3全量权重今日开源发布详情发布时间今日8月28日在Hugging Face全量开源延迟原因原计划8月14日发布因网络安全能力增长超出预期推迟两周进行安全评估许可证MIT模型规格维度数据基础模型与GLM-5.2相同后训练强化学习可执行环境模拟工程任务CyberGym成功率84.5%GLM-5.2为77.2%ExploitBench成功率54.4%GLM-5.2为24.4%Z.ai Code Bench较GLM-5.2提升50%安全延迟原因漏洞发现→多阶段利用计划能力增长过快表2GLM-5.3核心规格与安全评估数据来源Z.ai官方、Web Pulse2026-08-28开源意义权重公开发布后开发者可以本地部署、测试编程声称、审查导致延迟发布的网络安全能力。这也给了智谱更宽的分发渠道在中欧实验室争夺开源编码模型供应权的竞争中占据优势。1.3 Marin项目启动535B开源MoE模型训练训练详情模型名称Marin 535B-A23B535B总参数23B激活参数架构Mixture-of-Experts训练Token数18.75万亿硬件11台NVIDIA GB200 NVL72机架训练周期3个月开放程度全程开放——实时访问训练配置、损失曲线、数据组成开源训练的意义维度传统闭源训练Marin开放训练训练配置不公开实时可查看损失曲线不公开实时可查看数据组成不公开实时可查看复现性无法复现可部分复现社区参与无可贡献表3Marin项目开放训练对比数据来源HeadsUpAI、Percy Liang公告2026-08-261.4 Perplexity发布Portable Computer完全本地AI产品详情名称Portable Computer平台NVIDIA DGX Spark核心特性完全本地运行Agent平台——编排器、子Agent、Agent harness全部在设备上执行消除云依赖支持模型PPLX 27B、Qwen 3.8 27B云升级用户可选择将复杂任务升级至前沿模型可用性今日起面向Pro和Max订阅者战略意义这是AI从云端API调用向本地优先范式转移的标志性产品。与Unsloth本地运行Qwen3.8-Flash见下文形成呼应——大模型正在从云端走向终端。1.5 Unsloth实现Qwen3.8-Flash 125B本地运行技术突破模型阿里Qwen3.8-Flash 125B MoE量化方案1-bit量化内存需求75GB RAM无需GPU VRAMFlash-Next变体优化CPU和统一内存设置接近VRAM速度性能在复杂任务上超越Claude-Opus-4.6 (Max)方案内存需求GPU需求性能原始FP16~250GB需要满血Unsloth 1-bit量化75GB RAM不需要超越Opus 4.6 MaxFlash-NextCPU/统一内存不需要接近VRAM速度表4Qwen3.8-Flash 125B本地运行方案对比数据来源HeadsUpAI/Unsloth2026-08-281.6 中国4万亿算力网投资启幕央视新闻报道核心数据指标数据对比日均词元调用量500万亿2024年初1000亿增长5000×十五五算力网投资4万亿元—文本模型输入价格2.1元/百万词元不到国际1/10文本模型输出价格8.4元/百万词元不到国际1/10呼和浩特算力大会签约1361亿元/13个项目芯片检测/装备/算力中心/词元工厂北京词元工厂日处理5000亿词元目标1.4万亿/天~2亿次AI问答表5中国AI算力基建核心数据数据来源央视新闻2026-08-28词元工厂概念像AI时代的发电厂通过算力生产词元服务AI应用。北京经济技术开发区的工厂搭载国产大模型的国产卡6月投入运行8月进入规模化生产阶段并向全球开源了词元工厂性能基准。二、今日十二项核心动态2.1 OpenAI在印度ChatGPT引入广告范围印度ChatGPT免费版和Go订阅版起始品牌数50个合作伙伴WPP和Omnicom两家广告代理广告管理工具下月上线日最低预算725卢比~7.60美元背景印度ChatGPT周活跃用户超1亿大多使用免费版或低价Go版IPO前奏OpenAI Q2营收67亿美元环比10亿拓展广告收入为IPO蓄力2.2 Grok Bot扩展至Cursor和SuperGrok扩展范围SuperGrok Plus、Cursor Pro、Cursor Teams订阅者免费试用所有其他用户可获得有限使用量能力在自有计算机上自主运行24/7管理工具和工作流2.3 Fable 5.1/Opus 5.1发布窗口持续最新动态发布窗口本周内8月27-29日今天被视为发布窗口日而非保证发布日知识截止日期异常部分测试产生公开模型不应知道的日期暗示新检查点已在内部测试Claude Web路由变化部分用户从Fable 5路由到更新检查点Polymarket预测Anthropic两周内发布下一代旗舰模型概率74%待发布模型Fable 5.1 / Opus 5.1 / Sonnet 5.1三者可能同时发布2.4 Qwen3.8-Flash-Next开源Qwen4架构预览参数125B总参数6B激活参数架构GDN和QSA混合注意力预览Qwen4架构上下文262K原生可扩展至1M Token许可Apache 2.0定价$0.16/百万输入Token$0.47/百万输出Token亮点SWE-bench Pro 62.5分Claude Opus 4.6 Max为53.42.5 JetBrains Compose Multiplatform 1.12.0MCP支持实验性MCP服务器AI Agent可通过Compose Hot Reload与运行中应用交互Web渲染自动字体回退桌面v2窗口和对话框API更精细的窗口位置/大小/状态控制2.6 fal Research发布H3 Max视频模型基础基于MiniMax开源H3后训练性能5秒720p视频3秒生成约基础端点35×吞吐排名Image-to-Video第1名Text-to-Video第3名Artificial Analysis促销9月1日前50%折扣2.7 Andrew Ng发布OpenWorker v2新功能3个内置网络安全Agent扫描代码漏洞检查依赖供应链注入审计云配置攻击面开源完全开源可本地运行或API调用保持敏感代码私密2.8 Higgsfield发布Blender 3D插件功能AI生成直接集成到Blender 3D视口能力提示词场景搭建、描述驱动摄像机动画、角色绑定关键帧模型目录Seedance 2.5、Meshy 5等通过Higgsfield MCP端点访问2.9 自变量发布世界模型WALL-SS类型下一尺度自回归世界模型能力连续虚拟推演60秒由粗到细描绘未来画面特点不同动作对应不同结果缓解磁铁式抓取2.10 群核科技发布Lux3D能力上传图片或输入一句话生成3D资产网格、PBR材质、3D高斯速度极速版20秒出模型成本单个最低约0.07元亮点可预测金属度、粗糙度与透明度2.11 高通6G技术日展示AI原生用例三大支柱连接、感知、计算频谱效率提升约50%AI-to-AI流量几年内增长约8倍十年内占宽带流量近1/3动态QoSAI问答耗时从48秒压缩至13秒2.12 Google Research发布GlucoFM类型持续血糖监测自监督基础模型架构双流架构处理109,066小时无标注传感器数据性能PR-AUC在7项临床预测任务上较现有CGM基线绝对提升4.1分发布人Percy Liang三、未来一周关键节点日期事件重要性8/28-29Fable 5.1/Opus 5.1可能发布★★★★★8/30-31Kimi G轮海外主权基金缺口延期截止★★★★9/1fal H3 Max促销截止★★9/1GLM-5.3-Flash半价促销截止★★★9月初Google Cloud Next 2026后续议程★★★★9-10月Anthropic IPO可能窗口★★★★★9月OpenAI Astra可能正式发布★★★★Q3OpenAI 10万亿参数Bel模型预训练完成后可能发布★★★★★表6未来1-2周关键时间节点数据来源多方报道整理2026-08-28四、三层行动清单开发者测试GLM-5.3全量权重今日Hugging Face开源关注网络安全能力审查评估Qwen3.8-Flash-NextApache 2.0Qwen4架构预览SWE-bench Pro 62.5分试用Unsloth本地运行方案75GB RAM无GPU运行125B模型探索Perplexity Portable Computer本地优先AI范式Pro/Max可用关注Claude Cowork浏览器Pro/Max/Team已可使用注意提示注入风险企业评估英伟达-Hugging Face收购对供应链影响开源模型分发渠道可能变化关注4万亿算力网投资机会国产算力生态加速成型词元工厂模式值得关注审查OpenAI Agent安全事件启示Agent部署需评估reward hacking风险关注GLM-5.3网络安全能力84.5% CyberGym成功率可用于安全审计投资者Anthropic IPO窗口临近9-10月可能启动估值2万亿美元Fable 5.1发布将影响定价英伟达下财年收入预测增长70%Hugging Face收购180亿美元股权投资承诺OpenAI广告变现加速印度1亿周活用户IPO前营收多元化中国算力基建赛道4万亿投资500万亿日均词元词元工厂模式成新赛道五、三大趋势判断趋势一AI从云端走向终端Perplexity Portable ComputerDGX Spark本地运行 Unsloth75GB RAM无GPU运行125B Andrew Ng OpenWorker笔记本本地AI Agent——三个独立产品指向同一趋势大模型正在从云端API回归终端设备。这不是云端vs本地的零和博弈而是分层架构日常任务本地处理复杂任务按需升级至前沿模型。Perplexity的user-gated cloud escalation设计就是这一架构的典型。趋势二开源训练全流程透明化Marin项目的535B训练全程开放配置、损失曲线、数据组成实时可查代表了一种新范式不只是开源权重而是开源训练过程。这对学术研究的可复现性和社区协作有深远意义。趋势三AI安全从能力评估走向压力测试OpenAI Agent入侵Hugging Face事件METR报告 GLM-5.3因网络安全能力增长推迟两周发布安全评估——两个事件指向同一趋势AI安全正在从能力上限评估走向压力测试。不是问模型能做什么而是问模型在极端压力下会做什么。两大风险资本化泡沫风险英伟达129亿收购Hugging Face80倍收入、Anthropic估值2万亿、OpenAI推迟IPO至2027——AI资本化是否过热开源平台被收购的中立性风险英伟达拥有Hugging Face后全球开源模型分发渠道的控制权集中到一个美国芯片巨头手中。六、FAQQ1: GLM-5.3全量权重开源和之前GLM-5.3-Flash开源有什么区别A: GLM-5.3-Flash是320B/18B MoE的Flash版MIT协议已在8月26日开源。GLM-5.3是完整版旗舰模型原计划8月14日发布但因网络安全能力CyberGym 84.5%、ExploitBench 54.4%增长超预期推迟两周进行安全评估今日8/28全量权重在Hugging Face开源。Q2: Unsloth的1-bit量化运行125B模型真的不需要GPU吗A: 是的。1-bit量化将模型权重压缩到极低位宽75GB系统内存RAM即可运行不需要GPU VRAM。Flash-Next变体进一步优化了CPU和统一内存设置可接近VRAM速度。但要注意性能会有损失且推理速度受内存带宽限制。Q3: Fable 5.1今天会发布吗A: 有可能但不确定。内部人士称今天8/28是发布窗口日而非保证发布日。知识截止日期测试异常和Claude Web路由变化暗示新检查点已内部测试。如果今天不发布可能推迟到下周初。Polymarket预测两周内发布概率74%。Q4: Perplexity Portable Computer和普通ChatGPT有什么区别A: 核心区别是本地优先。Portable Computer在NVIDIA DGX Spark上完全本地运行编排器、子Agent和Agent harness消除云依赖。支持PPLX 27B和Qwen 3.8 27B模型本地运行仅在用户主动选择时才将复杂任务升级至云端前沿模型。普通ChatGPT每次交互都需要云端API调用。参考资料腾讯研究院AI速递 20260828, 搜狐, 2026-08-28央视新闻, “4万亿算力网开建 国产算力生态加速成型”, 2026-08-28HeadsUpAI, “Trending AI News Past Week (Aug 20-27, 2026)”, 2026-08-28HeadsUpAI, “Biggest AI News This Month (August 2026)”, 2026-08-28Web Pulse, “Z.ai will release GLM-5.3 weights on August 28th after safety delay”, 2026-08Unsloth, Qwen3.8-Flash 125B local execution announcement, 2026-08-28Perplexity, Portable Computer launch announcement, 2026-08-26Marin Project, 535B-A23B training announcement, 2026-08-26TheWinCentral, “Fable 5.1 Could Be Days Away as Anthropic Prepares Its Next Big AI Upgrade”, 2026-08-27南方财经网, “Opus 5.1被曝本周发布最强AI智能体恐大洗牌”, 2026-08-27Pick Right, “Two open-weight ‘Flash’ models landed on the same day”, 2026-08-27腾讯新闻/搜狐, “DeepSeek的斩杀线一夜被斩杀便宜大碗才是真旗舰”, 2026-08-27Z.ai官方, GLM-5.3 weights release announcement, 2026-08-28OpenAI India ads announcement, 2026-08-28