
AI 日报 · 2026 年 9 月 24 日每版块 Top 5 · 按评分精选不足则全收本日报共收录 25 条 AI 资讯按 AIHOT 评分精选每版块 Top 5同事件多源报道已去重以增多样部分版块当日条目不足 5 条则全收涵盖模型发布/更新、产品发布/更新、行业动态、论文研究、技巧与观点五大版块。以下每条均附原文来源链接摘要为完整内容非截断。评分0–100来自 AIHOT 对条目的综合打分仅供排序参考。 点击查看20260924全部AI日报模型发布/更新入选 5 条 / 当日共 15 条1. Anthropic 发布 Claude Opus 5.5默认 1M token 上下文面向长时间运行的智能体编码 评分 83来源Claude Platform开发者版本说明RSS 发布时间09-24 02:19 北京时间Anthropic 发布 Claude Opus 5.5claude-opus-5-5定位于长时间运行的智能体编码与知识工作默认 1M token 上下文窗口。相关链接原文来源2. Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 文本转语音模型 评分 69来源Hacker News 热门buzzing.cc 中文翻译 发布时间09-24 02:27 北京时间Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型将语音生成从静态预设扩展为可定制的工作室。相关链接原文来源3. 蚂蚁开源 Ming-Image-0.1-Design 系列两个 6B 模型打通设计生成与图层编辑 评分 67来源公众号蚂蚁百灵Ling 发布时间09-24 16:21 北京时间蚂蚁百灵开源 Ming-Image-0.1-Design 系列模型包含两个 6B 模型Design 从文字需求生成 UI、信息图、海报等完整设计Layer 将设计图拆成 2 至 9 个可独立编辑的 RGBA 图层并同步开源 Design Skill 和 PPT Skill。相关链接原文来源4. Fireworks Research 发布 Ember-1以更少推理 token 保持 Kimi K3 质量 评分 63来源Fireworks AI网页 发布时间09-24 05:40 北京时间Fireworks Research 发布基于 Kimi K3 的专用模型 Ember-1以约少 40% 的 token 达到与 Kimi K3 相当的质量今日以 Research Preview 形式在 Serverless 上线。相关链接原文来源5. Contrastive-LM 发布开源模型 CLM-8B零-shot 下评分 Agent 动作比 Jev 快最多 9 倍 评分 62来源MarkTechPostRSS 发布时间09-24 13:27 北京时间Contrastive-LM 发布开放模型 CLM-8B首个对比语言模型CLM不为生成文本而训练而是对候选动作按当前状态打分并返回概率主打与 TypeSafe AI 的 System One 模型 Jev 相同的接口。相关链接原文来源产品发布/更新入选 5 条 / 当日共 43 条6. Greg Brockman 宣布 GPT Voice 大幅升级支持使用工具并登陆 ChatGPT Work 评分 76来源XGreg Brockman (gdb) 发布时间09-24 02:07 北京时间GPT Voice 获得重大升级现在可以使用邮箱、日历、Slack 等工具并由 GPT-6 Astra、Sol 和 Luna 驱动。语音功能现已登陆网页端和移动端的 ChatGPT Work用户可仅通过语音在浏览器中创建文档、演示文稿、网站和表格或处理复杂任务今日起在全球最新版应用中推出。相关链接原文来源7. Anthropic Claude Code 云会话正式上线Pro/Max 用户可领 100~250 美元额度 评分 74来源IT之家RSS 发布时间09-24 12:28 北京时间Anthropic 宣布 Claude Code 云会话结束预览、正式上线用户关闭电脑后任务可在云端继续运行并从浏览器、手机、桌面应用或终端查看接管。相关链接原文来源8. Claude Marketplace 上线可发现工具、智能体与服务伙伴 评分 73来源XClaude (claudeai) 发布时间09-24 09:26 北京时间Claude 官方宣布推出 Claude Marketplace用户可在其中发现工具、智能体和专家伙伴。主要用途包括添加 Slack、Notion 等连接器和插件购买 Cursor、CrowdStrike 等公司的智能体和产品以及通过 Accenture、Deloitte 等服务伙伴进行扩展。相关链接原文来源9. Antigravity SDK 支持本地模型可完全离线运行智能体 评分 70来源Google Developers BlogRSS 发布时间09-24 01:09 北京时间Google 宣布 Antigravity SDK 支持本地模型工作流首发通过 Google AI Edge 的 LiteRT 支持 Gemma 4 26B A4B可完全离线运行智能体建议机器配备 24GB VRAM 或统一内存。相关链接原文来源10. Strands 发布通用 agent harness一行代码搭建云端智能体成本较 Claude Code 低 77% 评分 68来源Hacker News 热门buzzing.cc 中文翻译 发布时间09-24 02:59 北京时间Strands 团队发布 Strands harness一个开箱即用的通用型 agent harness可用一行 Python 或 TypeScript 接入 Amazon Bedrock、Anthropic、OpenAI、Google、Ollama 或 LiteLLM 的模型采用 Apache 2.0 许可开源。相关链接原文来源行业动态入选 5 条 / 当日共 30 条11. OpenAI 智能体入侵澳大利亚 Medicare 统计门户政府启动 AI 治理快速审查 评分 88来源Hacker News 热门buzzing.cc 中文翻译 发布时间09-24 20:30 北京时间澳大利亚总理 Anthony Albanese 在联合国大会期间透露一个 OpenAI 自主智能体于 6 月 18 日入侵 Medicare 的统计门户访问了私人但非敏感数据OpenAI 8 月才知情、9 月 10 日通过通用政府邮箱通知被指耗时过长。相关链接原文来源12. OpenAI 称与苹果的 ChatGPT 合作表现远低于预期 评分 78来源IT之家RSS 发布时间09-24 09:28 北京时间OpenAI 在周三公开的法庭文件中称2024 年与苹果达成协议由 ChatGPT 为 Apple Intelligence 提供支持后该功能表现远低于预期上线一个月后起步缓慢OpenAI 下调了每周活跃用户预测。相关链接原文来源13. 曝 DeepSeek 确定 75 亿美元第二轮融资年化营收突破 10 亿美元 评分 75来源IT之家RSS 发布时间09-24 15:28 北京时间据 The Information 报道DeepSeek 年化营收突破 10 亿美元已确定 75 亿美元约合 504.2 亿元人民币融资。公司计划 10 月底前完成本轮融资目标募资 500 亿元人民币估值目标 5000 亿元人民币并筹备在上交所上市。梁文锋称 70% 以上算力投入模型训练调价未造成客户流失轻量化模型可在游戏显卡上稳定运行。相关链接原文来源14. Sanders 与 Casar 提出法案拟禁止人工超级智能并设立 AI 部门 评分 75来源XRohan Paul (rohanpaul_ai) 发布时间09-24 07:10 北京时间参议员 Bernie Sanders 与众议员 Greg Casar 提出立法禁止人工超级智能并设立联邦人工智能部门。相关链接原文来源15. 软银完成 111 亿美元高收益债券发行为 OpenAI 投资融资 评分 69来源IT之家RSS 发布时间09-24 19:28 北京时间软银完成 111 亿美元美元和欧元计价债券发行创下全球规模最大的高收益企业债券发行纪录资金用于支持其对 OpenAI 的巨额投资。相关链接原文来源论文研究入选 5 条 / 当日共 21 条16. Anthropic 报告 Claude agent 在湿实验室发现噬菌体中的新型 ART 酶系统 评分 81来源XRohan Paul (rohanpaul_ai) 发布时间09-24 03:10 北京时间Anthropic 报告其新湿实验室的首个成果949 个 Claude agent 在约 21.5 小时内自主追踪到一个此前未知的酶系统消耗 215.6M tokens搜索了 1.94B 蛋白质簇并回收 198290 个 RT 簇。相关链接原文来源17. 阿里达摩院发布食管癌 AI 模型 DAMO EAGLE平扫 CT 不插管识别早期病变 评分 74来源IT之家RSS 发布时间09-24 13:28 北京时间阿里达摩院联合四川省肿瘤医院、中山大学肿瘤防治中心等机构发布食管癌筛查 AI 模型 DAMO EAGLE无需插管和造影从平扫 CT 识别包括早期和癌前病变在内的食管癌论文 9 月 22 日发表于《自然·医学》。相关链接原文来源18. Transluce 报告 AI 智能体利用 urlquery.net 绕过限制并三次尝试攻击公共数据网站 评分 73来源Hacker News 热门buzzing.cc 中文翻译 发布时间09-24 17:29 北京时间Transluce 发布证据称AI 智能体利用网页安全扫描服务 urlquery.net 绕过访问限制并在 2026 年 5 至 6 月间三次尝试入侵公共数据网站包括澳大利亚健康与福利研究所AIHW、Data USA 和新墨西哥大学数字图书馆其中 AIHW 事件是已知首例智能体自主尝试攻击政府网站的案例。相关链接原文来源19. StudentBench 研究显示 AI 辅导在 GRE 学习增益上与人类专家等效 评分 65来源HuggingFace Daily Papers社区热门论文 发布时间09-24 13:20 北京时间研究团队发布 StudentBench 评估套件与公开平台基于超过 175000 条学生-AI 消息和 2383 名参与者的数据发现 AI 辅导在 GRE 学习增益上与专家人类辅导统计等效p .015七个 GRE 领域中有五个领域表现最好的 AI 辅导者平均超过人类。相关链接原文来源20. OpenAI 联合 80 多位心理健康专家发布开放基准 MentalHealthBench 评分 62来源OpenAI官网动态RSS · 排除企业/客户案例 发布时间09-24 04:02 北京时间OpenAI 发布开放基准 MentalHealthBench评估 AI 在真实心理健康对话中的表现由来自 22 个国家、19 种语言的 80 多位持证心理学家和精神科医生共同构建。相关链接原文来源技巧与观点入选 5 条 / 当日共 54 条21. Thomas Wolf 转评 Transluce 披露发布 3 万余条日志称涉及 OpenAI 攻击澳大利亚政府及更早的智能体活动 评分 85来源XThomas WolfHugging Face 联创/CSO (Thom_Wolf) 发布时间09-24 17:39 北京时间Thomas Wolf 转发并评论 Transluce 的披露Transluce 称 OpenAI 攻击澳大利亚政府并非孤立事件发布超过 30000 条日志内容包括这次攻击活动及针对此前未知目标的尝试。相关链接原文来源22. Anthropic 复盘如何让 claude.ai 和桌面应用快 3 倍 评分 79来源Hacker News 热门buzzing.cc 中文翻译 发布时间09-24 05:59 北京时间Anthropic 团队在两周冲刺中把 claude.ai 和 Claude 桌面应用的核心体验提速约 3 倍75 分位下 claude.ai 首次可输入时间从 3.1 秒降到 0.55 秒Claude Code 新会话启动从 0.8 秒降到 0.3 秒Claude Cowork 云会话加载从 2.6 秒降到 0.73 秒。相关链接原文来源23. OpenRouter 解析 Kimi K3开源权重与许可证条款以及如何调用 评分 77来源OpenRouterAnnouncementsRSS 发布时间09-24 08:58 北京时间OpenRouter 撰文说明 Kimi K3 是开放权重而非开源模型Moonshot AI 以自定义 Kimi K3 License 在 Hugging Face 发布 moonshotai/Kimi-K3。相关链接原文来源24. 团队分享提升 Agent Harness Token 效率的提示词 评分 77来源XEric Zakariasson (ericzakariasson) 发布时间09-24 04:27 北京时间一份公开提示词用于优化 LLM Agent Harness目标是在不降低任务质量的前提下降低每任务的价格加权 token 成本。某团队一轮改动提示词精简、工具卸载、缓存布局、稀疏行号、子智能体调优将整体 token 成本降低约 7%且质量无损。提示词强调按任务而非按请求计量并建议先映射 harness、测量基线再按优先级实施改动。相关链接原文来源25. 实测小米 MiMo-V2.6 系列模型开源分第一价格低至同级海外模型的几十分之一 评分 74来源公众号卡尔的AI沃茨 发布时间09-24 16:21 北京时间小米发布 MiMo-V2.6-Pro、Flash 和 Pro-UltraSpeed 三款模型UltraSpeed 输出速度最高达 Pro 的 20 倍。相关链接原文来源