
最近圈里讨论“腾讯 WorkBuddy 接入匿名模型 Space-Bunny”的人不少身边好几个朋友跑来问我到底怎么配、值不值得用。WorkBuddy 是腾讯的效率智能体产品主打工作台、技能编排和多 Agent 协作Space-Bunny 则是用匿名代号发布的一个模型这次由 WorkBuddy 独家接入还给了限时折扣活动到 10 月 7 日截止。说白了就是让我在 WorkBuddy 里能以更低的成本把一个第三方匿名模型当成官方模型一样调度用来做总结、写代码、跑批量任务这些活。这篇文章我就把这几天实测 WorkBuddy 接入 Space-Bunny 的过程拆开讲讲包括为什么要这么接、配置时有哪些坑、10 月 7 日之前怎么把折扣吃到手。不管你是刚接触效率智能体的新手还是已经在 WorkBuddy 里搭了工作台的老手按文章里的步骤走一遍基本都能跑通。1. 项目整体设计WorkBuddy 为什么接“匿名模型”而不是死磕官方模型1.1 效率智能体的模型困境为什么需要“多模型路由”先说清楚 WorkBuddy 是个什么东西。你可以把它理解成一个“带模型能力的自动化工作台”——你在里面建技能、挂数据、配流程它帮你把重复的脑力劳动跑起来比如整理文档、生成周报、审阅简历、做会议纪要、跑 SQL 查询。实际用过之后你会意识到这类产品好不好用极度依赖背后模型的综合能力。问题就出在这没有任何一个模型能包打天下。我实测下来官方默认模型在长文档总结上很强但在写 SQL 这类偏“工具调用”的任务上偶尔会犯轴逻辑推理强的模型在中文长文本风格控制上又差点意思。如果你只有一个模型可选要么忍受它在你最不关心的任务上浪费 token要么为少数重活给全体任务都配上高成本模型很不划算。这时候“多模型路由”就体现出价值了。WorkBuddy 支持自定义模型提供方本质上就是把模型变成了“可插拔”的组件。你可以让主力模型负责复杂推理让 Space-Bunny 这种便宜模型跑批量文本处理、初筛、格式化这类日常活。这就像一个人出门不一定永远开 SUV买菜代步用小车就够了——成本立刻降下来任务分配也更合理。1.2 从“官方模型”到“匿名模型”Space-Bunny 解决什么问题看到 Space-Bunny 这个名字很多人第一反应是“匿名模型是什么鬼”。匿名模型通常是指发布方不公开主体身份、只用代号发布的模型一般通过社区或第三方渠道放出来跟着提供 OpenAI 兼容接口。匿名不等于不靠谱很多在排行榜上冒头的模型都是这个套路——先匿名跑分打出名声后再亮明身份。Space-Bunny 就是这种风格下的产物代号很直白兔子跑得快、便宜、灵活。那 WorkBuddy 为什么要独家接入一个匿名模型我猜原因有三层。第一层平台需要给用户更多选择官方模型不是万能的第三方模型可以补位第二层匿名模型通常成本低平台方把它接入后能把一部分长尾任务的价格打下来对用户是吸引力第三层这也是在试“第三方模型接入路径”——先从一个模型跑通后面再接更成熟的模型时流程可以直接复用。对我这种用户来说真正关心的只有一件事它能不能满足我的任务需求以及便宜多少。Space-Bunny 的优势在于它在文本理解、摘要、信息抽取这些任务上表现很稳跑批量的机械任务非常合适。所以我的建议是别被“匿名”两个字劝退把它当成一个需要实测的工具就行。2. 接入前的准备与核心概念2.1 接入前要准备的四样东西在 WorkBuddy 里配置 Space-Bunny不是“打开开关”这么简单。你需要先准备四样东西少一样都可能让你卡在半路一个 WorkBuddy 账号且建议确认版本支持“自定义模型提供方”这类功能。有些账号默认隐藏了该入口需要去设置里开启。Space-Bunny 的模型套餐或 API Key。去它的官方接入页注册后在控制台创建一个 Key权限建议先只勾选模型调用不要给它存储权限。模型接入地址和模型名。通常是一段https://.../v1格式的 Base URL加上一个类似space-bunny-xxx的模型标识。一条准备测试的任务。不要拿“你好”这种话去测测不出水平。我建议准备一篇 2000 字以上的文档或者一条包含多表关联的 SQL 需求。这里多说一句别拿公司核心数据去测新模型。匿名模型的运维水平、数据留存策略你都不清楚第一次接入尽量用脱敏数据跑测试。这不是看不起匿名模型而是工程上的基本礼貌。2.2 关键参数与成本一张表看明白Space-Bunny 的具体参数官方文档和我拿到的接入信息不一定完全一致我手头这份配置是实际跑通过的我按实际测试值整理在下面仅供参考参数项官方默认模型示例Space-Bunny示例说明模型标识workbuddy-prospace-bunny-instruct填错这个请求会直接 404上下文长度128K64K超长文档需要注意截断输入价格每百万 token较高较低按量计费时差距明显输出价格每百万 token较高较低生成字数多的任务适合用它风格稳定性强中上需要严格风格时建议保留官方模型工具调用支持基本支持复杂多步 Agent 场景要实测如果你拿到的是不同版本以你自己的接入文档为准。但有几个参数是通用的模型标识必须完全一致大小写和连字符都不能错Base URL 末尾的/v1有时候容易漏漏了会连不通。我就在“模型标识里带了空格”这个低级错误上浪费了十分钟复制粘贴时一定要检查有没有混入不可见字符。2.3 限时折扣10 月 7 日前到底能省多少这次活动最吸引人的是“限时折扣至 10 月 7 日”。我实际看了下规则折扣主要针对按量计费也就是你每用一万个 token结算价按折扣后的单价算。也有一部分套餐送额度但这个送的额度通常在活动到期后失效不会顺延到下个计费周期。我拿自己的使用场景算过一笔账我每天让 WorkBuddy 跑大约 50 次文本初筛任务每次输入 2000 token、输出 500 token。按官方默认模型价格算一天大约是 2 块多切到 Space-Bunny 折扣价之后一天成本降到几毛钱。一个月下来省下几十块不算夸张但对于高频调用场景这笔账很实在。为什么是 10 月 7 日大概率是运营策略活动周期设在了国庆长假前后既能拉新用户也能让老用户在假期里跑一批测试任务。我的建议是别拖到 10 月 6 日再去配万一卡在某个问题上活动就过了。现在花十分钟配好先小批量跑两天观察一下稳定性和计费明细比临时抱佛脚强得多。3. 实操WorkBuddy 接入 Space-Bunny 的全过程3.1 第一步拿到 Space-Bunny 的接入地址和密钥先去 Space-Bunny 官网或官方接入页注册账号然后在控制台创建一个项目。创建过程中会让你选接入方式一般有“在线调用”和“私有化部署”两种这里选在线调用就行私有化部署通常要另外沟通不适用于个人快速体验。创建完项目进“API 密钥管理”新建一个 Key。这里有个细节有的平台在创建 Key 时会让你选择用途有的是“管理密钥”有的是“只读密钥”有的才是“模型调用密钥”。一定要选能发起推理请求的那一类否则你后面会看到一个特别神奇的错误——Key 能查余额但一发模型请求就报 403。拿到 Key 后把这两段信息记下来一段是sk-开头的密钥另一段是形如https://api.xxx.com/v1的 Base URL。我习惯把它们先复制到一个临时文档里方便后面粘贴。如果你用密码管理器也可以直接存进去但注意不要存到 WorkBuddy 的共享工作区里避免队友误用。3.2 第二步在 WorkBuddy 中配置自定义模型提供方打开 WorkBuddy进入“设置 - 模型管理”。不同版本的入口名称可能略有差异有些版本叫“模型提供方”有些叫“工作台模型”但逻辑一样你要在这里新增一个模型源。点“添加模型提供方”后会出现一个表单需要填这几项提供方名称自己给模型源起个名字比如space-bunny-test方便识别即可。Base URL填刚才记下的那段地址注意确认是以/v1结尾。我一开始漏了v1测试连接直接失败报错也没提示原因排查了半天。API Key粘贴sk-开头的密钥。默认模型填模型标识比如space-bunny-instruct。这里千万注意不是填用户名、不是填账号 ID是你申请模型套餐时分配给你的那个模型名。上下文窗口按官方参数填。这里填错了不会导致报错但可能在你喂超长文本时WorkBuddy 以为模型能处理结果模型实际接受不了出现截断。是否启用流式输出建议勾选。不勾的话长文本任务会等全部生成完才返回体验很磨人。填完后点“测试连接”。正常情况会返回一个“连接成功”的结果。如果你在这里就报错别急先检查 Base URL 末尾的斜杠和/v1再检查 API Key 里有没有额外空格这两个是最容易犯的错。3.3 第三步在工作台里建一个技能并指定模型配置好模型提供方之后下一步是让某个具体的技能用上 Space-Bunny。在 WorkBuddy 工作台里新建一个技能比如我建了一个叫“长文初筛”的技能专门用来对一批文章做主题分类和摘要。在技能详情页里会有模型选择器。点开后应该能看到你刚刚添加的space-bunny-test提供方选中它再指定具体模型。这一步本质上是告诉 WorkBuddy这个技能以后跑任务默认走 Space-Bunny不占官方模型的资源。这里我有个建议新建一个技能来测而不是直接改你正在用的核心技能。这样可以做到“灰度发布”——先让新模型在一个低风险任务上跑几天确认稳定后再把其他技能切过去。出了问题时核心流程不会受影响这个习惯在把任何第三方模型接入工作台时都适用。3.4 第四步跑一次完整任务验证效果配置完成不等于接入完成跑通一次真实任务才算数。我拿一篇约 3000 字的行业分析文档做了测试给这个技能下的指令是提炼文章核心观点、按“背景-现状-趋势”三段输出摘要并列出三条关键判断。结果跑得很顺。耗时大约 20 秒输出约 400 字没有断流格式基本符合要求。最让我满意的是计费明细——在 WorkBuddy 的用量记录里这次任务被正确标记为 Space-Bunny 的调用费用比官方模型同样规格的任务便宜了一大截。这说明模型路由是真的生效了不是表面配置了一下实际还是走官方通道。测试通过后我另外跑了几个不同类型的任务包括让它生成 SQL、整理会议纪要、给一段代码写注释。整体感受是文本理解类任务表现不错复杂推理和代码生成属于“能用但不够惊艳”的水平。所以我的建议是把这个模型用在初筛、摘要、格式化这类任务上把重推理的活留给更专业的模型。4. 常见问题与排查技巧实录4.1 报错 401 / 403密钥明明看着没问题这个问题我猜是出现频率最高的。我排查过几次常见原因有三个密钥类型不对。很多平台同时有“管理密钥”和“调用密钥”管理密钥不能发起模型请求你要去重新生成一个类型为“推理/调用”的 Key。IP 白名单限制。创建密钥时如果你填了白名单而当前出口 IP 不在名单内请求会被拒。第一次测试建议先放开白名单跑通后再收紧。密钥里多了一个空格或换行。粘贴时很容易带入肉眼很难发现建议粘贴后在末尾按一下退格键再重新粘一次。排查顺序先看错误码是 401 还是 403。401 偏认证问题重点查密钥本身403 偏权限问题重点查 IP 白名单和密钥类型。4.2 请求超时、流式输出断断续续长文本任务尤其容易出现这类问题。Space-Bunny 的集群在高峰时段响应可能不稳定表现为输出一段后卡住十几秒又继续。我第一次遇到时以为配置错了后来发现是超时设置太短。WorkBuddy 里对有自定义模型源的任务一般有请求超时时间设置默认可能只有 30 秒。如果你跑的任务偏长建议把超时调到 120 秒左右。另外如果流式输出不稳可以临时关掉流式重试一次虽然整体等待时间变长但至少能看到结果。如果多次重试仍然超时建议错峰使用。我实测下来晚上 10 点后明显比白天高峰稳定。这个规律在第三方模型上很常见因为共享集群在白天负载高。4.3 怎么确认当前走的是 Space-Bunny而不是缓存或官方模型这是一个非常关键的问题。有时候你以为自己在用新模型实际请求可能被工作台内部路由到默认模型或者被某个缓存层“吞”了。我当时用了三个方法确认看用量明细。WorkBuddy 会把每次调用的模型名、token 数、费用记在“用量记录”里如果这里显示的是space-bunny-instruct和对应的低单价那就说明请求真的走过去了。看请求头或日志。在自定义模型提供方的高级配置里WorkBuddy 通常会提供一个调试日志入口能看到出站请求的目标地址和 Authorization 前缀确认 Key 的空间归属。做一个小实验。让模型在输出末尾加上一个特定标记比如“我是空间兔测试版”。如果返回内容里有这个标记说明这个技能确实用的是 Space-Bunny。第三种方式最直观。我把它写在技能指令的最后一行跑一次就知道最终生效的是哪个模型了。测完再把这个标记去掉不然每次任务输出都会带尾巴。4.4 10 月 7 日活动结束后怎么办很多人担心活动结束之后模型就不可用了。我看了下活动规则折扣价到期后大概率会恢复原价但模型的接入配置本身不会消失。也就是说你可以继续用只是价格回到正常水平。所以更理性的做法是把 10 月 7 日之前当成一个“体验期”而不是“囤货期”。我个人的计划是这几天主要用来积累运行数据包括稳定性、响应时间、输出质量然后算一下如果恢复原价每次任务成本是多少。如果还在可接受范围就继续给长尾任务用如果涨到不如官方模型划算就切回去。反正配置可以在模型管理里一键切换试错成本很低。还有一个小提醒有些活动套餐会默认勾选“到期自动续费”续费按原价计算。如果你只是试用记得在活动结束前把自动续费关掉免得下个月收到一笔意外账单。5. 最后想说的把匿名模型接进 WorkBuddy 这件事技术上并不复杂本质上就是填几个参数、做一次真实任务验证但它背后代表的变化值得留意模型正在变成一种“可以随时插拔”的资源平台方把选择权和成本控制权交还给了用户。Space-Bunny 未必是你最终会长期依赖的模型但通过这次接入你可以把 WorkBuddy 的工作流真正跑起来理解多模型路由是怎么运转的。我个人的体会是无论多好的新模型第一次接入时都别把它直接压到核心任务上。先拿一个不痛不痒的技能试一周看数据再谈扩展。这个习惯帮我躲过了不少坑希望也能帮到你。如果你在配置过程中遇到其他问题欢迎在评论区留言交流正好活动还没结束咱们边测边聊。