
WorkBuddy 刚放出来的双模型限免消息我看了一圈觉得是最近效率圈里最实在的一次活动Hy4 preview 给两周完整体验期Hy3 直接免费到 9 月底。对一直想试 WorkBuddy 又不想马上掏钱的人来说这就是官方递过来的体验卡完全不用客气。WorkBuddy 这个“效率智能体”我已经断断续续用了一段时间核心玩法一句话讲清楚它不是普通聊天机器人而是能把大模型接进真实工作流的工具。你在对话里说的每一句需求它都有机会变成一次外部操作比如定时发消息、同步钉钉多维表、整理群聊记录甚至把笔记写进 Obsidian。这篇文章我打算把双模型限免这件事拆透Hy3 和 Hy4 preview 分别适合干什么、限免时间怎么算、怎么在 WorkBuddy 里快速配置、有哪些实测好用的玩法以及几个新手容易踩的坑。无论你是刚听说 WorkBuddy还是已经在用但纠结要不要升级模型都可以在限免窗口里找到自己的答案。1. 先弄明白 WorkBuddy 到底是个什么东西1.1 它是“带手脚”的大模型不是聊天玩具WorkBuddy 的定位用一句话概括就是“能把指令变成动作的效率智能体”。传统的大模型对话你再怎么问它也只是在对话框里给你输出文字。WorkBuddy 多了一层执行能力它能调用连接器去操作其他软件能按设定好的时间触发任务能通过 Skill 把一段复杂流程封装成固定动作能够把你交给它的外部数据读进来、处理完再写回去。这里说的连接器你可以理解成智能体和外部应用之间的一座桥负责授权、读取、写入。没有连接器模型只是在你脑内想象业务数据长什么样有了连接器模型才算真正摸到了数据。拿热词里出现频率很高的几个用法举例有人用它定时发送微信消息有人让它定期同步钉钉多维表有人用它整理聊天记录还有人把它和 Obsidian 联动当成个人知识库的清洗工。这些用法有一个共同点模型不是在“回答一个问题”而是在“完成一个任务”。这种从“问答”到“执行”的转变才是 WorkBuddy 和普通聊天助手最本质的区别。我在刚开始接触的时候差点把 WorkBuddy 当成另一个 Chatbot 首页结果发现它更像个“带手脚、能看日历、有通讯录”的数字助理。你给它一个目标它自己拆分步骤、调用工具、产出结果。如果之前用过 CodeBuddy 这类偏开发场景的智能体上手 WorkBuddy 会更顺因为两者的底层思路很像差别主要在侧重点一个面向代码工程一个面向通用办公和业务流程。Skill 这个功能也值得解释一下它就像给智能体配的一本操作手册平时不会打扰你一旦触发某个场景它自动把手册翻到对应章节执行。对新手来说先别急着造自己的 Skill把系统自带的拆开看几遍很快就能理解这套设计逻辑。1.2 从 CodeBuddy 到 WorkBuddy产品线在横向扩热词里大量出现“codebuddy和workbuddy区别”这类搜索说明很多人在两个产品之间犹豫。其实它们的血缘关系很近WorkBuddy 可以理解成 CodeBuddy 向非开发者群体的一次延伸。CodeBuddy 的看家本领是代码生成、工程上下文理解、多文件修改它服务的主要是程序员。WorkBuddy 则把能力重心放到“业务流程自动化”和“知识工作辅助”上目标用户是运营、产品、行政、市场这些每天要和大量信息和表格打交道的人。但这不意味着开发者用不了 WorkBuddy。热词里同样能看到“workbuddy做ui自动化”“workbuddy linux版本”“workbuddy本地部署”这些偏技术向的搜索说明技术人群也在把它当成一个自动化工作台来用尤其是在 Linux 或国产化环境里做定时任务、跑回归、整理日志的场景。两边生态重叠度很高模型能力层可以共享剩下差别更多是模板和入口设计。所以你也可以理解成WorkBuddy 是同一个智能体底座换了一套更通用、更面向办公场景的皮肤和技能包。顺便说一句现在网上关于 WorkBuddy 的教程和资源已经不少但也混着一些容易误导人的内容。比如有人把某个用户自制视频剪辑成“大学清单”当成官方功能来传其实那只是个人整理的学习资料不是产品内置模块。这种信息差在工具类产品圈里很常见遇到“新功能”先看官方文档能省掉很多折腾时间。1.3 哪些人适合趁限免入场限免窗口是典型的“零成本试错期”我建议下面几类人重点留意。第一类日常要做大量信息汇总的人。周报、月报、会议纪要、项目同步这些工作本质上是把分散的信息压缩成结构化文本而大模型最擅长的恰恰就是这个。第二类需要定时或批量推送消息的运营和群管理员比如每天早上向工作群推送日报或者在项目节点自动给相关人发提醒。第三类有知识库维护需求的人比如用 Obsidian 做笔记、用钉钉多维表做资产登记都适合让智能体来定期清扫和归档。第四类正在做大模型选型的评测党Hy3 和 Hy4 preview 限免期间正好可以用自己的真实业务数据做横向对比比看任何官方榜单都更有参考价值。我遇到过不少朋友看到智能体的宣传视频很兴奋真正下载后又不知道从哪里开始。我的建议很简单趁限免先别追求复杂自动化从“整理今天的工作聊天记录”这种轻任务入手跑通一次后再慢慢加连接器、加自动化。在这个阶段跑通一件事比规划十件事更有价值你对模型的判断也会随着真实使用逐渐建立起来。2. Hy4 preview 和 Hy3 差在哪双模型怎么分工2.1 版本定位成熟版与预览版的关系Hy3 和 Hy4 preview 这两个名字在 WorkBuddy 的模型列表里出现频率非常高但很多用户并不清楚它们是什么关系。简单来说Hy3 属于已经在大量业务场景里打磨过的成熟版本特点是稳定性好、工具调用不容易翻车适合跑那些需要每天重复执行的生产级任务。Hy4 preview 则是新一代模型的预览版从目前公开信息和社区反馈来看它在语义理解深度、指令遵循、长文本处理这几个方向上有明显加强但 preview 这个词本身就意味着它还没完全定型可能出现响应波动、接口调整甚至临时不可用。你可以把两者类比成“稳定版系统”和“测试版系统”。稳定版不会给你惊喜但该干活的时候绝不掉链子测试版可能在某些功能上表现亮眼但也可能莫名其妙抽风。这种差异在自动化场景里会被放大如果一条链路是每天早上八点自动跑我肯定不希望在八点零一分因为预览模型返回值格式变了而中断那不如一开始就用更稳的那个。2.2 限免时间窗口的准确读法标题里已经很直白地给出了时间安排Hy4 preview 限免两周Hy3 限免到 9 月底。先说 Hy4 preview两周这个窗口不长意味着你想要深度体验新模型的话最好在拿到账号后立刻把典型任务跑一遍不要拖到第二周才开始。再说 Hy3给到 9 月底是比较舍得的一次开放说明官方大概率是想把 Hy3 打造成一个低门槛的默认档位让更多用户通过它留下来。这里有个细节提醒活动页显示的限免时间和控制台里的实际计费状态偶尔会对不上不同入口看到的剩余天数也可能不一样。我建议你以 WorkBuddy 控制台里的模型列表为准看到“限免/免费”标签才算数顺便在开始正式任务前跑一两条消息确认没有突然变成收费模式。还有一个容易被忽略的点限免费通常不等于不限量绝大多数活动都会设置每日额度或并发限制长期任务要预留重试空间别把额度烧在一个不会失败的任务上。2.3 双模型分工稳定任务用 Hy3探索任务用 Hy4 preview限免期间最容易犯的错就是哪个模型显得更高级就用哪个最后所有任务都压在 Hy4 preview 上。实际更合理的做法是给两个模型做分工。Hy3 负责定时任务、消息推送、数据同步这些确定性链路这类任务要求的是稳定输出和可预测的格式Hy3 的成熟度优势正好能发挥。Hy4 preview 则用来做信息整理、长文提炼、复杂推理这类智力密集型任务你可以借助它更强的理解能力拿到更高质量的结果就算偶尔需要重试影响也有限。我自己的习惯是凡是第二天早上要用的东西前一天晚上一定用 Hy3 先跑通凡是需要反复打磨、允许试错的内容才会丢给 Hy4 preview。这种分工方式能最大限度减少限免体验给你带来的额外风险也让两个模型都在各自擅长的位置上被评估最后得出的结论才真正有参考价值。把两者放在一张表里会更直观任务类型推荐模型理由定时任务、消息推送Hy3输出稳定、可预期、失败率低数据同步、表格读写Hy3格式要求严格稳定优先长文本整理、会议纪要Hy4 preview理解能力更强、细节捕捉更准复杂推理、策略分析Hy4 preview逻辑能力强可容忍重试3. 双模型配置实操从安装到吃满限免3.1 安装与首次看到的限免标识想吃到限免红利第一步自然是在 WorkBuddy 里正确进入模型环境。安装方面WorkBuddy 提供常见的桌面端安装包同时也有人在实际使用 Linux 版本和麒麟版覆盖了从个人办公到国产化环境的基本需求。下载安装完成后用账号登录第一次进入时建议直接打开设置里的“模型管理”或“模型列表”这里通常会展示所有可用模型以及它们当前的计费状态。如果首页有欢迎向导一般会引导你选择使用场景比如“自动化办公”“知识管理”“个人助手”选哪个不影响后续功能只是初始模板不同按自己最常干的活选就行。限免活动生效时模型名旁边一般会有明显标识比如“限免”“免费”或者一个倒计时角标。如果进去后没有看到任何标识先别急着下结论可以更新到最新版再查一次因为这类活动的开关经常跟着版本走旧客户端可能不显示。还有一种情况是活动按账号维度分批开放你暂时没看到可以等几小时再刷新通常不用太久就会同步过来。3.2 模型切换、额度查看与用量观察在实际使用中模型切换一般发生在两个地方一个是新建对话时的模型下拉框一个是针对已有对话的“切换模型”入口。大多数情况下在对话中间切换模型会开启一个新上下文不会保留之前的聊天历史这个细节要记清楚别辛辛苦苦铺垫了半天上下文一切换模型全丢了。我自己就踩过这个坑让 Hy4 preview 分析到一半切到 Hy3结果上下文直接断掉前面的指令全得重新给一遍。额度查看则是限免期间高频操作。常见的设计是在模型选择下拉框里直接显示剩余额度以进度条或“剩余 xx 次/xx token”的形式呈现。如果你每天跑的任务量比较大建议顺手点开用量明细看看请求次数、token 消耗和失败率这些数据在限免结束前会是你判断“该不该付费续用”的重要依据。我见过不少用户在限免结束前两天才想起来看用量结果发现自己根本不知道该选哪个模型相当于白嫖了一个月却没有得到结论非常可惜。从第一天就随手记录后面复盘会轻松很多。3.3 接本地模型和 OpenAI 兼容接口热词里反复出现“workbuddy接入openai”“千问3.8本地部署到workbuddy效果怎样样”说明很多人不满足于官方模型想把 WorkBuddy 接到自定义模型服务上。按照常见实现方式WorkBuddy 会提供 OpenAI 兼容接口的配置入口你只需要填一个 Base URL、模型名称、鉴权 Key 这三个信息就能把对话流量导到自己的模型服务。配置好后模型列表里会多出一个自定义项选它之后WorkBuddy 就会把请求转发到你指定的服务地址。配置本地模型时有几个坑很典型。第一模型名称必须和启动服务时注册的名字完全一致大小写都不能错填错最常见的报错是“model not found”。第二鉴权 Key 不能留空即使本地服务没有严格校验WorkBuddy 侧也常常要求非空随便填一个能通过校验的字符串即可。第三本地模型服务必须常驻且能被 WorkBuddy 所在网络访问到如果你把服务跑在容器里记得检查端口映射否则会出现连接超时。至于效果本地小模型的推理能力肯定和 Hy3、Hy4 preview 不在一个量级但胜在数据本地化适合对隐私敏感的内部场景这也是它存在的价值。3.4 自定义指令和 Skill 模板小白可以直接抄限免期间想快速看出模型差距最高效的方式是给两个模型喂相同的自定义指令。自定义指令本质上就是一段高权重前置提示你可以在 WorkBuddy 里配置后让每个新对话自动带上省得每次手打。这里我分享两个可以直接用的模板一个是整理聊天记录一个是生成工作周报。整理聊天记录模板可以这样写“你是一个信息整理助手。我会给你一段原始聊天记录请你按主题分类、提炼关键结论、列出待办事项并在结尾用表格输出参与人、结论、负责人、截止时间。要求不遗漏数字和日期语言保持中性。”生成周报模板可以这样写“你是我的周报助手。请根据我提供的工作笔记和消息摘录输出本周完成事项、下周计划、风险点、需要协调的资源全文控制在 500 字以内用分点列表呈现。”这两个模板都有很强的可复用性你在限免窗口里分别用 Hy3 和 Hy4 preview 跑同一份输入对比一下结构化程度和信息准确度很快就能判断哪个模型更贴合自己的需求。Skill 则可以理解成把自定义指令升级为可复用动作它不仅提醒模型怎么回答还规定了整个工作流的输入输出格式、调用哪些连接器、走什么校验逻辑。对新手我不建议一开始就沉迷于自己造 Skill先用系统自带的 Skill 库拆开看别人是怎么设计任务描述和参数定义的下次再遇到同类问题你就有感觉了。4. 四个实战场景把双模型用到真实工作流里4.1 场景一定时发送微信消息定时发消息是 WorkBuddy 里被问到最多的场景之一热词里“workbuddy 定时发送微信消息”长期有人搜。实操上你需要在自动化模块里新建一个定时任务触发条件设为每天特定时间动作用来发送消息再填接收人和文案模板。如果你的系统支持动态内容还可以让模型在触发时先根据最新数据生成文案再执行发送效果比单纯发固定文案好得多比如每天早上给团队发当天待办摘要内容会随着项目状态自动变化。这里我必须提醒一句合规问题微信个人号的自动化发送一直存在风控风险非官方协议做高频操作很容易被限制。我在测试时尽量选择企业微信或官方开放接口支持的通道个人号只保留低频提醒类消息千万不要拿它做群发营销。如果你是企业场景先确认内部是否有合规的发送通道如果是个人尝鲜控制频率、避免敏感词能少踩很多雷。模型选择上这类定时任务无脑选 Hy3原因很简单定时任务最怕不可控而 Hy3 的输出格式稳定、返回时间可预期凌晨三点跑批挂了也没人盯着给你重启。Hy4 preview 更适合在白天你本人盯着屏幕的时候去做那些需要灵活处理生成内容的探索。4.2 场景二钉钉多维表定期同步钉钉多维表在团队协作里的使用率很高很多人希望它每天自动同步汇总结果。WorkBuddy 通过连接器可以读写多维表做法通常分几步先在连接器列表里找到钉钉多维表并完成授权然后选择要同步的目标表格配置字段映射最后设置同步时间和输出规则。授权这一步要特别注意用哪个账号授权之后读写的就是哪个账号视角下的数据权限边界要提前想清楚别拿个人账号去同步团队敏感表。我实际测试时发现最容易出问题的环节是字段映射。多维表的字段类型很多把“日期”字段读出来再写回去时格式稍微不对就会写入失败。我的经验是在正式跑全自动任务前先手动跑一次单次同步把提示词里的字段名和表格里的列名对齐再保存为自动化任务。另外同步频率别设得太激进多维表接口一般都有调用频率限制建议每天 1 到 2 次即可。这种链路稳定性优先毫无疑问用 Hy3 做主力Hy4 preview 可以作为备选在 Hy3 挂掉时临时顶上但不要默认把预览模型跑在这个链路上。4.3 场景三聊天记录整理成会议纪要整理聊天记录是发挥 Hy4 preview 能力的好场景也是双模型对比最直观的实验场。操作方法不复杂把聊天记录粘贴或导入到对话里然后用我在前面分享的整理模板让模型输出结构化结果。关键在于聊天记录通常很长很杂真正考验模型的是长文本理解和信息抽取能力这正好是 Hy4 preview 宣称的强项。热词里专门有人搜“workbuddy整理聊天记录”说明这已经是公认的核心用法之一。我拿同一份包含 40 多条消息的项目群聊天记录做对比Hy3 和 Hy4 preview 都能给出基本可用的会议纪要差别体现在细节Hy4 preview 对“谁在什么时候承诺了什么”这类隐含信息的捕捉更准对数字和日期的敏感度更高。不过代价是它的响应时间明显更长偶尔还需要二次确认。所以如果你是紧急复盘场景建议先用 Hy3 快速产出一版再把重要信息丢给 Hy4 preview 做查漏补缺两边互补下来效率最高。整理完成之后记得让人工快速过一遍模型再强也只是辅助责任主体永远是自己。4.4 场景四与 Obsidian 联动沉淀个人知识库Obsidian 用户喜欢把 WorkBuddy 当作知识库的入口让模型把每天的对话精华、工作笔记整理后写入指定笔记。这种联动通常也是通过连接器实现授权 Obsidian 库的读写权限指定目标笔记路径和命名规则再配合定时任务或手动触发。用起来之后你会发现每天零散产生的工作记录终于有了一个自动归集的出口而不是散落在各个聊天窗口和临时文档里。实际使用中我会让两个模型分工Hy4 preview 负责当天信息的提炼因为它理解能力强能把零散内容总结成有逻辑的要点Hy3 负责把提炼结果写入 Obsidian因为写入动作需要严格的 Markdown 格式和文件命名稳定输出更重要。这里有一个小技巧在提示词里明确要求输出合法的 Markdown 结构比如二级标题、列表、引用块能明显降低模型乱加格式的概率。知识库一旦积累起来后续检索和回看都会非常轻松这也是我觉得 WorkBuddy 最值回票价的方向之一。5. 常见问题速查与避坑指南5.1 限免时间看不准怎么办很多人限免期间最焦虑的是“怕突然被扣费”。如果你在控制台看不到明显的剩余时间我的排查顺序是先确认客户端版本是否最新然后去官方公告或活动页核对时间再看模型列表里的标签最后看用量明细里是否有计费记录。如果都没有问题就直接联系官方支持。不建议凭第三方教程里的截图判断因为活动时间会根据运营节奏调整别人看到的版本很可能和你不在同一个期次。还有一种情况是限免是按账号或灰度批次开放的你身边别人能看到不代表你也能看到耐心等一等通常会同步。5.2 preview 模型中断、回答质量波动怎么处理Hy4 preview 既然是 preview就一定会有不稳定时刻这很正常。常见现象包括回答到一半中断、连续多次返回格式不一致、请求超时。我的处理经验是三层递进第一层简单重试一次很多时候只是临时的服务波动第二层把输入内容缩短或拆分超长输入是触发预览版异常的高频原因第三层切到 Hy3 完成同任务把 Hy4 preview 的失败记录保留下来作为评测依据。如果你要对 Hy4 preview 做严肃评测最好每类任务跑三次以上取多数结果而不是被一次坏响应带走结论。5.3 连接器或功能找不到的通用排查法热词里有一条“workbuddy没有看到claw怎么让他显示”这类“功能找不到”的问题很有代表性。遇到这种情况我建议按四步走一是检查版本很多连接器只在较新版本里上架升级后一般就能看到二是在设置或应用中心里搜索关键词有些连接器不是默认展示需要主动安装三是重启客户端连接器列表更新偶尔不会热加载四是确认账号权限企业版或团队管理后台可能屏蔽了个别连接器。如果以上都无效去官方社区问一句比自己在设置里翻半天效率高得多。另外提醒一句网上有些第三方教程会把非官方内容包装成产品功能比如“大学清单”这类说法其实就是某个用户的自制资料合集。如果你是因为这种视频去找某个功能而找不到先停一下确认它到底是不是官方能力再决定要不要继续花时间。5.4 限免结束后如何决策限免结束前两三天你应该停下手头任务做一次集中复盘。把这段时间记录的 token 消耗、任务成功率、输出质量整理成一张简单表格然后回顾你每天最常用的那两三个场景分别评估 Hy3 和 Hy4 preview 的表现。如果任务本身就是重复性、格式固定、对成本敏感选 Hy3 大概率是更理性的选择。如果任务要求深度理解、长文本、复杂推理且你能接受偶尔重试那 Hy4 preview 的设计方向就是为你准备的。按需付费的模型市场里没有绝对好坏只有适不适合你的工作流。决策时也可以参考这个表判断维度选 Hy3选 Hy4 preview任务类型重复、固定格式复杂推理、长文本成本敏感度高低稳定性要求高可接受重试使用频率大、频繁中等、偶发6. 我在限免期跑完之后的几点体会限免活动真正有价值的不是省下的那点钱而是它逼着我在有限时间里把两个模型放在完全一样的真实任务里做了一次压力测试。如果没有这个窗口我大概率会一直用默认模型不会主动去尝试预览版也就错过了很多关于能力边界的认知。测试下来我对 Hy3 的稳定性和 Hy4 preview 的理解能力都有了更具体的感受而不是停留在别人的评测截图里。最后再分享一个小技巧限免期间我会给每个模型建一个专门的评测笔记记录跑过的任务类型、输入规模、输出质量、失败情况表格随手写几行就行。等限免结束后翻出来看你会发现自己已经有了一份非常个性化的模型选型报告这比任何博主推荐都更适配你的业务。窗口已经开了先跑起来比什么都重要。