写于 2026 年 9 月 27 日 · 作者背景:建筑工程从业者,非程序员,2018 年起折腾博客与云服务器
一、从「AI 不管用」到 Vibe Coding
今天突然有很多话想说,那就从今年上半年最出圈的一件事说起——Vibe Coding:用 AI 驱动代码来实现你的想法,把脑子里的东西变成真实的软件。
其实早在 2024、2025 年我就是最早接触大模型的那批人。那时候的模型不太聪明,我也在自己的老电脑上装过本地小模型跑着玩,当时的判断是:这玩意儿是有钱的大公司才用得起的东西。
转折点是前段时间腾讯的 WorkBuddy 出圈——这是腾讯云 CodeBuddy 团队推出的 AI Agent 办公工作台,主打"一句话交任务、多 Agent 并行交付"。连我这个搞工程的人都听说了,于是下载试了试,发现确实打开了一个新世界。
二、关于腾讯的「赛马」
用下来发现 WorkBuddy 并不智能:它主打全行业通吃的全能型,在落地侧做了很多固定场景的适配(比如任务管理、工作台),把强相关的东西打包成固定用法,但模型能力不够,很多东西打不通。
WorkBuddy 也不是腾讯唯一的 Agent。事实是,同门的办公 Agent QClaw 已经在 9 月 24 日发布公告:因"业务发展调整",将于 12 月 24 日正式停止运营——这个产品今年 3 月才上线,生命周期不足半年,用户数据正被引导迁移到 WorkBuddy。据说腾讯内部就是几个团队同时做一个方向、各干各的,谁跑出来就主推谁,其余整合掉——这是内部赛马。站在打工人角度看很残酷,但公司为了生存全面试错,也可以理解。
三、寻找更聪明的 Agent
自从发现 WorkBuddy 不够用,我就开始找更聪明的替代品。几天时间花了六七百块,前前后后用了六七个 Agent:
- 豆包 Agent:字节的新版豆包已经是 Agent 了,但写代码能力在 Agent 里算差的。
- 字节的扣子 / 扣子编程(火山引擎系,由扣子空间和扣子开发平台升级而来):一个对标办公全场景,一个做 Vibe Coding、对标 Anthropic 的 Claude Code。扣子编程做普通任务还行,界面也可以,能力差一点,但比 WorkBuddy 便宜,我开了 Plus 会员(约 70 元),加上每天签到送积分,比 WorkBuddy 耐用。
- DeepSeek Harness:梁文锋的团队 8 月开源的 Agent 运行时框架(MIT 协议),思路是"一切皆插件"——微内核加插件挂载。开源才能推动技术发展,这个必须点赞。但它现阶段不够聪明:所有工具都要自己配置,配好了才能发挥全部实力。对搞工程、完全不懂代码的我门槛偏高。
说说我的一点底子:我 2018 年就开始做博客,学买云服务器、学配置,那会儿用宝塔面板,现在用 1Panel 管网站。我以前干的事就是把 GitHub 上喜欢的开源项目 clone 下来,修修改改部署到服务器上——有点基础,但写代码是真不会。
四、主力工具的兜兜转转
- Codex + GPT-6:后来充上了 ChatGPT 会员(网上找礼品卡渠道,25 美元花了约 185 元人民币,没 Visa 卡只能这样)。Codex 确实是成熟产品:自身能力很强、不依赖过多插件,写代码逻辑严谨,产物是能直接用的成品,只有小 bug、没有大问题,代码安全性也好。9 月 22 日 OpenAI 发布 GPT-6 家族(旗舰 Astra,以及 Sol、Luna 档),Codex 开到最高推理档速度快、能力强,缺点一个字:贵——Plus 会员 5 小时额度,我十几分钟能烧完。
- Codex 的 Luna 档:便宜、快,适合当"干活的主力",让它深度思考就不行了——想复杂问题太慢。我是为了额度消耗慢一点才常用它,毕竟我用量太大:这两天烧掉的 token 得以上百亿计。
- 国产模型横评:豆包 Seed 2.1 系列(含 Pro / Turbo 及面向编程的版本)算及格线以上,勉强够用;DeepSeek V4 系列的大杯版本能力不错但价格偏高,后来的 V4.1 Flash 价格友好得多,在充不上 ChatGPT 的那段时间,我用 Codex 配合 V4.1 Flash 跑,体验还行。
- 腾讯元宝:普通对话 AI,不如豆包——豆包上线更早、有先发优势,信息面广,但普遍不够深入。
- 提示词的觉醒:这个阶段我逐步学会用提示词去约束和提升 AI 的能力,发现提示词真的很神奇。
五、最终主力:ZCode + GLM 5.3 Flash
因为各家额度都见底,我想找新的「白嫖」对象,找来找去发现了智谱自家的 ZCode,配上自家的 GLM 5.3 Flash(GLM-5 系列首个原生多模态模型,百万 token 上下文,官方称擅长代码生成与修复),用起来非常舒服:
- 产品克制:界面简洁,功能克制,是一个成熟产品的样子;
- 能力强:在我心里已经可以对标 Codex,配自家模型很好用,接第三方 API(DeepSeek、OpenAI 等)我也全部接好了,额度没了随时切换;
- 省 token:消耗速度比其他 Agent 慢一点,比较耐用;
- 上下文衔接能力强,系统占用也不大。
据公开报道,截至 8 月 11 日 ZCode 用户数已突破 100 万。当然,也要说说它的风波:9 月 18 日有开发者抓包发现 ZCode 会静默上传包含完整 Git 历史的工作区快照,智谱回应"代码数据未留存、未用于训练",并在 9 月 21 日将 ZCode 正式开源作为整改。真伪与责任我不做定论,但这件事提醒我:选 Agent 也要把厂商的数据边界、开放程度和口碑放进考量——开源整改至少是个知错就改的姿态。
六、结语:目前的推荐组合
- Vibe Coding 主力:ZCode(配 GLM 5.3 Flash,或切 DeepSeek / OpenAI 模型);
- 代码兜底:Codex(成熟、严谨,就是贵);
- 性价比日常:扣子编程(积分体系,用自家 Seed 系编程模型按 0.03 倍计积分,比较耐用);
- 固定场景办公:WorkBuddy 这类场景化 Agent,配合大量 Skill 使用,效率提升明显。
另外两个我还没用上但盯着的:最新的 Claude Code,以及 Meta 的 Muse(4 月发布了 Muse Spark 模型,9 月又推出了个人 AI Agent)。以上就是我这一路的踩坑记录,想到哪写到哪。
参考资料
- 腾讯 WorkBuddy 官网(copilot.tencent.com / workbuddy.ai)
- 《腾讯 QClaw 宣布 12 月停运:AI 办公内部赛马结束》(xmsumi.com,2026-09-24)
- 《DeepSeek Harness(dsh):一切皆插件的 Agent 运行时框架》(cnblogs.com,2026-09-01;dsh 于 2026-08-13 以 MIT 协议开源)
- 《DeepSeek V4.1 Flash 上线,闲时缓存价格直降 60%》(smzdm.com,2026-09-10)
- 《智谱 ZCode 代码上传风波持续:开源整改回应信任危机》(新浪财经,2026-09)
- 智谱 ZCode 用户突破 100 万(东方财富,2026-08-11)
- Meta Muse 个人 AI Agent 发布(Meta Newsroom / NYT,2026-09-08);Muse Spark 首发(CNBC,2026-04-08)
- 扣子编程官网(coze.cn / loop.coze.cn)