Reddit AI 编程 - 2026-07-22¶
1. 人们在讨论什么¶
1.1 额度不透明,成了当天的共同语言 (🡕)¶
至少有 8 条高信号线程,把 Claude 的用量问题当成了产品本身,而不是后台计费。主导模式并不是某一次单独的宕机或公告,而是用户以为自己的套餐状态意味着什么,与计量器、额度系统或模型接下来实际会怎么表现之间,裂开了一道越来越大的缝。
u/siliconsoul-10k 把当天最大的线程写成了一份假的产品备忘录,里面有“17 个相互咬合的限制”、“计费牛头怪”,以及一个会显示 Green、Amber、Red 和 Plaid 的额度界面,但最高赞回复几乎都在说,这个笑话准确得让人很难一笑了之(《Important Update to Claude Usage Limits》)(1810 分,154 条评论)。u/ssn-669(得分 276)感谢这条帖子带来了“清晰度”,而 u/zockie(得分 222)则说,他们甚至希望这帖根本别被打上幽默标签。
u/T-Dot1992 揭开了这段讽刺背后更具体的花费惊吓:他们说,Fable 在一个任务做到 95% 时,在他们为了收尾而充值后,10 分钟内又烧掉了大约 80 美元额度(《Something kinda concerning about Fable》)(71 分,102 条评论)。u/lagom_kul(得分 44)回应说,与其继续买额度,不如切到 Sol 这类兜底智能体;u/edible_posting(得分 6)则算出了接近每小时 500 美元的成本。u/FinalFantasiesGG 则给出了同一恐惧的小一号版本:他们说,一个 5 行的 HTML 调整,在撞上 5 小时限额后,花掉了约 4 美元额度(《Who could possibly afford to use usage credits for anything meaningful?》)(34 分,45 条评论)。
u/AdDry7339 随后又把抱怨从“贵”转向“不可预测”:他们说,一个 Team 套餐在正常使用节奏下,25 分钟就把 token 用空了(《Someone else see increased token usages ?》)(42 分,58 条评论)。u/Brilliant-Bend4824(得分 10)说,同样的工作流突然比过去几个月耗得多得多;u/AwareStaging(得分 6)则说,他们只能把任务拆得更碎,并在每次运行之间提交 commit,尽量把损失压小。

u/ChallengeOne5494 又给出了最强的运营层证据:一张本地缓存的 Claude 实验标记截图,看起来会影响智能体行为(《Anthropic live testing on user caught. I DEMAND ANOTHER 100$》)(61 分,37 条评论)。u/nseavia71501(得分 28)贴出了一个 GitHub issue 和之前一条关于静默加入实验、设置被覆盖的 Reddit 抱怨;u/theknobbyaccomplice(得分 12)则说,这张图和他们最近一次说不清原因的行为变化对得上。u/ImaginaryRea1ity 另外还把这个月浓缩成了 4 个 Fable 公告日期,认为 7 月 1 日、7 日、12 日和 20 日,每一次都又重新定义了一遍这项权益(《AI users are frustrated with Anthropic’s constant pricing changes. It feels like we’re watching a lab realize, in real time, that it no longer controls the terms.》)(45 分,42 条评论),不过回复分成了两派:一边说“这只是正常的促销波动”,另一边说“这就是为什么没人相信限额界面”。

讨论要点: 评论者并不认同原因到底是什么——普通促销波动、feature flag,还是在线 A/B 测试——但他们对自救方式高度一致:不断检查计量器、保留备份、把工作拆成更小块,并把溢出部分路由到别的模型。
与前日对比: 7 月 21 日已经出现了互相矛盾的 Fable 横幅和额度提示。7 月 22 日则从套餐困惑,进一步升级成支出惊吓、token 暴涨报告,以及用户翻本地缓存文件来解释行为变化。
1.2 模型选择如今成了投资组合问题,不再是赢家通吃式下注 (🡕)¶
至少有 9 条强信号线程,按角色来评估模型:快速主力、高配规划者、便宜兜底、保额度的审查者,或前端专才。当天最大的发布故事是 Gemini 3.6 Flash,但社区讨论它时,更像是在谈一个路由栈里新增的卡位,而不是新的全场冠军;这个栈里本来就有 Fable、Sol、Kimi、Grok 和 Cursor 自家模型。
u/minxio_ 发了当天信息量最大的 Gemini 3.6 Flash 基准测试线程(《Gemini 3.6 Flash Benchmarks》)(232 分,106 条评论)。评论里链接的一篇 9to5Google 发布文章 说,3.6 Flash 相比 3.5 Flash,输出 token 少了 17%,输出价格从每百万 token 9 美元降到 7.50 美元,DeepSWE 从 37% 提升到 49%;而 u/hitmante(得分 46)则把这次发布框成了一种性价比打法,而不是前沿模型替代方案。u/FV-The_Hammer 也从产品侧推进了同一条发布线:他们把上线截图和另一条讨论串在一起,而回复里依然在问,它和 Anthropic、OpenAI 比到底怎么样,以及 Google 是不是为了继续推更便宜的 Flash 变体,才一直拖着不发 Pro(《Gemini 3.6 LIVE in antigravity!》)(230 分,111 条评论)。

u/defi_specialist 说,3.6 Flash 是第一个让他们开始考虑放弃 Pro 档替代品的 Google 模型(《Flash 3.6 just super good, don’t want to use pro anymore.》)(96 分,71 条评论),但就连这条正面线程里也带着限制。u/Snoo-81627(得分 5)说,在他们的工作流里,它比 GPT 或 Sonnet 快得多,但仍然不够细致,偶尔还会无视明确指令。u/Miserable-Archer-631(得分 6)则从当天另一面概括了同一现象:Google 一口气发了 3.6 Flash、3.5 Flash-Lite 和 Flash Cyber,但拖了很久的 3.5 Pro 依然没有上线(《Google dropped 3 new Gemini models today and somehow still no Gemini 3.5 Pro》)(31 分,32 条评论)。
u/Wide-Ad1564 随后又贴出了一段看起来很像官方口径的文字,让路线图讨论继续烧下去:Google 说 3.5 Pro 正在和合作伙伴测试,而 Gemini 4 已经进入预训练阶段(《According to Google, Gemini 3.5 Pro is in testing and Gemini 4 is in pre-training》)(56 分,21 条评论)。

跨供应商这一侧也同样热闹。u/KLAMBO365 分享了 Cursor 把个人和团队套餐使用上限翻倍的公告,而 u/Zachattackrandom(得分 36)立刻把这个利好收窄成“只适用于自家模型”(《Cursor Doubles Usage Limits for All Individual and Team Plans》)(172 分,59 条评论)。u/mackey88 贴出了一个 Code Arena WebDev 排行榜,显示 Kimi-k3 排在 Fable 和 Sol 前面(《Kimi-k3 is in the lead》)(145 分,40 条评论);而 u/rayhomme 则写出了当天最有用的一份 Kimi 实战报告:在 Claude Code 里输出质量不错,但一个他们原以为 60–90 分钟就能做完的任务,实际跑了 3 个多小时,测试后总花费还到了大约 88 美元(《Kimi-K3 in Claude Code》)(51 分,49 条评论)。就连那条反 Grok 的梗图线程,最后也变成了替 Grok 4.5 辩护:u/graeme_1988(得分 34)说,在他们的审查工作流里,它给出的计划比 Opus 或 Codex 更干净;u/Acceptable-War4836(得分 7)则说,Grok 4.5 + Composer 2.5 已经成了他们的主力(《Try Grok they said》)(173 分,75 条评论)。
讨论要点: 反复出现的问题,已经不再是“哪个模型赢了?”,而是“在这个角色、这个额度、这个价格和这个速度下,哪个模型已经够用了?”
与前日对比: 7 月 21 日已经出现了路由配方和供应商切换。7 月 22 日又补进了 Gemini 3.6 的官方材料、公开基准表、Cursor 的额度动作,以及更细的 Kimi 和 Grok 多模型栈适配报告。
1.3 控制界面、规划纪律和可检查性,成了区分“有用”和“垃圾输出”的分水岭 (🡕)¶
至少有 7 条高信号线程,讲的是同一种转变:AI 编程的价值,越来越取决于人类在周围保留了多少上下文、可见性和约束边界。数据里表现最好的工作流,不是更“凭感觉”,而是更结构化。
u/SweatyCompetition343 在交付了 30 多个 app 之后,给出了最明确的操作模型:做可复用积木、坚持一套技术栈、记录反复出现的瓶颈、集中管理 secrets,并保留一个能从任何项目继续干下去的统一入口(《I vibe coded 30+ apps in 2 years. 6 are still in production with real users. Here's what I learned.》)(263 分,75 条评论)。u/melaschasma(得分 4)又补了一层面向未来的做法:让模型现在就把功能拆成多个文件,并写好说明,以防高级模型未来变得更贵。
u/T07NAD0 则用更小的案例讲了同一课:当第一个任务从“构建这个功能”变成“先理解这个系统”时,Cursor 的表现就变好了(《Cursor got better for me when I stopped treating the prompt as the starting point》)(25 分,35 条评论)。u/Agent007_MI9(得分 3)和 u/fedekun(得分 1)明确把这叫作规范驱动开发。u/ke1lle 则给出了同一问题在 UI 上的版本:一个按钮挪 4px,结果却变成重写 flex 规则、额外改色,再加上更多破坏,这让他们更想直接在实时预览里编辑,而不是无休止地反复提示(《I told codex to move a button 4px. My ai bro rewrote the entire layout.》)(244 分,15 条评论)。
最强的安全论点来自 u/ridablellama:他们那条 skip-permissions 线程,正好把人分成了两派——一派看重完全自治,另一派只接受“完全自治,但只能在适当隔离的环境里”(《do you --dangerously-skip-permissions or not?》)(70 分,172 条评论)。u/AuditMind(得分 19)说,正确答案就是“完全自治,但只限于适当隔离的环境”;u/Front_Eagle739(得分 8)则说,一次错误的 rm -rf 以前曾经直接抹掉了他们整台 Mac,最后还是靠备份救回来。u/jaykrown 又把同样的控制论点延伸到了 IDE 设计:那些把文件浏览器和直接文本编辑藏起来的工具,实际上是在逼用户去信任自己根本没法好好检查的 AI 改动(《The growing trend of removing the ability to see the file explorer and edit text files in the IDE needs to stop》)(34 分,34 条评论)。
这一主题在文化层面更尖锐。u/CynChloe 开玩笑说,用户只给 Claude 3 个小时,它却回一句这个项目得做 3 个月(《Claude: "This project will take 3 months." Me: "You have 3 hours."》)(1561 分,66 条评论);而 u/Amazing-Bid9694 则说,自己一年的氛围编程让他们“什么都没学到”,Java 水平甚至比以前还差(《I have been vibe coding for more than a year. After 5+ projects... here is what I learned.》)(452 分,73 条评论)。这两个笑话方向相反,但都指向了同一个要求:要有更可见的结构。
讨论要点: 最有说服力的回复,并不是去要更聪明的提示词,而是要 specs、并排编辑器、沙箱、备份,以及能把改动显出来的工具。
与前日对比: 7 月 21 日还在争论 AI 辅助工作到底算不算“真正的编程”。7 月 22 日则开始争论,要让 AI 输出保持可读、可控、可复用,到底需要什么样的操作纪律。
1.4 构建者热情集中在本地替代品和智能体周边基础设施上 (🡒)¶
数据里的构建者侧依然很广,但最强的项目已经不是泛泛的“什么都能做”演示,而是狭窄工具、本地优先封装层、记忆层,以及那些要么替代某个付费 SaaS 功能、要么让另一套编程智能体更容易驾驭的运维工具。
u/Sea-Assignment6371 做了 Déjà View,用来在投入新想法前,先研究类似创业公司的前例、死亡案例和幸存竞争者(《I built a tool that tells you who already tried your startup idea, and how they died》)(879 分,225 条评论)。网站文案写着,它会“挖出那些在你之前追逐同一个想法的真实公司”,截图既展示了它的钩子——“你的点子已经有 5 具尸体”——也暴露了眼前的可靠性问题:反复出现“无法解析模型引用”的状态。u/Adulations(得分 201)说这像是在“收割点子”;u/ItsDeius(得分 62)则报了一个提示框提供器坏掉的问题。

u/mimrock 做了 MusicHammer,想用本地方案替代类似 Moises 的乐器分离服务,底层是开放的音轨分离模型,外面包了一层 MIT 许可封装(《Instrument separator app made with Fable》)(154 分,31 条评论)。公开 README 写着,这个应用完全在用户机器上运行、按需下载分离模型,并支持 Demucs、BS-RoFormer 和 Mel-RoFormer。u/don_kruger 则报告了另一种替代型胜利:Kanban Pro 下载量突破了 5000,日活大约 200,作为本地优先 Kanban 板,它的 Markdown/YAML 工单现在还能给 OpenClaw 智能体充当长期记忆层(《100% Free Kanban Board - no paywalls, no signups, no subscriptions》)(79 分,129 条评论)。

u/CrayonsFearMe 把“围着智能体再包一层智能体”这个模式推到了最远:他们发布了一份个人 AI OS 的构建指南,里面有零上下文内核、临时工作节点、Markdown 知识库、预算控制器和安全围栏,全部由一个持久编排器统筹(《I built an always-on personal AI OS that dispatches coding work across my repos and maintains its own knowledge base. I talk to it via Discord》)(20 分,17 条评论)。u/mnszurkalo 则展示了同一种本能更小、更战术化的版本:一个浮动气泡,能把当下的 UX 烦点、页面链接和精确元素一起记进文件,之后再让智能体批量清掉(《just made a floating bubble that turns my UX nitpicks into a to-do list my agent clears》)(41 分,22 条评论)。

同样的本地控制偏好,也出现在前端和运维工具里。u/yuraoak 分享了 Lizard Studio:一个本地 Chrome 扩展,在侧边栏里运行 Claude Code,并能访问当前页面的 DOM、控制台、网络、截图和测量能力(《I built a Claude Code Chrome extension for frontend work. It saves me a ton of time.》)(9 分,6 条评论)。u/muntaseer_rahman 则做了 TellMeWhenDown,从陌生访客视角去扫描线上网站,并报告 SSL、header、DNS 和暴露文件的泄漏问题(《can a stranger take your site down?》)(35 分,15 条评论)。u/Key-Scallion7406 又补上了个人经济学版本:他们用一个周末,把原本每月 23 美元的 no-code 建站工具换成了静态 Netlify 部署,但也承认,一旦联系表单坏掉,“别人的问题”在晚上 11 点又重新变成了自己的问题(《Cancelled my no code website builder after 3 years and vibecoded the replacement in a weekend》)(38 分,40 条评论)。
讨论要点: 反复出现的卖点都是“所有权”:本地优先存储、可读文件、无遥测、公开仓库、浏览器直接控制,或者公开安全扫描。速度当然重要,但可检查性更重要。
与前日对比: 7 月 21 日已经有很强的构建者热情。7 月 22 日延续了这个势头,但又进一步偏向封装层、记忆层,以及针对狭窄付费工作流的自有替代品。
2. 令人困扰的问题¶
没人信得过的权益与花费界面¶
严重性:高。最反复出现的挫败,并不只是“限额太低”,而是“我根本没法从眼前这个套餐界面判断下一步会发生什么”。u/T-Dot1992 说,Fable 在一个任务快结束时,10 分钟就烧掉了大约 80 美元额度(《Something kinda concerning about Fable》)(71 分,102 条评论);u/AdDry7339 说,一个 Team 套餐在日常工作流下 25 分钟就没了(《Someone else see increased token usages ?》)(42 分,58 条评论);u/FinalFantasiesGG 则说,一个 5 行的 HTML 修改,在撞上限额后花掉了约 4 美元额度(《Who could possibly afford to use usage credits for anything meaningful?》)(34 分,45 条评论)。u/AnimatorFun7470 又把“该切到哪个兜底模型”本身,也当成了一种负担:他们问,一旦 Fable 专属那一桶用完,Opus 还有没有值得用的理由;而回复则分成了“用 Opus 保住 Fable”和“直接切到 5.6 Sol”两派(《I've hit my Fable limit, is there any reason for Opus?》)(21 分,58 条评论)。
同样的不确定性,在 Claude 之外也存在。u/sans5z 贴出了一张 Cursor 计费界面:20 美元套餐里,“included” 花费已经到 66.25 美元,而 on-demand 还是 0;他们的问题是,这些超额部分会不会在下一个账单周期再收费(《I bought $20 plan, but my usage is crossing $60 without enabling On-demand. Will I be charged for the extra in next billing cycle?》)(19 分,24 条评论)。这说明核心挫败已经超出某一家供应商:用户越来越把模型接入当作预算路由来管理,但这些界面仍然很难把真实预算状态解释清楚。这值得做成额度解释器、支出预测器和账号状态对账工具。

当可检查界面不足时,完全自治依然让人不安¶
严重性:高。人们显然想少点点击操作,但回复一再表明,只有在自治过程可见或被沙箱隔离时,他们才愿意信任。u/ridablellama 说,跑 --dangerously-skip-permissions 会让 Claude 用起来舒服很多(《do you --dangerously-skip-permissions or not?》)(70 分,172 条评论),但 u/AuditMind(得分 19)坚持认为,正确模式应该是“完全自治,但只能在适当隔离的环境里”;u/Front_Eagle739(得分 8)则说,一次错误的 rm -rf 曾经直接抹掉他们整台 Mac,最后还是靠备份恢复。
同样的信任问题,也出现在界面设计里。u/jaykrown 认为,那些把文件浏览器和直接文本编辑拿掉的 IDE,是在要求用户去信任自己已经没法好好检查的改动(《The growing trend of removing the ability to see the file explorer and edit text files in the IDE needs to stop》)(34 分,34 条评论)。u/ke1lle 则描述了一个更小、但本质相同的版本:一个 4px 的 CSS 调整,最后变成了布局规则重写和额外的视觉回归,这也把他们推向了直接预览编辑,而不是继续写更多提示词(《I told codex to move a button 4px. My ai bro rewrote the entire layout.》)(244 分,15 条评论)。这值得做成沙箱优先的智能体、始终可见的 diff,以及可回退的实时编辑界面。
上线首日的提升,仍然和回归问题纠缠在一起¶
严重性:中等。当天几条最有意思的发布帖,几乎立刻就跟着 bug 报告或补救讨论。u/FV-The_Hammer 发起了最大的 Gemini 3.6 发布线程,但回看那条讨论里的截图,也能看到 Antigravity 在首日使用时弹出了“窗口无响应”对话框(《Gemini 3.6 LIVE in antigravity!》)(230 分,111 条评论)。u/defi_specialist 在另一条线程里夸 3.6 Flash 很强,而 u/sozturk-88(得分 11)则追问,Antigravity 卡住,会不会是 IDE 的 bug,而不是模型本身的问题(《Flash 3.6 just super good, don’t want to use pro anymore.》)(96 分,71 条评论)。
这种上线摩擦并不只发生在 Google 身上。在“caps reset”那条线程里,u/Common_Mail_861(得分 6)说,他们更老版本的 Antigravity IDE 在 Flash 更新后直接不能用了(《Gemini 3.6 Flash is out and we reset caps》)(225 分,74 条评论)。Déjà View 也在构建者侧撞上了同样的模式:u/ItsDeius(得分 62)报了 Tooltip.Provider 故障,而回看截图时,还能看到实际运行中的应用里仍有未解决的模型引用错误(《I built a tool that tells you who already tried your startup idea, and how they died》)(879 分,225 条评论)。这值得做成上线 QA、回归检测、兼容性矩阵,以及更清楚的恢复路径。

拥有替代方案,也意味着继承支持负担¶
严重性:中等。数据里那些最积极的“我自己重做了”故事,同样带着维护债。u/Key-Scallion7406 很高兴自己摆脱了每月 23 美元的 no-code 建站工具,但他们也说,一旦联系表单在晚上 11 点坏掉,这就不再是发个支持工单的问题,而成了自己的问题(《Cancelled my no code website builder after 3 years and vibecoded the replacement in a weekend》)(38 分,40 条评论)。u/Amazing-Bid9694 又把同样的担心转向了自己身上:他们说,一年的氛围编程让自己的“净编程知识”变成了负数(《I have been vibe coding for more than a year. After 5+ projects... here is what I learned.》)(452 分,73 条评论)。
最实用的对策,反而来自另一种类型的帖子。u/SweatyCompetition343 说,可复用砖块、单一技术栈,以及一种能从任何项目继续干下去的统一恢复方式,是他们能交付 30 多个 app、而不是被上下文流失淹没的关键(《I vibe coded 30+ apps in 2 years. 6 are still in production with real users. Here's what I learned.》)(263 分,75 条评论)。这值得做成重构/文档脚手架,以及能让“第一次发布之后的所有权”变得还能活下去的持久项目记忆层。
3. 人们期望的功能¶
会在烧钱前先解释清楚的额度控制器¶
这是一个很实际的需求,而且它同时表现为焦虑和临时路由行为。u/T-Dot1992 直到一个任务快做完时,10 分钟内烧掉了约 80 美元额度,才真正感受到 Fable 的额度消耗是什么样(《Something kinda concerning about Fable》)(71 分,102 条评论);而 u/FinalFantasiesGG 则说,一个 5 行的 HTML 修改就花了大约 4 美元额度(《Who could possibly afford to use usage credits for anything meaningful?》)(34 分,45 条评论)。这两条线程底下真正的诉求,并不是“给我无限用量”,而是“告诉我这个动作会打到哪一个计量器、接下来会触发什么兜底,以及我继续做下去要花多少钱”。
已经有一些局部答案了。u/rayhomme 在 Claude Code 里测试 Kimi 时,展示了一套 DevFob 账号切换工作流(《Kimi-K3 in Claude Code》)(51 分,49 条评论);而 u/sans5z 贴出的 Cursor 花费界面,仍然让他们搞不清后面会不会继续收费(《I bought $20 plan, but my usage is crossing $60 without enabling On-demand. Will I be charged for the extra in next billing cycle?》)(19 分,24 条评论)。机会评级:直接。
没有隐藏修改、隐藏文件或权限轰炸的完全自治¶
这同样是一个很实际的需求,而且人们描述它时,用的都是操作层语言,而不是哲学层语言。u/ridablellama 想要的是 --dangerously-skip-permissions 带来的便利,但最强的回复说,真正的答案是“完全自治,但只能在适当隔离的环境里”(《do you --dangerously-skip-permissions or not?》)(70 分,172 条评论)。u/jaykrown 又从 IDE 侧表达了同一个需求:用户必须能看到文件、看到 diff,并直接编辑文本,而不是把 IDE 当成一个纯提示词输入框(《The growing trend of removing the ability to see the file explorer and edit text files in the IDE needs to stop》)(34 分,34 条评论)。
一些局部界面已经开始出现。u/Annual_Area4848 突出了桌面版 Claude Code 新出的 iOS 模拟器面板(《Is this useful ?》)(568 分,43 条评论);而 u/yuraoak 则做了 Lizard Studio,把 Claude Code 放到真实页面旁边,并配上 DOM、控制台、网络、点击、截图和测量工具(《I built a Claude Code Chrome extension for frontend work. It saves me a ton of time.》)(9 分,6 条评论)。这个机会不只是更低摩擦,而是更低摩擦加上持续可检查性。机会评级:直接。
能跨项目延续、扛过重置、模型更替和人类遗忘的记忆层¶
这是一个越来越紧迫的实际需求,因为人们已经从“一个玩具仓库”走到了“很多个活跃项目”。u/SweatyCompetition343 说,维护 30 多个 app 最难的地方,是要有“一个能从你停下来的地方继续开发的入口”,然后再做出“一个覆盖所有项目的中央大脑”(《I vibe coded 30+ apps in 2 years. 6 are still in production with real users. Here's what I learned.》)(263 分,75 条评论)。u/mnszurkalo 则在交互层表达了同一个需求:烦点一出现就把它记下来,连同精确元素和页面一起附上,让智能体之后再去清空文件(《just made a floating bubble that turns my UX nitpicks into a to-do list my agent clears》)(41 分,22 条评论)。
现在已经出现了几种彼此竞争的局部答案。u/don_kruger 说,Kanban Pro 越来越多地被当成 OpenClaw 智能体的长期记忆层(《100% Free Kanban Board - no paywalls, no signups, no subscriptions》)(79 分,129 条评论);而 u/CrayonsFearMe 则发布了一整套个人 AI OS 蓝图,里面有零上下文内核、持久 Markdown 知识,以及预算控制器(《I built an always-on personal AI OS that dispatches coding work across my repos and maintains its own knowledge base. I talk to it via Discord》)(20 分,17 条评论)。机会评级:竞争型。
面向狭窄软件需求、可自己拥有的替代套件¶
这个需求一半是实际,一半带情绪。人们想停止为那些又臃肿、又限制多、又不符合自己真实工作方式的软件持续付费,但他们又不想因此变成全职维护者。u/Key-Scallion7406 用一个周末重建了一套 no-code 建站工具栈,把费用压缩到只剩域名钱,同时也承认,第一次表单坏掉时,支持责任就回到了自己头上(《Cancelled my no code website builder after 3 years and vibecoded the replacement in a weekend》)(38 分,40 条评论)。u/mimrock 则用开放模型在本地重做了一个类似 Moises 的乐器分离器,把同样的思路用在音乐练习上(《Instrument separator app made with Fable》)(154 分,31 条评论)。
人们真正想要的,似乎不是一个通用的“替代 SaaS”按钮,而是一套可重复使用的启动包:把某一个狭窄需求替换得足够好——网站、工具、小扫描器、练习软件、记忆板。像 u/muntaseer_rahman 那个公开安全扫描器这样的线程(《can a stranger take your site down?》)(35 分,15 条评论)说明,下一层机会不只是把替代品做出来,还要把原来由供应商偷偷替你兜住的那些无聊运维检查也一起交付。机会评级:竞争型。
4. 使用中的工具与方法¶
| 工具 | 类别 | 评价 | 优势 | 局限 |
|---|---|---|---|---|
| Claude Code / Fable 5 | 编程智能体 | (+/-) | 中心运行框架很强,作为编排器的信任度高,而且 Artifacts 和模拟器支持等第一方界面还在扩展(用量线程、Artifacts、iOS 模拟器) | 烧额度、套餐规则反复变化,以及意外行为,仍然是最主要的抱怨(额度、暴涨、实验) |
| Opus 4.8 | 前沿模型 | (+/-) | 是 Claude 栈里常见的兜底选项;有用户说,它能在尽量拉长 Fable 使用时间的同时保住质量(讨论) | 也有用户说,它的体验不如 Sol,更多只是 Fable 那一桶用完后的节流手段(讨论) |
| Gemini 3.6 Flash | 前沿模型 | (+/-) | 更快、比 3.5 Flash 更便宜、基准更好,而且反复被描述成日常主力模型(基准测试、发布、实战报告) | 深度和可靠性仍有争议,Pro 依然延期,而且首日回归问题立刻就出现了(延期线程、路线图) |
| Codex / GPT-5.6 Sol | 模型 + 客户端栈 | (+) | Claude 限额触顶后常见的溢出路径;被用来做审查、兜底执行,以及在更便宜套餐上跑出更高性价比(兜底线程、定价帖) | 通常是多订阅组合中的一部分,而不是单工具答案(Kimi 报告) |
| Kimi K3 | 前沿模型 | (+/-) | 在前端/WebDev 上口碑很强,主观质量也足够高,所以有人愿意把它塞进 Claude Code 会话里试(排行榜、Claude 运行框架报告) | 响应慢、API 成本高,一旦重度使用,吸引力就可能被抵消(Claude 运行框架报告) |
| Grok 4.5 | 前沿模型 | (+/-) | 搭配结构化规划/审查工作流时,经常被描述成又快、又便宜、也够有效(混合线程) | 口碑两极化仍然很重,所以梗图反弹和零散失败案例依旧常见(混合线程) |
| Cursor | IDE / 智能体客户端 | (+/-) | 当 Composer、Grok 这类自家模型扛主力时,用户一再说 20 美元套餐性价比很强(限额) | 额度提升似乎只覆盖自家模型,计费理解依旧薄弱,而且一些用户反感它越来越爱把文件和改动藏起来(计费困惑、可见性批评) |
| Auto 模式 + 沙箱隔离 | 方法 | (+) | 在不盲目信任的前提下,给出大部分“零点击”体验;很多人都把它推荐成最务实的中间路线(权限线程) | 全权限变体依然很诱人,而一旦缺少护栏,失败模式可能非常具破坏性(权限线程) |
| Caveman / RTK | 技能 / 代理方法 | (-) | Caveman 的压缩风格,可能让人更容易快速扫读智能体输出(Caveman 测试) | 实测节省远低于宣传,RTK 还被报告会剥掉 CI 输出,甚至把成本拉得更高(RTK 测试、讨论) |
| Kanban Pro | 记忆 / 协调层 | (+) | 本地优先的 Markdown/YAML 存储、内嵌终端、文件夹同步,以及越来越多被拿来当智能体记忆层的用法(构建者帖子) | 专有桌面打包方式,以及 Electron 取舍,引来了熟悉的“为什么不做成网站?”质疑(构建者帖子) |
| Lizard Studio | 浏览器侧编程智能体 | (+) | 在真实页面旁边运行 Claude Code,并提供 DOM、控制台、网络、截图和测量工具,而且都在本地跑(构建者帖子) | 需要本地 native host、浏览器权限,以及对更强大浏览器智能体界面的接受度(构建者帖子) |
| TellMeWhenDown | 运维 / 安全扫描器 | (+) | 用白话检查 SSL、headers、DNS、暴露文件,以及类似 cron 的 heartbeat 故障(构建者帖子) | 它仍然只能抓到外部访客看得到的问题,所以修复责任还是落在用户身上(构建者帖子) |
整体满意度光谱,从 Gemini 3.6 Flash、Grok 4.5 和 Cursor 自家模型栈那种“快到足以当日常主力”,一路延伸到 Claude 那套界面带来的“能力很强,但预算管得人心累”。工具层里最负面的评价,甚至不是给某个模型,而是给那些“元绕行”产品:JetBrains 的公开测试称,像 Caveman 和 RTK 这样的省 token 技巧,不是被夸大了,就是适得其反(《Gemini 3.6 Flash Benchmarks》)(232 分,106 条评论);(《Try Grok they said》)(173 分,75 条评论);(《JetBrains analyzed the CaveMan and RTK token savers, and the results are highly critical》)(207 分,59 条评论)。
共同的绕行方案,更像投资组合策略,而不是品牌忠诚:把 Fable 的溢出路由到 Sol、Kimi 或 Grok;哪怕智能体客户端把文件藏起来,也始终开着一个可见编辑器;用账号切换器或多订阅来抹平余量;再把项目记忆外置到 Markdown 看板、wiki 或按应用拆分的问题清单文件里(《I've hit my Fable limit, is there any reason for Opus?》)(21 分,58 条评论);(《Kimi-k3 is in the lead》)(145 分,40 条评论);(《100% Free Kanban Board - no paywalls, no signups, no subscriptions》)(79 分,129 条评论);(《I built an always-on personal AI OS that dispatches coding work across my repos and maintains its own knowledge base. I talk to it via Discord》)(20 分,17 条评论);(《just made a floating bubble that turns my UX nitpicks into a to-do list my agent clears》)(41 分,22 条评论)。
5. 人们在构建什么¶
| 项目 | 构建者 | 功能 | 解决的问题 | 技术栈 | 阶段 | 链接 |
|---|---|---|---|---|---|---|
| Déjà View | u/Sea-Assignment6371 | 研究围绕某个想法出现过的前辈创业公司、停运案例、幸存者和模式 | 帮助创始人别在太晚的时候才发现自己又踩进了一个已死类别 | Web 应用;技术栈未公开 | 测试版 | 网站 · 帖子 |
| MusicHammer | u/mimrock | 把歌曲拆成多条 stem,并让用户静音/solo 各部分,用于练习或卡拉 OK | 用本地工具替代类似 Moises 的订阅式工作流 | 本地应用,使用 Demucs、BS-RoFormer 和 Mel-RoFormer 模型 | Alpha | 仓库 · 帖子 |
| Kanban Pro | u/don_kruger | 本地优先的 Kanban 板,同时充当智能体记忆/工作区层 | 在不依赖 SaaS 账号的前提下,给人类和智能体提供一个持久、可检查的任务系统 | Electron、Angular/TypeScript、Node、Markdown/YAML、Chokidar、FlexSearch、Tiptap、Tailwind | 测试版 | 网站 · 仓库 · 帖子 |
| 个人 AI OS | u/CrayonsFearMe | 运行一个零上下文内核,负责路由工作、管理记忆,并派发按仓库划分的工作节点 | 把持久状态放到模型上下文窗口之外,并协调长时间运行的工作 | Discord 前端、SQLite、Git/Markdown 知识库、检索层、模型注册表、安全围栏 | Alpha | gist · 帖子 |
| Lizard Studio | u/yuraoak | 在浏览器侧边栏运行 Claude Code,并配上 DOM、控制台、网络、截图和测量工具 | 去掉前端调试与设计审查里来回截图、切标签页的开销 | Chrome MV3 扩展、本地 native host、Claude CLI、浏览器侧工具 | 测试版 | 应用商店 · 仓库 · 帖子 |
| TellMeWhenDown | u/muntaseer_rahman | 从公共可见配置错误入手扫描线上网站,并监控 uptime/heartbeat 故障 | 抓出 vibe-coded app 常常带上线的暴露文件、SSL、header 和 cron/webhook 错误 | 在线 Web 服务;技术栈未公开 | 已发布 | 网站 · 帖子 |
| UX 吐槽气泡 | u/mnszurkalo | 把页面上的烦点、页面链接和精确元素记进一个文件,之后让智能体批量清理 | 防止测试和编码会话之间,那些小 UX 问题被忘掉 | 浏览器浮层 + 按应用拆分的文件;技术栈未公开 | Alpha | 帖子 |
Déjà View 是当天最大的发布,但讨论几乎立刻裂成两个方向:信任和在线稳定性。它的产品主张很利落——在继续投入时间前,先查清失败前例——截图也把价值展示得很直观;但最强的回复讨论的,却是“收割点子”和坏掉的模型引用,而不只是创业策略本身(《I built a tool that tells you who already tried your startup idea, and how they died》)(879 分,225 条评论)。
MusicHammer、那个 no-code 网站替代故事,以及 TellMeWhenDown,指向的是同一种触发模式:用户不再想重做所有软件,但当某一个狭窄付费工作流的价格显得和任务不成比例时,他们越来越愿意把那一小块自己重做出来(《Instrument separator app made with Fable》)(154 分,31 条评论);(《Cancelled my no code website builder after 3 years and vibecoded the replacement in a weekend》)(38 分,40 条评论);(《can a stranger take your site down?》)(35 分,15 条评论)。限制不是想象力,而是构建者愿不愿意把后续的支持、下载分发、运维和调试全都接过来。
Kanban Pro、个人 AI OS 和 UX 吐槽气泡,又汇聚到另一种反复出现的构建模式:围绕短暂智能体建立持久上下文。一个产品把 Markdown 工单变成记忆,另一个把 Markdown 加 SQLite 变成编排化的智能体操作系统,最小的那个则把实时烦点变成一个以后可由模型清理的文件(《100% Free Kanban Board - no paywalls, no signups, no subscriptions》)(79 分,129 条评论);(《I built an always-on personal AI OS that dispatches coding work across my repos and maintains its own knowledge base. I talk to it via Discord》)(20 分,17 条评论);(《just made a floating bubble that turns my UX nitpicks into a to-do list my agent clears》)(41 分,22 条评论)。Lizard Studio 则贴着这个模式的边界,把更多上下文采集直接搬进了浏览器本身。
6. 新动态与亮点¶
Claude Code 离真实应用界面又近了一步¶
数据里最清楚的一项第一方控制界面变化,是桌面版 Claude Code 在对话视图旁边加上了一个 iOS 模拟器面板(《Is this useful ?》)(568 分,43 条评论)。这之所以重要,是因为同一天另外几条线程,本质上都在抱怨:用户不得不用语言描述 UI 状态,或者在看不见改动时被迫相信改动。内置模拟器会直接缩小这道缺口。

屏幕录制式技能,正在变成第一方原生能力¶
u/Due-Cup9574 把 Claude 新出的“teach Claude a skill”流程带了出来:用户先录一段短短的屏幕操作和旁白,然后把结果存成一个可复用 skill(《New in Claude Code - Teach Claude a Skill by recording your screen》)(16 分,5 条评论)。它值得注意的地方,不在于得分,而在于它改写了工作流的经济性:那些过去只能放在 README、帖子或一次性提示词里的习惯,现在可以作为产品内的可复用 artifact 被保存下来。

Artifacts 正被当作可分享的演示基础设施¶
u/Mysterious-Guide-745 认为,npm next 通道上的 Claude Code 2.1.216,已经把 Artifacts 推成了一个更完整的发布平台:支持多文件页面和 live-watch 模式(《ClaudCode just released a earthquake with Artifacts》)(122 分,59 条评论)。最有用的反应不是吹捧,而是对照:u/fischimitat(得分 7)说,他们之前已经做过一个 skill,用来生成适合用户测试的自包含演示页面;如果第一方支持到位,能省掉很多调试和胶带式拼接。
逆向本地配置,已经成了信任验证工作的一部分¶
那条 experiment-config 线程,并不只是另一条定价抱怨。它展示了用户如何把本地缓存文件、实验 key 和 GitHub issues 当成运营证据,用来解释为什么智能体行为变了(《Anthropic live testing on user caught. I DEMAND ANOTHER 100$》)(61 分,37 条评论)。这值得注意,因为它把“信任这个工具”推进成了“审计这个工具”,而这和营销界面描绘的关系,已经是另一种质变。
7. 机会在哪里¶
[+++] 额度智能与兜底编排 —— 一旦 Fable 烧额度,或者套餐界面开始说不通,用户就会立刻用替代智能体、账号切换器和手动读表来补位。最强证据横跨直接的花费惊吓、token 暴涨报告,以及跨供应商的路由绕行,而不是抽象诉求(《Something kinda concerning about Fable》)(71 分,102 条评论);(《Someone else see increased token usages ?》)(42 分,58 条评论);(《Kimi-K3 in Claude Code》)(51 分,49 条评论)。
[++] 可检查的自治界面 —— 数据表明,人们只在自治保持可见、可回退、可沙箱隔离时,才会要求更多自治。skip-permissions 争论、文件浏览器抱怨、iOS 模拟器面板,以及 Lizard Studio 这类浏览器原生界面,都指向了同一种产品形态:点击更少,但不是盲信(《do you --dangerously-skip-permissions or not?》)(70 分,172 条评论);(《The growing trend of removing the ability to see the file explorer and edit text files in the IDE needs to stop》)(34 分,34 条评论);(《I built a Claude Code Chrome extension for frontend work. It saves me a ton of time.》)(9 分,6 条评论)。
[++] 持久智能体记忆与项目连续性 —— 多项目构建者想要一个地方来恢复工作、保留决策,并把那些短暂的实时上下文观察转成排队任务。Kanban Pro、个人 AI OS 蓝图、UX 吐槽气泡,以及那个 30 多个 app 经验帖,只是从不同尺度指向了同一个需求(《I vibe coded 30+ apps in 2 years. 6 are still in production with real users. Here's what I learned.》)(263 分,75 条评论);(《100% Free Kanban Board - no paywalls, no signups, no subscriptions》)(79 分,129 条评论);(《I built an always-on personal AI OS that dispatches coding work across my repos and maintains its own knowledge base. I talk to it via Discord》)(20 分,17 条评论)。
[+] 内建运维的单用途替代套件 —— 人们愿意一次替换一个过度收费的工作流,但前提是替代品也得覆盖掉老供应商以前替你藏起来的那层无聊运维。MusicHammer、那个 no-code 网站替代故事,以及 TellMeWhenDown 说明,机会并不是抽象地“替代 SaaS”,而是“替代这一件事,并帮我继续把它跑稳”(《Instrument separator app made with Fable》)(154 分,31 条评论);(《Cancelled my no code website builder after 3 years and vibecoded the replacement in a weekend》)(38 分,40 条评论);(《can a stranger take your site down?》)(35 分,15 条评论)。
8. 要点总结¶
- 额度清晰度,如今已经是产品质量的一部分。 互动量最高的 ClaudeCode 线程,是一篇关于用量政策的恶搞帖,而多条互动量更低的线程,又用真实的额度烧损、token 暴涨和实验截图把这个笑话坐实了。(来源)
- 模型选择越来越按角色分工。 Gemini 3.6 Flash 是以快速主力的身份进入讨论的,而 Kimi、Grok、Sol 和 Cursor 的额度,则被当成同一路由栈里的替代卡位来讨论,而不是某一个“通吃型”替代品。(来源)
- 最强的工作流建议,是更结构化,而不是更玄。 最好的帖子强调的是可复用组件、动手前先检查仓库、改动始终可见,以及明确的安全边界,而不是更“有感觉”的提示词或更长的提示词。(来源)
- 构建者动能,正集中到封装层、记忆层和狭窄替代品上。 Kanban Pro、个人 AI OS 蓝图、UX 吐槽气泡、MusicHammer 和 TellMeWhenDown,做的都是扩展或约束智能体工作流,而不是去追逐泛泛的“什么都能做”演示。(来源)
- 信任正在从营销说法转向用户自证。 公开基准测试文章、本地配置截图,以及评论里贴出的 issue 线程,正越来越多地决定人们如何判断某个模型、功能或定价界面到底靠不靠谱。(来源)