用 vibe coding 替换企业 SaaS:省下订阅费却花了 1.5 万到 2 万美元
作者所在公司想用 AI 自研工具替换一个每月 200 美元、支持 200 多个应用的同步类 SaaS,结果开发约 1 个月、支持与修 bug 又花 1 个月,同步 bug 还导致公司多数产品在批发网站上显示缺货数周,估计损失 1 万美元销售额。
作者所在公司想用 AI 自研工具替换一个每月 200 美元、支持 200 多个应用的同步类 SaaS,结果开发约 1 个月、支持与修 bug 又花 1 个月,同步 bug 还导致公司多数产品在批发网站上显示缺货数周,估计损失 1 万美元销售额。
作者在单张 AMD MI300X 上用 vLLM ROCm 版跑 Qwen2.5 7B/32B/72B,按 $2.99/GPU-hr 计价,BF16 基线为 7B $0.227/M、32B $0.77/M、72B $1.67/M 输出 token。
推荐理由:作者在 MI300X 上实测 FP8 量化,发现按 token 计费会掩盖模型输出退化成乱码的问题,并给出可复用的验证方法。
一名用户续订 OpenAI Codex 的 5x 套餐并被扣款 $100 后,打开 Codex 发现周用量仍显示 0%,额度并未因付费而重置。他意识到此前的额度重置已把周期推移,只能等 Tibo 再次手动重置或再等 4-5 天自然恢复;若想立刻用上算力,本应先取消再重新订阅。他称退款机器人判定其不符合退款条件,表示打算再用一个月 Computer use 后就不再关注 GPT。
有用户反映 Claude Pro 免费试用周期间 Opus 5.5 在 medium 和 high 档位下用量充裕,5 小时窗口几乎用不完;付费后同样使用 Opus 5.5 high,约一小时就消耗了 5 小时窗口的 90% 和每周用量的约 16%,质疑免费周后限制被下调。
一名付费 20x 的 Claude 用户反映,自 Sonnet 和 Opus 5.5 发布后,几乎每个任务都会消耗约 1% 用量,2 小时设计工作就用掉 30% 额度。该用户称已为 Claude 累计投入近 2400 美元,如今不得不每周四到周日改用 Codex 的 plus 计划,并认为 Claude 在用量上难以胜过 Codex,但在设计与输出质量上仍占优。
用户在 Claude Code 中以 API 认证方式使用 Opus 5.5(开启 1 小时 TTL 缓存和 ultracode 模式)跑了两轮会话,最终花费近 39 美元。但 /usage 显示 Haiku 承担了主要推理,包括 4.1m 输入和 204 次网页搜索,用户质疑为何付费使用 Opus 却由 Haiku 完成核心工作。
有用户反映在 OpenAI 模型选择器中选中 GPT-6 Astra Extra High,实际却被路由到 GPT 5.6 Luna LOW,两条提示词消耗 7000 credits(280 美元)。该用户称从未在 Claude 上遇到此类问题,并质疑为何不提供模型路由提醒。
有用户查阅 Claude Pro 欧洲区服务条款后发现,其条款似乎排除了商业用途,而该用户正用 ChatGPT 和 Mistral 订阅开发潜在商业产品原型。他想评估 Claude Pro,但不想为 Claude Teams 的两个席位付费,因此询问是否有办法在订阅制下绕开这一限制。
一位 Codex Pro 20x 订阅用户反映,额度调整后 20x 实际被降到 10x,其常驻助手 dot 还因“preview limit”在夜间中断工作。dot 事后无法说明该配额大小、重置频率,也未确认是否与 Codex 额度共用,连重试时间都没标时区。该用户要求给出明确限额、可见的用量仪表和中断前预警,并询问是否有人找到这一限制的官方文档。
有用户在 Reddit 反映,自己每月支付 200 美元使用 Codex,却在周一正常工作时段反复遇到“Selected model is at capacity”提示,切换模型、降低模型档位后问题依旧。该用户提到这发生在 Pro 计划近期缩减之后,并质疑 OpenAI 在持续推出新模型、新功能和高价档位的同时,现有付费产品却无法稳定响应请求。
作者用 Codex 和 GPT-5.5、GPT-5.6 Sol 从零开发远程访问工具,第一版完全交给 AI 决定架构和代码,结果项目超过 12 万行仍无法运行,修一处 bug 又引入新问题。
作者发现 Cursor 在 2026 年 7 月 31 日撤下了 Usage 页面的美元金额,只保留 token 数和 Included 标记,连历史记录也被追溯清零。
有用户自建 AI 中转发现,Codex 20x 订阅请求的 gpt-6-astra 实际被路由到 gpt-5.6-luna,且返回的模型 ID 未作修改。该用户称 plus 用户似乎不受影响,问题主要集中在 Pro 的 20x 订阅。另有用户从官方模型调用统计中也看到不少 luna 记录,但自己并未使用过 luna。
ETH Zurich 团队用带与不带 AGENTS.md 的测试项目跑编码智能体,发现提供上下文文件通常不提升任务成功率,推理成本平均增加超过 20%,该结论在不同 LLM、编码智能体和 LLM 生成与开发者提交的上下文文件上都成立。
OpenCode Go 套餐的 DeepSeek-V4-Flash 额度缩水 88%,变为每月等效 15 美元,双倍额度活动也已结束。用户反映该套餐原本专为 DS Flash 设计,如今性价比大幅下降,且 OpenCode 中的 DeepSeek 模型实际调用官方 API,需勾选“允许使用托管于中国的模型”才能使用。