GPT 降价 80%,GLM Coding Plan 却涨了?AI Coding 的真实成本,不能只看 Token
GPT-5.6 Luna 降价 80%,GLM Coding Plan 却提高月付门槛。两家公司其实都在使用 API 与订阅双轨、模型分级、缓存折算和时间窗口。本文从两套计费体系出发,拆解 AI Coding 的真实成本。
Writing topic
沿着这个关键词,继续往里看。
GPT-5.6 Luna 降价 80%,GLM Coding Plan 却提高月付门槛。两家公司其实都在使用 API 与订阅双轨、模型分级、缓存折算和时间窗口。本文从两套计费体系出发,拆解 AI Coding 的真实成本。
Superpowers 解决的是“Agent 要不要先找流程”的纪律问题,Matt Pocock 这套 Skills 解决的是“流程本身是不是工程化”的问题。它不是全量替代,而是替代那层最常用的流程纪律层。
AI Coding到底是怎么写出能用的代码的?——Spec Coding工程化全链路 如果你用过 Cursor 或 Claude Code 写代码,你一定体验过这种感觉: 给它一句”帮我加一个用户登录功能”,它刷刷刷生成几百行代码,看着像模像样。但你细看——密码没加密,session 没过期时间,S…
Agent沙箱Token安全:怎么让工具可用但密钥不可见 很多人觉得沙箱就是安全边界。把Agent放在Docker容器里跑,隔离开文件系统和网络,便认为安全问题已解决。 但问题是: Agent需要调用外部API——GitHub、飞书、数据库、LLM。这些调用需要Token。Token放在哪里? 放环…
Agent评测:从Golden Set到业务指标 很多人觉得Agent评测就是”写几个测试用例,跑一下看结果对不对”。和单元测试有些相似,但本质不同。 但Agent的行为是 非确定性 的——同样的输入,今天能过明天可能就不过了。你改了一个Prompt的措辞,或者LLM provider悄悄更新了模型…
Claude Managed Agents到底在做什么 初次接触 Claude Managed Agents 时,容易将其理解为 Claude Code 的 API 版本——通过 API 创建 Agent,在沙箱中执行代码并返回结果。 但查阅官方文档后会发现,它不是一个产品,而是一套 Agent基础…
大规模Agent系统设计:从个人助手到十亿用户服务 很多人第一次搭Agent系统,觉得就是”套个LLM API + 加几个工具调用”。跑通了一个Demo,问它”今天天气怎么样”能正确调用天气API,就以为Agent系统的复杂度仅此而已。 但实际情况是: 你的系统能服务1个用户、10个用户、10万个用…
姚顺雨提出"AI下半场"一年后,首次在腾讯公开解读。从方法论成熟到"寻找好问题",从混元3的苦活到coding agent的图灵完备性——腾讯凭什么说下半场才刚开始?
远程控制权限链路:手机审批如何控制桌面端Agent 很多人觉得远程控制就是”加个WebSocket”。手机发指令,电脑执行,完成。 但真正的问题是: 当Agent在桌面端自主执行时,它可能要做危险操作——删文件、执行命令、访问数据库。你不可能让它全自动,但用户又不在电脑前。你需要一个权限审批机制——…
Compaction 是 Agent 长时间运行绕不开的上下文工程问题。这篇拆解压缩 vs 记忆的区别、常见保留策略、压缩触发时机、Token 预算方法,以及为什么这些东西跟 Prompt Cache 和上下文组织方式是一体的。