Writing topic

# Agent

沿着这个关键词,继续往里看。

10 MIN

AI Coding到底是怎么写出能用的代码的?——Spec Coding工程化全链路

AI Coding到底是怎么写出能用的代码的?——Spec Coding工程化全链路 如果你用过 Cursor 或 Claude Code 写代码,你一定体验过这种感觉: 给它一句”帮我加一个用户登录功能”,它刷刷刷生成几百行代码,看着像模像样。但你细看——密码没加密,session 没过期时间,S…

AgentLLMAI-Coding
6 MIN

Agent沙箱Token安全:怎么让工具可用但密钥不可见

Agent沙箱Token安全:怎么让工具可用但密钥不可见 很多人觉得沙箱就是安全边界。把Agent放在Docker容器里跑,隔离开文件系统和网络,便认为安全问题已解决。 但问题是: Agent需要调用外部API——GitHub、飞书、数据库、LLM。这些调用需要Token。Token放在哪里? 放环…

安全Agent沙箱
5 MIN

Agent评测:从Golden Set到业务指标

Agent评测:从Golden Set到业务指标 很多人觉得Agent评测就是”写几个测试用例,跑一下看结果对不对”。和单元测试有些相似,但本质不同。 但Agent的行为是 非确定性 的——同样的输入,今天能过明天可能就不过了。你改了一个Prompt的措辞,或者LLM provider悄悄更新了模型…

AgentLLM评测
5 MIN

Claude Managed Agents到底在做什么

Claude Managed Agents到底在做什么 初次接触 Claude Managed Agents 时,容易将其理解为 Claude Code 的 API 版本——通过 API 创建 Agent,在沙箱中执行代码并返回结果。 但查阅官方文档后会发现,它不是一个产品,而是一套 Agent基础…

AnthropicClaudeAgent
6 MIN

大规模Agent系统设计:从个人助手到十亿用户服务

大规模Agent系统设计:从个人助手到十亿用户服务 很多人第一次搭Agent系统,觉得就是”套个LLM API + 加几个工具调用”。跑通了一个Demo,问它”今天天气怎么样”能正确调用天气API,就以为Agent系统的复杂度仅此而已。 但实际情况是: 你的系统能服务1个用户、10个用户、10万个用…

Agent系统设计分布式系统
6 MIN

远程控制权限链路:手机审批如何控制桌面端Agent

远程控制权限链路:手机审批如何控制桌面端Agent 很多人觉得远程控制就是”加个WebSocket”。手机发指令,电脑执行,完成。 但真正的问题是: 当Agent在桌面端自主执行时,它可能要做危险操作——删文件、执行命令、访问数据库。你不可能让它全自动,但用户又不在电脑前。你需要一个权限审批机制——…

Agent系统设计权限系统
10 MIN

Compaction:让Agent长时间跑下去的上下文压缩术

Compaction 是 Agent 长时间运行绕不开的上下文工程问题。这篇拆解压缩 vs 记忆的区别、常见保留策略、压缩触发时机、Token 预算方法,以及为什么这些东西跟 Prompt Cache 和上下文组织方式是一体的。

AgentHarness EngineeringClaude Code
123

Ask Leslie

从本站公开文章中寻找答案。当前版本在浏览器本地检索,不上传问题,也不会编造不存在的经历。

输入一个问题,我会把你带到 Leslie 写过的相关内容。

微信联系

Leslie Zhang 的微信二维码

扫码添加 Leslie,建议备注你的名字与来意。