资源截图
MP4 |视频:h264,1920×1080 |音频:AAC,44.1 KHz
语言:英语 |时长:2小时14米
你将学到什么
- 从头开始构建一个可用的 Claude Agent SDK 支持代理并测量其实际任务成功率:基线为 56%,最终为 88%
- 构建一个评估工具,根据固定的黄金集对每次运行进行评分,而不是手动评分,并捕获干净的退出代码隐藏的真正错误
- 设计最低权限工具和上下文包,在不更改底层模型的情况下将任务成功率从 56% 提高到 84%
- 添加可在硬代币预算内跨会话保存的内存,以及可捕获看起来不错但失忆的代理的一致性判断
- 应用三种成本控制(缓存、模型路由和预算上限),并衡量哪些成本真正收回成本,哪些成本使账单变得更糟
- 为无头代理提供安全层,可承受 8 次真实攻击、可观察性跟踪和真实事件响应,然后重用该架构
要求
- 能够轻松读写基本 TypeScript
- 已安装终端和 Node.js
- Anthropic API 密钥(免费密钥足以遵循)
- 无需具备构建 AI 代理的经验
描述
本课程使用 Claude Agent SDK 从头到尾构建一个真正的生产 AI 代理。您会看到单个支持代理的构建、测量和交付,一个又一个讲座,每个数字都来自实际运行收据而不是幻灯片。
一切都是从诚实开始的。第一个版本是一个夜间代理,可以回答真正的支持请求,并得到 56% 的正确率。从那里开始,每个讲座都会改变一件事:工具、评估工具、上下文、内存、子代理、成本控制、安全性、部署和可观察性。然后它衡量这个改变的实际价值。
大多数讲座都报告获胜。至少一份报告指出,每个人都建议的解决方案使账单变得更糟。两者都会显示在屏幕上,并附有收据,因为仅显示胜利的课程并不会教您生产的实际运作方式。
该课程还映射到克劳德认证开发人员 (CCDV-F) 认证蓝图。代理循环、工具设计、评估、上下文工程、内存、子代理、成本、安全性和部署按照考试预期的顺序进行介绍,构建为工作代码而不是幻灯片。
是什么让这门课程与众不同:
- 屏幕上的每个指标均来自针对一组固定支持票证的分级运行,而不是手动输入
- 一个配套的 GitHub 存储库,每个讲座都有一个检查点分支,因此您可以自己运行代理的每个版本,并根据自己的收据检查数字
- 至少有一次讲座展示了一种流行的最佳实践的失败,并用真实的数字来展示,而不是只展示有效的方法
- 完整的工作评估工具、成本保护和安全层,您可以从第一天起重复使用来冷启动第二个代理
- 专为已经了解基本 TypeScript 的开发人员而构建。不假设之前有代理构建经验
到最后,代理稳定地保持了 88% 的任务成功率,并配备了有效的评估工具、成本防护、已在摄像机上受到攻击并保持的安全层,以及可供下一个代理重用的完整架构。
您需要 TypeScript 和终端。一切都是从公共配套存储库逐个分支构建的,因此您可以自己运行代理的每个版本,而不用相信我的话。
这门课程适合谁
使用过 Claude Agent SDK 或 Claude 代码并希望了解演示与可在生产中运行的内容有何区别的开发人员,任何准备 Claude 认证开发人员 (CCDV-F) 认证的人,希望将概念作为工作代码,而不仅仅是考试理论,拥有或将拥有生产中的 AI 代理并需要一本用于评估、成本、安全性和事件响应的工作手册的工程师


评分及评论
暂无评分
来评个分数吧