现场指南
深入的、参考级的文档,在实际构建后撰写。在协议成为主流之前,在生产工作负载上验证过的方法,坦诚地说明哪些是模拟的,哪些会失效。值得收藏,否则一无是处。
Jev, Clef, Haiku, or nothing?
What a decision model is, who makes them, and what happened when I put them in front of six AI models for 3,264 runs
Decision models explained with a real eval: Jev, Clef, Clef-flash and a Haiku router in front of six AI models, from Nova Micro to Fable 5.1, plus OpenAI's Luna Decisions against Jev. Cost, speed and right answers per turn.
AG-UI:流式传输界面,不只是答案
一份关于代理-用户交互协议的实地指南,以及当流程引擎驱动流式传输时会发生什么
一份关于AG-UI(代理到用户事件协议)的实地指南:事件剖析、传输方式、流程编排的生成式用户界面,以及它尚未解决的问题。
AP2: 代理支付协议
在构建一个能在我睡觉时购买FIFA门票的代理时,我学到了什么
构建者对AP2 v0.2的深入探讨:授权令密码学、四方模型、威胁模型以及无人值守流程,并根据规范进行了验证。
代理实际工作的地方:来自50多个企业级构建的现场笔记
两年,七个行业,四种工作流形态。一张关于代理式AI如何发挥价值,以及普通代码仍占上风的地图。
来自50多个企业级代理式AI构建的现场笔记:代理如何根据行业和工作流形态发挥价值,以及普通代码仍占上风的地方。
控制平面:规模化治理智能体AI
智能体框架掌控内循环。必须有人掌控外循环。
智能体框架掌控内循环。您的机构掌控外循环。一种与框架无关的模式,用于在生产环境中治理智能体AI。
评估智能体系统:四轴评估法
每案例成本、字段级质量、工具跳过率和温度:如何在受控流程中运行的智能体选择模型
一种经过现场验证的评估嵌入流程的AI智能体的方法:每案例成本、字段级准确性、工具跳过率和温度敏感性。
工具契约:为什么智能体跳过你的工具
工具规范是确定性系统与概率性调用者之间的契约。大多数团队为错误的读者编写它。
为什么智能体默默地跳过工具:故障分类法、可衡量地降低跳过率的规范规则,以及用于 MCP 工具契约的确定性 0-100 linter。
A2A:智能体到智能体,构建者实战指南
来自不同供应商、团队和信任区域的智能体如何实际地相互通信,以及如何保持其可审计性
一份关于 A2A 协议的构建者实战指南:智能体卡片、任务生命周期、编排与群集、隐私边界以及重要的威胁模型。