现场指南

深入的、参考级的文档,在实际构建后撰写。在协议成为主流之前,在生产工作负载上验证过的方法,坦诚地说明哪些是模拟的,哪些会失效。值得收藏,否则一无是处。

深度探讨 · 6 min

Jev, Clef, Haiku, or nothing?

What a decision model is, who makes them, and what happened when I put them in front of six AI models for 3,264 runs

Decision models explained with a real eval: Jev, Clef, Clef-flash and a Haiku router in front of six AI models, from Nova Micro to Fable 5.1, plus OpenAI's Luna Decisions against Jev. Cost, speed and right answers per turn.

AG-UI 深度探讨 · 18 min

AG-UI:流式传输界面,不只是答案

一份关于代理-用户交互协议的实地指南,以及当流程引擎驱动流式传输时会发生什么

一份关于AG-UI(代理到用户事件协议)的实地指南:事件剖析、传输方式、流程编排的生成式用户界面,以及它尚未解决的问题。

AP2 v0.2 深度探讨 · 16 min

AP2: 代理支付协议

在构建一个能在我睡觉时购买FIFA门票的代理时,我学到了什么

构建者对AP2 v0.2的深入探讨:授权令密码学、四方模型、威胁模型以及无人值守流程,并根据规范进行了验证。

深度探讨 · 22 min

代理实际工作的地方:来自50多个企业级构建的现场笔记

两年,七个行业,四种工作流形态。一张关于代理式AI如何发挥价值,以及普通代码仍占上风的地图。

来自50多个企业级代理式AI构建的现场笔记:代理如何根据行业和工作流形态发挥价值,以及普通代码仍占上风的地方。

深度探讨 · 22 min

控制平面:规模化治理智能体AI

智能体框架掌控内循环。必须有人掌控外循环。

智能体框架掌控内循环。您的机构掌控外循环。一种与框架无关的模式,用于在生产环境中治理智能体AI。

深度探讨 · 20 min

评估智能体系统:四轴评估法

每案例成本、字段级质量、工具跳过率和温度:如何在受控流程中运行的智能体选择模型

一种经过现场验证的评估嵌入流程的AI智能体的方法:每案例成本、字段级准确性、工具跳过率和温度敏感性。

MCP 深度探讨 · 17 min

工具契约:为什么智能体跳过你的工具

工具规范是确定性系统与概率性调用者之间的契约。大多数团队为错误的读者编写它。

为什么智能体默默地跳过工具:故障分类法、可衡量地降低跳过率的规范规则,以及用于 MCP 工具契约的确定性 0-100 linter。

A2A 深度探讨 · 22 min

A2A:智能体到智能体,构建者实战指南

来自不同供应商、团队和信任区域的智能体如何实际地相互通信,以及如何保持其可审计性

一份关于 A2A 协议的构建者实战指南:智能体卡片、任务生命周期、编排与群集、隐私边界以及重要的威胁模型。

esc