智能体推理
AgentX
也称为 AgentX 基准测试、AgentX 场景
先用大白话
AgentX 是 InferenceX 用来测试完整长上下文、多轮编码智能体会话的工作负载。
技术定义
AgentX 是 InferenceX 的智能体推理基准测试场景,其工作负载形状来自自愿提供的编码智能体轨迹,并在移除原始内容后构建。
工程细节
AgentX 使用确定性合成 token 重建会话结构。回放会保留请求长度、轮次间隔、共享前缀增长、工具等待以及主 agent 与 subagent 的依赖关系;原始提示词、生成代码和工具 payload 不会进入测试数据。推理栈只接收请求模式。
为什么重要
长上下文考验 KV cache 容量,重复前缀考验 cache 复用,分支时序则考验请求调度。这些影响在短小独立请求中较少出现。最终曲线反映推理系统在智能体流量下的整体表现。
如何在 InferenceX 中解读
具备对应数据的模型默认显示 Agentic 场景。比较 AgentX 结果时,应使用兼容设置下的其他 AgentX 运行,并同时查看吞吐量、延迟与交互性。固定序列场景适合分析传统请求流。