2026年8月19日·12 分钟阅读面向 LLM 推理的 Agentic Benchmark:指标与方法Agent Benchmark 如何回放长上下文、多轮工作负载,并测量延迟、吞吐量、cache 行为与推理服务成本benchmarkagentsagenticinferencelatencythroughput
2026年8月19日·6 分钟阅读Agentic 工作负载简述多轮会话、长上下文与近乎完全的 prefix 复用,让 agentic 推理成为一个系统问题,也改变了基准测试需要测量的内容agenticagentsagentxbenchmarkinference