摘要
Google 为 ADK 带来原生实时评估能力,可用模拟用户以音频驱动实时语音智能体、对语音回复打分,并在与文本智能体相同的评估循环中完成。示例采用三个基于 gemini-live-2.5-flash-native-audio 的智能体组成工作流,支持对话场景与固定对话两种测试用例,内置 NOVICE 等用户人设,并以 max_allowed_invocations 限制总轮数。
Google 为 ADK 带来原生实时评估能力,可用模拟用户以音频驱动实时语音智能体、对语音回复打分,并在与文本智能体相同的评估循环中完成。示例采用三个基于 gemini-live-2.5-flash-native-audio 的智能体组成工作流,支持对话场景与固定对话两种测试用例,内置 NOVICE 等用户人设,并以 max_allowed_invocations 限制总轮数。