> ## Documentation Index
> Fetch the complete documentation index at: https://cndoc-langchain.site/llms.txt
> Use this file to discover all available pages before exploring further.

# 测试

> 测试 LangChain 代理的策略，包括单元测试、集成测试和轨迹评估。

代理应用程序让大语言模型自行决定下一步操作以解决问题。这种灵活性非常强大，但模型的黑盒特性使得难以预测对代理某一部分的微调将如何影响整体。要构建生产就绪的代理，彻底的测试至关重要。

测试代理有几种方法：

* **单元测试**使用内存中的模拟对象，隔离地测试代理中小型、确定性的部分，以便快速、确定性地断言精确行为。
* **集成测试**使用真实的网络调用来测试代理，以确认组件协同工作、凭证和模式匹配，并且延迟可接受。
* **评估**使用评估器来评估代理的执行轨迹，可以通过确定性匹配或大语言模型裁判进行。

代理应用程序往往更依赖集成测试，因为它们将多个组件链接在一起，并且必须应对由于大语言模型的非确定性特性而导致的不稳定性。

<CardGroup cols={1}>
  <Card title="单元测试" icon="flask" href="/oss/python/langchain/test/unit-testing" arrow>
    模拟聊天模型并使用内存持久化来测试代理逻辑，无需 API 调用。
  </Card>

  <Card title="集成测试" icon="plug" href="/oss/python/langchain/test/integration-testing" arrow>
    使用真实的大语言模型 API 测试您的代理。组织测试、管理密钥、处理不稳定性并控制成本。
  </Card>

  <Card title="评估" icon="scale" href="/oss/python/langchain/test/evals" arrow>
    使用确定性匹配或大语言模型作为裁判的评估器来评估代理轨迹。
  </Card>
</CardGroup>

***

<div className="source-links">
  <Callout icon="terminal-2">
    [连接这些文档](/use-these-docs)到 Claude、VSCode 等，通过 MCP 获取实时答案。
  </Callout>

  <Callout icon="edit">
    [在 GitHub 上编辑此页面](https://github.com/langchain-ai/docs/edit/main/src/oss/langchain/test/index.mdx) 或 [提交问题](https://github.com/langchain-ai/docs/issues/new/choose)。
  </Callout>
</div>
