UiPath Documentation
test-cloud
latest
false
Test Cloud 管理员指南
重要 :
新发布内容的本地化可能需要 1-2 周的时间才能完成。

配置 LLM

AI Trust Layer 中的 LLM 配置选项,用于将自定义或基于订阅的大型语言模型连接到 Test Cloud 服务。

LLM 配置选项卡可让您集成现有 AI 订阅,同时维护 UiPath™ 提供的治理框架。您可以:

  • 替换 UiPath LLM 订阅:将 UiPath 管理的订阅替换为您自己的订阅,前提是这些订阅与 UiPath 产品已支持的相同模型系列和版本匹配。这样就可以将 UiPath 托管模型与订阅的模型无缝交换。
  • 添加自己的 LLM:使用满足产品兼容性条件的任何 LLM。为确保集成顺利进行,您选择的 LLM 必须通过通过探测器调用启动的一系列测试,然后才能在 UiPath 生态系统中使用。
备注:

对 UiPath 托管模型和/或 LLM 配置的访问权限取决于您使用的云平台。有关详细信息,请参阅Test Cloud 功能可用性。

配置 LLM 可保留 AI Trust Layer 的大多数治理优势,包括通过 Automation Ops 执行策略和详细的审核日志。但是,模型治理策略专为由 UiPath™ 托管的 LLM 设计。

这意味着,如果通过 AI Trust Layer 策略禁用特定模型,该限制仅适用于该模型的 UiPath 托管版本。您自己配置的同一类型模型不受影响。

在利用该选项以使用自己的 LLM 或订阅时,请牢记以下几点:

  • 兼容性要求:您选择的 LLM 或订阅必须与 UiPath 产品支持的模型系列和版本保持一致。
  • 设置:确保在自定义设置中正确配置和维护所有必需的 LLM。如果有任何组件缺失、过期或配置不正确,您的自定义安装可能会停止运行。在这种情况下,系统将自动还原为 UiPath 托管的 LLM,以确保服务的连续性,除非通过 Automation Ops 策略关闭 UiPath LLM。
  • 节省成本:如果您的自定义 LLM 设置完整、正确并满足所有必要要求,您可能符合降低消耗率的条件。有关详细信息,请参阅客户托管模型的消耗率。

许可​

LLM 配置可在以下许可计划中使用:

  • Unified Pricing:社区版、企业版平台、Standard Platform、Basic Platform、App Test Platform Enterprise、App Test Platform Standard。
  • Flex:高级平台,Flex 标准平台。

如何路由 LLM 请求​

来自 UiPath 产品的每个 LLM 调用都会通过 AI Trust Layer LLM 网关,然后再到达模型,无论模型是 UiPath 托管的还是您自己的模型。下图显示了可用于您自己的模型的连接模式:直接连接到可公开访问的提供程序、与托管在私有网络中的模型建立通过Relay 中介的连接,以及用于您自己的 AI 网关背后的模型的自定义连接器。

通过 Integration Service 直接连接​

通过直接连接,产品会将请求发送到 LLM 网关,网关通过您为提供程序创建的 Integration Service 连接路由请求。连接将请求跨越边界进入提供程序的域,响应则沿同一路径返回。

网关会停留在两个方向的路径中,因此策略强制执行和审核日志记录适用于每次调用,即使模型是您的模型。

通过 Relay 建立私有网络连接​

如果您的模型托管在本地或在没有公共端点的私有网络中,则 Relay会提供指向该模型的连接。LLM 网关和 Integration Service 的行为与直接连接中的行为相同。然后,UiPath 中继基础架构通过出站隧道转发请求,网络内的中继客户端会保持打开状态,并且客户端会在本地调用您的模型。

对于此连接模式,在创建 Integration Service 连接时,必须在 Relay 组下注册模型端点,并选择“私有”作为连接类型。有关详细信息,请参阅使用 Relay 。

AI 网关通过自定义连接器建立的连接​

如果您的模型位于您自己的 AI 网关后面,或公开了没有内置连接器支持的 API,则自定义 Integration Service 连接器会桥接这两种格式。LLM 网关发送和接收标准请求和响应格式,连接器会在该格式与网关所需的格式之间进行双向转换。有关详细信息,请参阅“通过 AI Trust Layer 连接自定义 LLM” 。

设置 LLM 配置​

LLM 配置依赖Integration Service与您自己的模型建立连接。您可以创建与以下提供程序的连接:

  • Azure Open AI
  • OpenAI
  • Amazon Web Services
  • Anthropic Claude
  • Google Vertex
  • 符合 Open AI V1 要求的 LLM – 使用此选项可连接到 API 遵循 OpenAI V1 标准的任何 LLM 提供程序。 有关详细信息,请参阅《符合 OpenAI V1 要求的 LLM 连接器》文档。
    备注:

    要使用 Integration Service 连接,必须将Integration Service 出站 IP 范围添加到允许列表中。

要设置新连接,请执行以下步骤:

1. 创建 Integration Service 连接​

  1. 在Integration Service中,创建与 LLM 提供程序的连接。
  2. 选择用于存储连接的文件夹。
  3. 根据所选连接器的要求完成身份验证。
    备注:

    您选择的文件夹将同时控制安全性和可见性。为防止未经授权的访问,请在私有的非共享文件夹中创建 Integration Service 连接。但是,请注意,模型可见性取决于对此文件夹的访问权限。如果管理员无权访问该流程,则关联的模型配置将不会显示在列表中。

2. 添加新的 LLM 配置​

  1. 导航到“管理” > “AI Trust Layer” > “LLM 配置” 。
  2. 选择“租户” 。
  3. 选择“添加配置” 。
  4. 选择产品(例如智能体)和功能(例如设计、评估和部署)。
  5. 选择“连接文件夹” 。

3. 配置模型​

在“模型配置”部分中,填写以下字段:

  • LLM 名称– 该字段支持两种配置选项,具体取决于您的用例:
    • 从列表中选择模型 –从预定义列表中选择模型会将 UiPath 管理的 LLM 订阅替换为您自己针对同一模型的订阅。此方案称为“自带订阅 (BYOS)” 。
    • 添加自定义别名 – 输入自定义名称可让您配置未包含在该产品预定义的推荐模型列表中的模型。 此场景称为“自带模型 (BYOM)”。
      备注:

      “添加自定义别名”选项仅适用于支持自定义模型的产品。要了解哪些产品支持自定义模型,请参阅下表。

  • API 类型– LLM 支持的 API 端点(例如,打开 AI 聊天补全)。这必须与提供程序公开的端点匹配。
  • 连接器– Integration Service 连接器(例如 Microsoft Azure OpenAI、Amazon Web Services)。
    • 如果您有权访问 AI Trust Layer 的自定义连接器(目前可应企业客户请求提供),您还可以选择“创建自定义连接器” ,以通过连接器生成器使用预定义的模板。有关详细信息,请参阅“通过 AI Trust Layer 连接自定义 LLM” 。
  • 连接– 之前创建的特定 Integration Service 连接。如果没有可用连接,请在 Integration Service 中创建连接。
  • LLM 标识符– 模型标识符与 LLM 订阅中显示的完全相同。
    • 对于 Azure 托管的模型:输入模型部署名称/标识符。
    • 对于 AWS Bedrock 跨区域推理:输入推理配置文件 ID。您必须在模型 ID 的前面加上区域代码,例如: eu.anthropic.claude-3-5-sonnet-20240620-v1:0 。
    • 对于其他提供程序:使用订阅中定义的模型名称。
备注:

配置您自己的 LLM 时,您可以选择限制可在组织中使用的大型语言模型(LLM)。如果想确保仅使用自定义模型,则可以通过应用AI Trust Layer 策略来禁用 UiPath 托管的第三方模型 。请查看 AI Trust Layer 策略文档中的“模型”部分。

4. 验证并保存​

  1. 选择“测试配置”以验证端点是否可访问。

    • 平台验证连接。
    • 您有责任确保配置正确的模型。
  2. 如果验证成功,请选择“保存”激活配置。

管理现有 LLM 连接​

您可以对现有连接执行以下操作:

  • 检查状态– 验证 Integration Service 连接的状态。此操作可确保连接处于活动状态并正常运行。
  • 编辑– 修改现有连接的任何参数。
  • “禁用” – 暂时暂停连接。禁用后,该连接在列表中仍可见,但不会路由任何调用。您可以在需要时重新启用连接。
  • 删除– 从系统中永久删除连接。此操作会禁用连接并将其从列表中删除。

为产品配置 LLM​

每个产品都支持特定的大型语言模型 (LLM) 和版本。使用下表确定您的产品支持的型号和版本。

您可以使用以下提供程序之一连接自己的 LLM:Amazon Web Services、Google Vertex、Microsoft Azure OpenAI 或符合 OpenAI V1 要求。请按照上一节中列出的步骤创建连接。

备注:

文件支持:部分产品功能依赖配置的 LLM 端点来处理上传的文件。使用自定义 LLM 配置时,对文件格式的支持取决于提供程序、模型系列、模型版本和 API 类型。在启用基于文件的功能之前,请验证所选模型是否支持所需的文件格式。有关产品特定的要求,请参阅相关产品文档,例如《Analyze Files for Agents》。

您必须配置的模型数量取决于产品和功能:

  • 对于具有可选模型的功能(您可选择使用哪个模型),您可以配置一个或多个模型;未配置的模型将继续使用 UiPath 托管的订阅。
  • 对于具有固定模型集的功能(其中功能使用预先确定的模型集),必须配置所有模型才能使功能正常运行;部分配置无效。
产品 支持自定义模型 功能 LLM 主要 LLM 版本
智能体1 是 设计、评估和部署 Google
  • gemini-3.7-flash
  • gemini-3.5-flash
  • gemini-3.5-flash-lite
  • Gemini-2.5-Pro
  • gemini-2.5-flash
OpenAI
  • gpt-5.6-sol
  • gpt-5.6-terra
  • gpt-5.6-luna
  • gpt-5.5-2026-04-23
  • gpt-5.4-mini-2026-03-17
  • gpt-5.4
  • gpt-5.2-2025-12-11
  • gpt-5.1-2025-11-13
  • gpt-5-2025-08-07
  • gpt-5-mini-2025-08-07
  • gpt-4.1-2025-04-14
  • gpt-4.1-mini-2025-04-14
  • gpt-4o-2024-11-20
  • gpt-4o-2024-08-06
  • gpt-4o-mini-2024-07-18
  • gpt-4o-2024-05-13 —即将移除: 2026-09-30 —替换: gpt-5.1-2025-11-13
Anthropic
  • anthropic.claude-sonnet-5
  • Anthropic.claude-opus-4-8
  • anthropic.claude-opus-4-7
  • anthropic.claude-sonnet-4-6
  • anthropic.clade-opus-4-6-v1
  • anthropic.clade-haiku-4-5-20251001-v1:0
  • anthropic.claude-sonnet-4-5-20250929-v1:0
  • anthropic.claude-sonnet-4-20250514-v1:0—即将移除: 2026-10-13 —替换: anthropic.claude-sonnet-4-6
防护机制 Google
  • gemini-3.7-flash
  • gemini-3.5-flash
  • gemini-3.5-flash-lite
  • Gemini-2.5-Pro
  • gemini-2.5-flash
OpenAI
  • gpt-5.6-sol
  • gpt-5.6-terra
  • gpt-5.6-luna
  • gpt-5.5-2026-04-23
  • gpt-5.4-mini-2026-03-17
  • gpt-5.4
  • gpt-5.2-2025-12-11
  • gpt-5.1-2025-11-13
  • gpt-5-2025-08-07
  • gpt-5-mini-2025-08-07
  • gpt-4.1-2025-04-14
  • gpt-4.1-mini-2025-04-14
  • gpt-4o-2024-11-20
  • gpt-4o-2024-08-06
  • gpt-4o-mini-2024-07-18
Anthropic
  • anthropic.claude-sonnet-5
  • Anthropic.claude-opus-4-8
  • anthropic.claude-opus-4-7
  • anthropic.claude-sonnet-4-6
  • anthropic.clade-opus-4-6-v1
  • anthropic.clade-haiku-4-5-20251001-v1:0
  • anthropic.claude-sonnet-4-5-20250929-v1:0
Autopilot 是 聊天 Anthropic
  • claude-haiku-4-5@20251001
  • claude-opus-4-6
  • Claude Opus-4-7
  • claude-opus-4-8
  • claude-opus-5
  • claude-sonnet-4-5@20250929
  • claude-sonnet-4-6
  • anthropic.claude-sonnet-5
  • Anthropic.claude-opus-4-8
  • anthropic.claude-opus-4-7
  • anthropic.claude-sonnet-4-6
  • anthropic.clade-opus-4-6-v1
  • clade-opus-4-5@20251101
  • anthropic.clade-haiku-4-5-20251001-v1:0
Fireworks AI
  • fw-kmi-k3
  • fw-kmi-k2.7-code —即将移除: 2026-09-30 —替换: fw-kmi-k3
  • fw-kmi-k2.6
OpenAI
  • gpt-5.6-sol
  • gpt-5.6-terra
  • gpt-5.6-luna
  • gpt-5.5-2026-04-23
  • gpt-5.4-mini-2026-03-17
  • gpt-5.4-2026-03-05
Google
  • gemini-3.6-flash
  • gemini-3.5-flash
  • gemini-3.1-flash-image
  • Gemini-3.1-Pro-Preview
  • gemini-3-flash-preview
  • Gemini-2.5-Pro
  • gemini-2.5-flash
代 Google
  • Gemini-2.5-Pro
  • gemini-2.5-flash
  • gemini-2.5-flash-lite
  • Gemini-embedding-001
适合所有人的 Autopilot 是 聊天 Anthropic
  • anthropic.claude-sonnet-4-5-20250929-v1:0
    • 替代模型: gemini-2.5-flash (Google)
    • 替代模型: gpt-4o-2024-11-20 (OpenAI)
OpenAI
  • gpt-4.1-mini-2025-04-14
    • 替代模型: gemini-2.5-flash (Google)
    • 替代模型: gpt-4o-mini-2024-07-18 (OpenAI)
编码智能体 是 调用 LLM Google
  • gemini-3.7-flash
  • gemini-3.5-flash-lite
  • Gemini-2.5-Pro
  • gemini-2.5-flash
OpenAI
  • gpt-5.6-sol
  • gpt-5.6-terra
  • gpt-5.6-luna
  • gpt-5.1-2025-11-13
  • gpt-5-2025-08-07
  • gpt-5-mini-2025-08-07
  • gpt-4.1-2025-04-14
  • gpt-4.1-mini-2025-04-14
  • gpt-4o-2024-05-13 —即将移除: 2026-09-30 —替换: gpt-5.1-2025-11-13
  • text-embedding-3-large
  • text-embedding-ada-002
Anthropic
  • anthropic.claude-sonnet-5
  • anthropic.claude-sonnet-4-6
  • anthropic.clade-haiku-4-5-20251001-v1:0
  • anthropic.claude-sonnet-4-5-20250929-v1:0
  • anthropic.claude-sonnet-4-20250514-v1:0—即将移除: 2026-10-14 —替换: anthropic.claude-sonnet-4-6
上下文基础 是 高级提取 Google
  • gemini-2.5-flash
批量转换 Google
  • gemini-2.5-flash
  • gemini-2.5-flash-lite
使用网页搜索进行批量转换 Google
  • gemini-2.5-flash
  • gemini-2.5-flash-lite
DeepRAG Google
  • gemini-2.5-flash
嵌入 Google
  • Gemini-embedding-001
GenAI Activities 是 构建、测试和部署 OpenAI
  • gpt-5.6-sol
  • gpt-5.5-2026-04-23
  • gpt-5.4-mini-2026-03-17
  • gpt-5.4-2026-03-05
  • gpt-5.2-2025-12-11
  • gpt-5.1-2025-11-13
  • gpt-5-2025-08-07
  • gpt-5-mini-2025-08-07
  • gpt-5-nana-2025-08-07
  • gpt-4o-2024-11-20
  • gpt-4o-mini-2024-07-18
  • gpt-4o-2024-05-13 —即将移除: 2026-09-30 —替换: gpt-5.1-2025-11-13
Anthropic
  • anthropic.claude-sonnet-4-6
  • anthropic.clade-opus-4-6-v1
  • clade-opus-4-5@20251101
  • anthropic.clade-haiku-4-5-20251001-v1:0
  • anthropic.claude-sonnet-4-5-20250929-v1:0
  • anthropic.claude-sonnet-4-20250514-v1:0—即将移除: 2026-10-13 —替换: anthropic.claude-sonnet-4-6
Google
  • gemini-3.5-flash
  • Gemini-2.5-Pro
  • gemini-2.5-flash
Healing Agent 是 工作流恢复 Google
  • gemini-2.5-flash
OpenAI
  • gpt-4o-2024-08-06
用户界面自动化 是 ScreenPlay OpenAI
  • gpt-5.6-sol
  • gpt-5.6-terra
  • gpt-5.6-luna
  • gpt-5.5-2026-04-23
  • gpt-5.4-mini-2026-03-17
  • gpt-5.4-2026-03-05
  • gpt-5-2025-08-07
  • gpt-5-mini-2025-08-07
  • Computer-use-preview-2025-03-11
  • gpt-4.1-2025-04-14
  • gpt-4.1-mini-2025-04-14
Google
  • gemini-3.6-flash
  • gemini-3-flash-preview
  • gemini-2.5-flash
Anthropic
  • anthropic.claude-sonnet-4-5-20250929-v1:0
语义 活动 OpenAI
  • gpt-5.4-mini-2026-03-17
  • gpt-5-mini-2025-08-07
  • gpt-4.1-2025-04-14
  • gpt-4.1-mini-2025-04-14
Google
  • gemini-3-flash-preview
  • gemini-2.5-flash
语义选取器 Google
  • gemini-2.5-flash
Test Manager 是 Autopilot 搜索 Anthropic
  • anthropic.claude-sonnet-4-5-20250929-v1:0
OpenAI
  • gpt-5.1-2025-11-13
  • gpt-4o-2024-11-20
Google
  • Gemini-2.5-Pro
  • gemini-2.5-flash
查找过时的测试 Anthropic
  • anthropic.claude-sonnet-4-5-20250929-v1:0
OpenAI
  • gpt-5.1-2025-11-13
  • gpt-4o-2024-11-20
Google
  • Gemini-2.5-Pro
  • gemini-2.5-flash
生成测试用例 Anthropic
  • anthropic.claude-sonnet-4-5-20250929-v1:0
OpenAI
  • gpt-5.1-2025-11-13
  • gpt-4o-2024-11-20
Google
  • Gemini-2.5-Pro
  • gemini-2.5-flash
导入测试用例 Anthropic
  • anthropic.claude-sonnet-4-5-20250929-v1:0
OpenAI
  • gpt-5.1-2025-11-13
  • gpt-4o-2024-11-20
Google
  • Gemini-2.5-Pro
  • gemini-2.5-flash
生成报告 Anthropic
  • anthropic.claude-sonnet-4-5-20250929-v1:0
OpenAI
  • gpt-5.1-2025-11-13
  • gpt-4o-2024-11-20
Google
  • Gemini-2.5-Pro
  • gemini-2.5-flash
需求评估 Anthropic
  • anthropic.claude-sonnet-4-5-20250929-v1:0
OpenAI
  • gpt-5.1-2025-11-13
  • gpt-4o-2024-11-20
Google
  • Gemini-2.5-Pro
  • gemini-2.5-flash
IXP (智能提取处理) Yes (Private Preview) 提取模型 Google
  • gemini-3.5-flash
  • gemini-3.5-flash-lite
  • Gemini-3.1-Pro-Preview
  • Gemini-2.5-Pro
  • gemini-2.5-flash
OpenAI
  • gpt-5.4-2026-03-05
  • gpt-5.1-2025-11-13
  • gpt-4o-2024-08-06
否 Table model pre-processing, model-based attribution, and Autopilot for taxonomy generation Google
  • gemini-2.5-flash
Delegate 是 聊天 Fireworks AI
  • fw-kmi-k3
  • fw-kmi-k2.7-code —即将移除: 2026-09-30 —替换: fw-kmi-k3
  • fw-kmi-k2.6
OpenAI
  • gpt-5.6-sol
  • gpt-5.6-terra
  • gpt-5.6-luna
  • gpt-5.5-2026-04-23
  • gpt-5.4-mini-2026-03-17
  • gpt-5.4-2026-03-05
Anthropic
  • anthropic.claude-sonnet-5
  • Anthropic.claude-opus-4-8
  • anthropic.claude-opus-4-7
  • anthropic.claude-sonnet-4-6
  • anthropic.clade-opus-4-6-v1
  • anthropic.clade-haiku-4-5-20251001-v1:0
Google
  • gemini-3.6-flash
  • gemini-3.5-flash
  • Gemini-3.1-Pro-Preview
  • gemini-3-flash-preview
  • Gemini-2.5-Pro
  • gemini-2.5-flash

1 智能体要求:

  • 确保您的 LLM 支持:
    • 工具(功能)调用 – 模型必须能够在执行期间调用工具或功能。
    • 禁用并行工具调用 – 如果提供程序支持,模型应提供禁用并行工具调用的选项。
  • 使用自定义模型时,无论模型的真实容量如何,智能体都会默认采用 4096 个令牌限制,因为 UiPath 无法推断客户定义部署的令牌限制。

客户托管模型的消耗率​

当您使用自己的模型 (BYOM) 时,符合条件的产品消耗的许可单元较少。下表汇总了发布在UiPath 许可策略中的 BYOM 消耗率,这是权威来源。有关权限以及此处未列出的产品和功能,请参阅该页面。

大多数符合条件的产品应用 30% 的费用减少,三种产品完全免除费用,AI Center 应用减少 90% 的费用,智能体更改仪表而不是费率。

要符合折扣资格,请配置产品所需的每个模型。如果缺少所需的模型,产品将回退使用 UiPath 托管模型,并适用标准费率。

统一定价​

费率以 Platform Units (PU) 表示。

备注:

列出的消耗率为标准消耗率,可能并不反映您组织的合同消耗率。有关完整的最新费率列表,请参阅UiPath 许可。

产品功能仪表标准费率使用您自己的模型进行评分缩小
对话智能体执行Autopilot for Everyone每次操作0.20.1430%
智能体执行代理每次调用 LLM,以 64k 输入令牌为增量0.2 标准模型; 0.16 基础模型; 0.4 高级模型每次执行智能体 0.2 个无。计量表从 LLM 调用变为智能体执行。
智能体执行编码智能体 (BYOA)每次智能体执行,上限5 分钟运行时0.2 台小型计算机; 0.4 标准; 0.8 中型; 2 个大型与标准费率相同无
Healing Agent不适用每次修复,包括建议32.130%
应用测试 Healing Agent不适用每次测试的修复情况10.730%
ScreenPlayScreenPlay每次 ScreenPlay 运行0.2 标准模型; 0.05 基础模型空闲100%
ScreenPlay语义 活动每个活动0.1空闲100%
ScreenPlay语义选取器每次运行选取器0.01空闲100%
上下文基础DeepRAG 查询每个请求,最多 30,000 个令牌0.20.1430%
上下文基础高级提取每提取 15,000 个令牌0.40.2830%
上下文基础批量转换每处理一行0.20.1430%
AI Center 执行不适用每个预测0.20.0290%

Flex​

有关 Flex 定价 BYOM 消耗率的更多信息,请联系您的 UiPath 代表。

此页面有帮助吗?

连接

需要帮助? 支持

想要了解详细内容? UiPath Academy

有问题? UiPath 论坛

保持更新