在本文中,你将了解:
- Oracle Generative AI Agents Service 是什么,以及它带来了什么。
- 为什么企业 AI 智能体需要访问实时网页数据以获取情境化的市场洞察,以及 Bright Data 如何实现这一点。
- 如何使用自定义的 Bright Data 支持工具构建具备网页访问能力的 Oracle Generative AI Agent。
让我们开始吧!
什么是 Oracle Generative AI Agents Service?

Oracle Generative AI Agents 是一项完全托管的 OCI(Oracle Cloud Infrastructure)服务,用于构建和部署 AI 智能体。这些智能体可以理解自然语言、保留对话上下文、编排工具、访问企业数据并自动化复杂工作流。
常见用例包括客户支持、技术故障排除、法律和金融研究、内容创作、教育辅导、供应链分析、房地产洞察和旅行协助。
主要功能
Oracle Generative AI Agents 提供的核心能力包括:
- 简单的智能体设置:通过引导式、完全托管的设置流程创建和部署 AI 智能体,无需管理基础设施。
- 多轮对话:支持自然、类人的对话,并在多条消息中进行上下文感知的互动。
- 上下文保留:记住之前的对话轮次,以提供个性化、一致且相关的响应。
- 自定义指令:通过可配置指令定义智能体行为、语气、目标和路由逻辑。
- 内置护栏:帮助防范提示注入攻击、审核内容并检测敏感 PII 数据。
- 人工参与支持:支持针对敏感操作和业务关键操作进行人工审核与干预。
- 企业可扩展性与安全性:运行在 OCI 安全、可扩展的基础设施上,具备企业级可靠性和治理能力。
- 内置和自定义工具:通过 SQL、RAG、智能体到智能体编排、函数调用和自定义 API 集成扩展智能体。
在官方文档中了解更多信息。
为什么企业 Oracle AI 智能体需要网页访问能力
为了做出业务就绪的决策,企业 AI 智能体需要访问外部市场数据。这包括当前趋势、竞争对手活动、客户情绪、突发新闻和监管更新。
挑战在于,LLM 默认并未连接到实时网络。因此,它们面临两个关键限制:
- 无法访问实时信息:LLM 无法原生检索最新的网页内容。
- 对网站的访问受限:许多网站采用反机器人技术,阻止自动化系统收集数据。
这些限制可以通过使用外部工具和集成扩展 AI 智能体来克服。
这正是 Oracle Generative AI Agents 支持多种工具选项的原因。特别是,API 端点调用工具允许它们安全连接到基于外部 API 的服务,例如 Bright Data。
Bright Data 作为解决方案

Bright Data 是领先的企业级、AI 就绪网页数据平台。借助一套全面的产品套件,它使你能够以合乎伦理的方式大规模收集、结构化和分析公共网页数据。
其中包括:
- Unlocker API:绕过 CAPTCHA、反机器人系统和网站封锁,从任何网页检索数据。
- 搜索引擎 API:从 Google、Bing、Yandex 和其他主要搜索引擎提供结构化的实时搜索引擎结果。
- Discover API:从实时网络返回由 AI 排名的相关 URL 列表,可供进一步处理。
- Crawl API:支持大规模网站爬取和自动化数据提取。
- 爬虫 API:从 120 多个热门网站和平台提供结构化数据提取。
Bright Data 的突出之处在于其拥有覆盖 195 个国家/地区的超过 4 亿个住宅 IP网络。该基础设施支持高度可扩展、地理分布式的网页数据收集,同时实现 98.50% 的成功率和受 SLA 支持的 99.99% 正常运行时间。它还符合所有主要隐私与安全框架,包括 GDPR 和 CCPA。
通过 API 端点调用工具集成 Bright Data,Oracle Generative AI Agents 可以搜索网络、访问新鲜的在线信息、从网站检索数据,并将现实世界上下文纳入其响应。这会带来更准确、更新且可操作的结果。
将 Bright Data 与 Oracle Generative AI Agent 集成
在这个分步部分中,你将学习如何构建一个与 Bright Data 集成的 Oracle Generative AI Agent。具体而言,你将看到如何定义两个自定义 API 端点调用工具,以连接到 Bright Data 的网络解锁器 API 和搜索引擎 API。
搜索引擎 API 使智能体能够发现新来源,而网络解锁器 API 则允许它访问这些来源中的内容。它们共同实现了强大的搜索并提取模式。这有助于智能体自主地将其响应建立在实时、可验证、情境化的网页数据之上,并生成更真实、企业级的结果。
请按照以下说明操作!
前提条件
要跟随本节操作,请确保你拥有:
- 一个 Oracle Cloud 账户(免费层账户即可)。
- 一个已配置 API 密钥的 Bright Data 账户。按照官方指南设置你的 Bright Data API 密钥。
第 #1 步:设置 VCN
登录你的 Oracle 账户,搜索 “Virtual Cloud Networks”,并选择相应服务:

在 “Virtual Cloud Networks” 页面,打开 “Actions” 下拉菜单并选择 “Start VCN Wizard”:

接下来,选择 “Create VCN with Internet Connectivity” 选项并按照设置向导操作:

为你的 VCN 命名(例如 “ai”)并继续完成向导。默认设置适用于此设置。
注意:必须为子网启用 “DNS Resolution” 功能。否则,自定义工具将无法调用外部端点。不过,使用 OCI 网络向导时该功能默认启用,因此无需担心。
创建 VCN 后,你应该会看到类似如下内容:

太好了!你现在拥有一个 OCI Virtual Cloud Network(VCN),其中包含一个子网,Bright Data 工具可以使用它来路由其 HTTP 流量。
第 #2 步:将你的 Bright Data API 密钥存储在 Oracle Vault 中
首先按照 Oracle 官方指南设置 Oracle Vault(带有加密密钥)。接下来,在你的 Oracle 账户中搜索 “Secret Management” 并打开该服务。点击 “Create secret” 按钮:

在 “Create secret” 表单中,为你的密钥命名(例如 “bright-data-api-key-bearer”),选择你的 Oracle Vault 和加密密钥,然后选择 “Manual secret generation” 选项。使用以下格式填充密钥值:
Bearer <BRIGHT_DATA_API_KEY>
将 <BRIGHT_DATA_API_KEY> 占位符替换为你实际的 Bright Data API 密钥。
注意:API 密钥前的 “Bearer” 前缀是必需的。这是要在 Authorization 标头中为 Bright Data API 身份验证设置的标准基于令牌的格式。

按 “Create secret” 以完成密钥创建。你现在应该会在 “Secrets” 页面上看到你的密钥列出:

很棒!此密钥将用于对自定义智能体工具向 Bright Data API 发出的请求进行身份验证。
第 #3 步:添加所需的 IAM 策略
默认情况下,Oracle Generative AI 服务无法访问存储在你的 Vault 中的密钥。要启用该功能,你必须添加正确的 IAM 策略。
在 OCI Console 中搜索 “Policies” 并打开相应页面。然后点击 “Create Policy”:

在 “Create Policy” 表单中,为你的策略命名(例如 “genaiagent”)。然后点击 “Show manual editor” 并粘贴以下 IAM 策略:
allow any-user to read secret-family in tenancy where any {request.principal.type='genaiagent'}
此策略允许任何 Generative AI Agent 读取租户内 OCI Vault 实例中存储的密钥,包括之前创建的 “bright-data-api-key-bearer” 密钥。
点击 “Create” 确认创建策略:

创建后,该策略将出现在 “Policies” 页面中:

或者,你可以按照官方指南设置动态组来实现相同目标。
做得好!你现在拥有构建可通过自定义工具连接到 Bright Data 的 Oracle Generative AI Agents 所需的所有构建块。
第 #4 步:初始化你的网页访问智能体
搜索 “Agents” 并在 “Generative AI Agents” 服务中打开相应页面:

继续按下 “Create agent” 按钮:

这将启动智能体创建向导。按如下方式填写表单:
- Name:
Web Access AI Agent - Description:
You are a web agent with web access powered by the Bright Data integration - Routing instructions:
When asked to search the web, retrieve online data, or scrape web pages, use the Bright Data tools
然后选择你偏好的 LLM 作为智能体的大脑。在这种情况下,默认的 Llama 3.3 70B 模型就足够了。

完美!点击 “Next” 进入向导的 “Tools” 部分。在定义 Bright Data 集成工具之前,让我们先启动相关事项。
第 #5 步:开始使用 Bright Data 的 Unlocker API 和搜索引擎 API
现在是在你的 Bright Data 账户中创建 Unlocker API 和搜索引擎 API 的时候了。要快速设置,请参阅官方文档页面:
否则,请按照以下说明操作。
如果你还没有,创建一个 Bright Data 账户。如果你已有账户,请登录并打开控制面板:

接下来,从左侧菜单导航到 “Web Access > Web Access API”:

如果你已经在 “My APIs” 表中看到 “网络解锁器 API” 和 “搜索引擎 API” 条目,那么就可以继续了:

如果没有,请点击 Create API 按钮上的下拉菜单并选择 “Unlocker API”(或者如果你想创建的是 搜索引擎 API,则选择 “搜索引擎 API”):

这将启动 Unloker/搜索引擎 API API 设置向导。为你的 API 命名(例如 unlocker_api/serp_api),并根据你的需求配置 API:

完成后,点击 “Add API”。从现在开始,我们假设你设置了以下 API 名称:
unlocker_api用于 Bright Data Unlocker API。serp_api用于 Bright Data 搜索引擎 API。
你现在已准备好定义连接到这些 API 的自定义 API 端点调用工具。太棒了!
第 #6 步:创建用于 网络解锁器 API 集成的自定义工具
返回 Generative AI Agent 创建向导。在 Tools 部分,点击 “Add tool”。
要创建用于 Unlocker API 集成的工具,请选择 “Custom tool” 选项。然后像这样填写表单:
- Name:
Web Unlocker API - Description:
An automated web scraping tool that extracts content from web pages and bypasses anti-bot protections
在 “Tool configuration” 部分,选择 “API endpoint calling (agent execution)” 选项:

在 “Examples” 部分,选择 “None” 以从空白画布开始,然后粘贴以下 OpenAPI 规范:
{
"openapi": "3.0.4",
"info": {
"title": "Bright Data Web Unlocker API",
"version": "1.0.0",
"description": "Bright Data Unlocker API enables you to bypass anti-bot measures. It manages proxies and solves CAPTCHAs automatically for easier web data collection.\n\n\[Web Unlocker API documentation\](https://docs.brightdata.com/scraping-automation/web-unlocker/introduction)\n"
},
"servers": [
{
"url": "https://api.brightdata.com"
}
],
"paths": {
"/request": {
"post": {
"operationId": "sendWebUnlockerRequest",
"summary": "Send a Web Unlocker API request",
"description": "Submit a Web Unlocker API request using your Bright Data Web Unlocker API zone.\n\n\[Web Unlocker API `/request` documentation\](https://docs.brightdata.com/api-reference/rest-api/unlocker/unlock-website)\n",
"requestBody": {
"required": true,
"content": {
"application/json": {
"schema": {
"type": "object",
"required": ["zone", "url", "format"],
"properties": {
"zone": {
"type": "string",
"description": "Your Web Unlocker zone name.",
"default": "unlocker_api"
},
"url": {
"type": "string",
"description": "The target website URL to unlock and fetch.",
"example": "https://example.com/products"
},
"format": {
"type": "string",
"description": "Response format.\nAllowed values:\n- raw: Returns the response immediately in the body.\n- json: Returns the response as a structured JSON object.",
"default": "raw"
},
"method": {
"type": "string",
"description": "HTTP method used when fetching the target URL.",
"example": "GET"
},
"country": {
"type": "string",
"description": "Country code for proxy location (ISO 3166-1 alpha-2 format).",
"example": "us"
}
}
}
}
}
},
"responses": {
"200": {
"description": "Successful response containing search results."
},
"400": {
"description": "Invalid request (missing required fields or invalid parameters)."
},
"401": {
"description": "Unauthorized (invalid or missing Bright Data API key)."
}
}
}
}
}
}
这对应于 Bright Data 网络解锁器 OpenAPI 规范。更多参考信息,请阅读 “OpenAPI 规范:通过 SERP 和 Unlocker API 进行 AI 集成” 指南。
重要:注意 zone 属性下的 "default": "unlocker_api" 字段。这一点至关重要,因为它会指示 AI 智能体应如何调用你的 Bright Data Unlocker API。将 "unlocker_api" 替换为你的 Unlocker API 的实际名称。
要配置身份验证方法,请按如下方式填写表单:
- Authentication type:
API key - Key location:
Header - Key name:
Authorization - Secret value:
bright-data-api-key-bearer(或你存储的 Bright Data API 密钥 secret 的名称) - VCN:
ai(或你的 Oracle VCN 名称) - Subnet:
private-subnet-ai(关键:选择私有子网,否则你的所有工具调用都将因500错误而失败)

这会使用 Bright Data 所需的身份验证方法配置自定义工具。此外,它还确保对 Unlocker API 的 API 调用通过 OCI VCN 私有子网执行。
最后,点击 “Add tool” 完成设置。由 Bright Data 支持的网页爬虫工具现在将可供你的智能体使用。太棒了!
第 #7 步:创建搜索引擎 API 工具
仅具备抓取能力的智能体,如果无法自主发现网页内容,就会受到限制。这正是 Bright Data 搜索引擎 API 发挥作用的地方!
再次点击 “Add tool”,并像之前一样重复该过程。这一次,用以下内容填写表单:
- Name:
SERP API - Description:
An endpoint that provides real users``'search results at high volume across major search engines, including Google
接下来,粘贴以下规范:
{
"openapi": "3.0.4",
"info": {
"title": "Bright Data SERP API",
"version": "1.0.0",
"description": "Extract search engine results using Bright Data SERP API. Extract structured data from major search engines, including Google, Bing, Yandex, DuckDuckGo, and more. \nGet organic results, paid ads, local listings, shopping results, and other SERP features.\n\[SERP API documentation\](https://docs.brightdata.com/scraping-automation/serp-api/introduction)\n"
},
"servers": [
{
"url": "https://api.brightdata.com"
}
],
"paths": {
"/request": {
"post": {
"operationId": "sendSerpRequest",
"summary": "Send a SERP API request",
"description": "Submit a SERP API request using your Bright Data SERP API zone. \n\n\[SERP API `/request` documentation\](https://docs.brightdata.com/api-reference/rest-api/serp/scrape-serp)\n",
"requestBody": {
"required": true,
"content": {
"application/json": {
"schema": {
"type": "object",
"required": [
"zone",
"url",
"format"
],
"properties": {
"zone": {
"type": "string",
"description": "The name of your SERP API zone.",
"default": "serp_api"
},
"url": {
"type": "string",
"description": "The search engine URL to query (e.g., `https://www.google.com/search?q=<search_query>`).",
"example": "https://www.google.com/search?q=pizza&hl=en&gl=us"
},
"format": {
"type": "string",
"description": "Response format. \nAllowed values: \n- `raw`: Returns the response immediately in the body. \n- `json`: Returns the response as a structured JSON object. \n",
"default": "raw",
"enum": [
"raw",
"json"
]
},
"country": {
"type": "string",
"description": "Country code for proxy location (ISO 3166-1 alpha-2 format). \n",
"example": "us"
}
}
}
}
}
},
"responses": {
"200": {
"description": "Successful response containing search results."
},
"400": {
"description": "Invalid request (missing required fields or invalid parameters)."
},
"401": {
"description": "Unauthorized (invalid or missing Bright Data API key)."
}
}
}
}
}
}
重要:如前所强调,请确保 zone 属性下的 default 字段与你的搜索引擎 API 名称匹配。
添加此工具后,你应该会看到如下内容:

注意:以类似方式,你可以连接所有其他基于 API 的 Bright Data 解决方案。
太好了!现在只剩下最后的收尾工作。
第 #8 步:完成智能体创建
点击 “Next” 进入智能体端点设置。这是测试智能体所必需的。然后,检查所有智能体信息,点击 “Create agent”,并接受 Llama 3 许可协议。
你将被重定向回 “Agents” 页面,在那里你会看到一个状态为 “Creating” 的 “Web Access AI Agent” 条目。配置过程可能需要几分钟,所以请耐心等待。

过一会儿,状态将变为 “Active”,这意味着你的集成了 Bright Data 的 Oracle Generative AI Agent 已准备就绪!
第 #8 步:测试智能体
点击智能体名称,你将被重定向到以下页面:

在这里,你可以通过按下 “Launch chat” 来测试智能体。
确保已选择你的 AI 智能体和相关端点,然后粘贴如下提示:
Search Google for the latest news about SpaceX stock, review the content from the 2,3 most relevant sources, and provide a report summarizing the most important information
这是一个理想的测试,因为它验证 Bright Data 集成可以同时处理网页搜索和爬虫任务。
在 “Chat” 页面中,执行提示。你应该会看到类似如下内容:

如你所见,AI 智能体返回了关于 SpaceX 股票的情境化信息。由于 SpaceX 几小时前刚刚上市(在撰写本文时),这是非常新的信息。
标准 LLM 无法提供它,因为它是在静态数据集上训练的。要确认 Bright Data 工具被调用了(并且结果不是幻觉),展开 “Traces” 下拉菜单并点击右侧的 “View” 按钮。
在这里,你可以检查智能体的计划和执行步骤。你会看到它调用了搜索引擎 API 工具,对 SpaceX 股票新闻进行了 Google 搜索:

在底层,智能体工具调用 Bright Data 搜索引擎 API,该 API 返回此 Google SERP 的 JSON 版本:

从发现的 URL 中,智能体选择最相关的来源,抓取它们,并将所有检索到的信息聚合到最终的情境化结果中。
瞧!这个简单示例展示了你的 Oracle Generative AI agent 如何借助 Bright Data 提供的网页搜索和抓取能力变得有依据且准确。现在,尝试不同提示来探索所有其他受支持的企业用例。
结论
在本教程中,你了解了 Oracle Generative AI Agents 服务是什么以及它提供的功能。你还探索了 AI 智能体的局限性,以及如何通过 Bright Data API 在企业场景中解决这些问题。
你被引导完成了一个 Oracle Generative AI Agent 的定义,该智能体带有用于调用 Bright Data 端点的自定义工具。结果是一个能够探索网络并从中检索信息的 AI 智能体,就像人类会做的那样。
这只是 Bright Data 集成所支持的众多用例之一。如果你需要实施帮助或想探索其他可能的场景,请联系我们的 24/7 支持团队。
立即免费创建 Bright Data 账户,开始探索我们的网页数据解决方案!