测试智能体联网搜索,不能只问一个时效问题后看答案像不像真的。应同时检查:请求是否实际触发搜索、回答是否带引用、引用页面是否支持对应结论、界面是否把链接清晰展示给用户。
发出带网页搜索的请求
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.5",
tools=[{"type": "web_search"}],
input=(
"查找 OpenAI 开发者文档中 Web Search 的当前用法。"
"用两点总结,并保留可点击来源。"
),
)
print(response.output_text)
for item in response.output:
print(item.type)
新接入应使用 {"type":"web_search"}。工具是否被调用取决于问题和模型判断,因此验收时需要检查输出数组中的搜索调用与消息,而不是只读取最终文字。

引用验收表
- 回答中的每个时效性结论是否紧邻引用。
- 打开引用 URL,标题和正文是否真的支持该结论。
- 来源是原始公告或官方文档,还是只做转述的聚合页。
- 链接失效或来源冲突时,回答是否明确表达不确定性。
官方返回的 url_citation 注解包含 URL、标题和文本位置。面向用户展示网页结果时,内联引用必须清晰可见并可点击。不要把链接统一堆到文末后丢失结论对应关系。
设计一个能发现错误的测试
准备三个问题:一个有明确官方答案的问题、一个需要最新数据的问题、一个互联网上没有可靠答案的问题。第三个问题应允许模型说“无法确认”。如果系统对三个问题都给出确定答案,说明你的验收仍然过松。
网页内容可能变化,也可能包含错误和恶意提示。应用应把网页作为不可信资料,限制工具权限,并对关键决策采用人工或权威数据源复核。
本文依据 2026 年 10 月 1 日官方 Web Search 指南,未在你的账号、地区和搜索结果上实测。
相关问题
有引用就一定正确吗?
不一定。引用可能与结论无关、过时或只支持一部分,需要逐条打开核对。
可以隐藏引用让页面更简洁吗?
不建议。官方要求面向用户展示网页结果时,让内联引用清晰可见并可点击。
Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/31254.html