XYZ-Aquila-pro工具调用完全指南:web_search与scrape功能实战
XYZ-Aquila-pro工具调用完全指南web_search与scrape功能实战【免费下载链接】XYZ-Aquila-pro项目地址: https://ai.gitcode.com/hf_mirrors/XYZAILab/XYZ-Aquila-proXYZ-Aquila-pro是由XYZ AI Lab开发的开源Deep Search智能体基于Qwen3.5-397B-A17B模型优化专注于长周期规划、多语言网页浏览、多源证据聚合和工具调用能力。本文将详细介绍如何使用其核心的web_search与scrape功能帮助新手快速掌握智能搜索技能。为什么选择XYZ-Aquila-pro进行深度搜索XYZ-Aquila-pro通过AI4AI pipeline进行优化在多个搜索基准测试中表现优异。它不仅支持标准的网页搜索还能精确提取网页信息并与Python代码执行工具无缝集成形成完整的问题解决闭环。核心优势一览精准搜索能力在BrowseComp、DeepSearchQA等权威基准中超越同量级开源模型多语言支持同时优化中英文搜索场景特别适合跨境信息获取结构化工具调用严格遵循Qwen3格式的函数调用规范确保工具使用准确性长上下文处理支持256K上下文窗口可处理大规模网页内容和搜索结果快速开始环境搭建与部署安装SGLang推理框架推荐使用sglang0.5.14版本运行XYZ-Aquila-prouv pip install githttps://github.com/sgl-project/sglang.git#subdirectorypythoneggsglang[all]启动OpenAI兼容服务通过以下命令启动支持工具调用的推理服务需要8张GPU可根据实际环境调整参数MODEL_PATHXYZAILab/XYZ-Aquila-pro SERVED_MODELXYZ-Aquila-pro python -m sglang.launch_server \ --model-path ${MODEL_PATH} \ --served-model-name ${SERVED_MODEL} \ --port 8000 \ --tp-size 8 \ --mem-fraction-static 0.8 \ --context-length 262144 \ --reasoning-parser qwen3 \ --tool-call-parser qwen3_coderweb_search功能详解智能获取网络信息web_search工具允许模型通过Google搜索获取最新信息支持自定义搜索参数以优化结果质量。基础参数说明query必填搜索关键词需简洁明确num可选返回结果数量默认10条最大100条hl可选语言代码如en或zh默认engl可选国家代码如us或cn默认us最佳实践构建高效搜索查询使用特定关键词避免模糊表述如用2024年诺贝尔物理学奖得主代替今年诺贝尔物理奖是谁添加限定条件通过site:限制域名filetype:指定文件格式渐进式搜索先宽泛搜索获取背景再针对性细化查询Python调用示例tools [ { type: function, function: { name: web_search, description: Search the web using Google and return relevant results, parameters: { type: object, properties: { query: {type: string, description: The search query string}, num: {type: integer, description: Number of results to return, default: 10}, hl: {type: string, description: Language code, default: en}, gl: {type: string, description: Country code, default: us} }, required: [query] } } } ]scrape_and_extract_info精准提取网页内容scrape工具用于获取指定URL的内容并可根据需求提取特定信息是将搜索结果转化为可用知识的关键步骤。核心功能全页内容获取获取网页完整文本内容适用于深度阅读定向信息提取通过自然语言描述需要提取的信息模型将返回结构化结果多格式支持可处理网页、PDF、代码文件等多种格式使用技巧URL验证确保URL完整有效优先使用搜索结果中的官方链接明确提取目标info_to_extract参数应具体如提取该页面中所有2024年科技公司营收数据结果验证对关键信息建议通过多来源交叉验证调用示例{ type: function, function: { name: scrape_and_extract_info, description: Fetch and read web page contents, parameters: { type: object, properties: { url: {type: string, description: The URL to scrape}, info_to_extract: {type: string, description: Specific information to extract} }, required: [url] } } }工具调用工作流从搜索到答案标准流程问题分析模型理解用户问题判断是否需要工具搜索决策确定搜索关键词和参数调用web_search结果筛选评估搜索结果相关性选择合适URL内容提取使用scrape工具获取关键信息答案合成整合多源信息生成最终答案提示词设计原则明确任务目标清晰说明需要解决的问题设定思考步骤引导模型分步骤使用工具指定输出格式如要求用特定结构呈现结果完整示例代码详细的工具调用示例可参考项目中的tool-use示例其中包含系统提示词设计、工具定义和API调用完整流程。常见问题与解决方案搜索结果不相关优化查询词添加更具体的关键词或限定条件调整参数尝试不同的hl和gl设置获取地区化结果增加结果数量适当提高num参数值扩大搜索范围提取信息不准确细化提取描述info_to_extract使用更精确的表述分段提取对复杂页面分多次提取不同部分结合Python工具使用run_python_code进行数据清洗和验证服务部署问题内存不足减少tp-size或context-length参数启动失败检查SGLang版本是否符合要求性能优化调整mem-fraction-static参数平衡内存使用总结与进阶XYZ-Aquila-pro的web_search和scrape功能为智能搜索提供了强大支持通过本文介绍的方法您可以快速构建专业的信息获取系统。进阶用户可探索多工具协同结合run_python_code实现数据处理和可视化提示工程优化系统提示词提升工具使用效率批量处理开发脚本实现多查询自动化处理通过不断实践和优化您将能充分发挥XYZ-Aquila-pro的深度搜索能力高效解决各类信息获取问题。引用与资源技术报告AI4AI at Scale: A Full-Pipeline System数据集XYZ-Aquila-SFTAgent框架AxisAgentic【免费下载链接】XYZ-Aquila-pro项目地址: https://ai.gitcode.com/hf_mirrors/XYZAILab/XYZ-Aquila-pro创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考