跳至内容

DuckGo搜索API ·源-有效载荷终端点

查询数据的数据.

设置查询和记录DuckDuckGo过器,然后收到包含请求元数据和源SERPHTML有效载荷的JSON封装.您的应用程序拥有提取,验证和方案维护.

服务器端 GET 请求 ·engine=duckduckgo · 讨论您的数据源工作流程

  • 集中搜索控制查询,地方,界面,安全,时间
  • 保存的来源在JSON中输入的SERPHTML
  • 具体的所有权您的提取器,方案和验证
  • 附带的文本要求除了有效载荷之外的元数据
Web data workflow · duckduckgo searchReady

q privacy research

kl en_US

kad en_US

kp -1

moderate

fielddf m
stack克达克戈捕获合同
stack过表
stack隐私研究
stacken_US
图示请求和响应形态不是客户数据.源SERPHTML有效载荷仍然存在于JSON封面中,用于客户所有的提取.

清晰的交换

捕获源响应,而不模糊数据模型的所有者.

WebScrapingAPI运行了文档化的DuckDuckGo请求路径.您的应用程序接收了源码有效载荷,并决定如何提取,验证,版本,存储和使用它.

01

限制观察

随着每次捕获,请将查询,本地,接口语言,安全搜索水平,时间范围和设备放在旁边.

02

保持源

接收源SERPHTML有效载荷在JSON封装中,而不是假设固定下游方案.

03

设计你的取器

选择您的工作流程所需的领域,并与代表性有效载荷进行验证.

04

版本布局变化

处理提取规则和记录方案作为应用程序代码,

WebScrapingAPI文件要求执行

响应界限转载数据

您的申请提取+维护方案

DuckGo 网页搜索

控制源-SERP观测的集中终点.

使用DuckDuckGo引擎进行文件过器家族的网页搜索请求.验证您的产品所依赖的查询组合的实际有效载荷.

捕获范围

查询背景,源页面的有效载荷.

封筒将提交的搜索元数据与DuckDuckGo结果有效载荷相邻,以便您的管道可以保留所需的来源.

Review the basic request

地方

国家和语言

使用记录的结合本地值进行搜索.

演讲

接口语言

设置 DuckDuckGo 控制器和标签使用的语言.

政策

安全搜索

选择一个文件安全搜索水平.

过去

时间范围

要求记录日,周,月或年窗口,或者省略过器.

演讲

设备

选择所需结果页面的文档设备文本.

覆盖范围:杜克达克可改变其页面所显示的字段和标记. 测试代表性有效载荷,并将抽取假设保存在一个版本的客户所有的消费者内.

文件选器组件

在比较捕获之前,请明确搜索文本.

首先要使用所需查询. 加入只属于你打算复制的观察的可选DuckDuckGo过器.

q Required

搜索查询

提供DuckDuckGo应该搜索和编码URL空间或特殊字符的术语.

kl Optional

国家+语言

使用文件组合的本地代码,如 en_US,当请求需要该文本时.

kad Optional

接口语言

选择 DuckDuckGo 控制器和标签的文档语言.

kp Optional

安全搜索水平

设置,调节或关闭,以记录的数值.

df Optional

时间范围

限制结果到过去的一天,一个星期,一个月或一个年,或者任何时间都省略过器.

device Optional

设备背景

选择文件设备值,当要求的演示文本重要时.

参数真相来源在生产使用前确认已接受的值.

源有效载荷响应

处理JSON封面作为一个运输界限,而不是最终的记录模型.

终点响应是包含请求元数据和源SERPHTML有效载荷的JSON封装.您的应用程序拥有提取,验证和方案维护.

文件的形状

附加于有效载荷的元数据

其他类型

{ "search_parameters": { "search_engine": "duckduckgo", "query": "privacy research" }, "search_results": "<html>...source SERP HTML...</html>" }

存储和检查只需要工作流程的内容.

消费者合同

你的团队定义了稳定的层.

  1. 检查

    检查HTTP结果和预期封面字段.

  2. 提取物

    阅读下游使用情况所要求的元素.

  3. 验证

    区分缺失内容,改变标记和未能提取.

  4. 版本

    记录采集器和图案版本,并使用衍生数据.

拥有权规则

WebScrapingAPI 返回文件封面.您的应用程序拥有源SERPHTML有效载荷的任何提取和维护每一个下游的现场合约.

要求保持记录

建立捕获和提取生命周期作为单独的阶段.

保持终端响应与业务方案分开,使得拥有权,验证和布局更容易处理.

  1. 01

    定义环境

    选择查询,只需观察所需的文件过器.

  2. 02

    发送和验证

    调用服务器端,检查HTTP状态,并确认预期的源-有效载荷包.

  3. 03

    摘录和版本

    应用测试的规则,验证所需的字段,并附加你的方案版本.

整合

开始一个DuckDuckGo请求和一个明确的故障路径.

保存凭据服务器侧,URL编码请求值,设置限期,检查未成功的HTTP状态,并在提取前验证封面.

要求简报

检查您的消费者将保持的环境.

开始使用一个代表性查询和一个小的文件过器集. 在提取器正在测试期间,将源有效载荷与衍生记录分开.

秘密
WSA_API_KEY服务器侧
发动机
engine=duckduckgo
过器的例子
kl=en_US
消费者
检查状态,封面,然后来源
: "${WSA_API_KEY:?WSA_API_KEY is required}" curl --get --fail-with-body --max-time 120 \ "https://serpapi.webscrapingapi.com/v2" \ --data-urlencode "api_key=$WSA_API_KEY" \ --data-urlencode "engine=duckduckgo" \ --data-urlencode "q=privacy research" \ --data-urlencode "kl=en_US" \ --data-urlencode "kad=en_US" \ --data-urlencode "kp=1" \ --data-urlencode "df=w" \ --data-urlencode "device=desktop"

安全的起点

每个例子都保留了关键服务器侧面,发送了文档引擎和查询,使用了限定的时间,并暴露了未成功的HTTP结果.

产品选择

根据您想要拥有的源到方案工作流量,

克达克戈搜索API处理了记录的引擎请求和源-有效载荷包裹. 邻近的产品将责任转移到访问基础设施或托管数据交付.

产量评估

在选择计划之前验证有效载荷适应.

试验普通,本地化,时间过,空,改编,未成功的案例.目前的定价和计划描述仍然是商业的真相来源.

评估矩阵

计算环境和维护工作.

说明工作量公式

问题 × 镜组件 × 运行频率 + 提取器测试

您的生产设计包括保留源,验证方案和处理布局变更.

现场问题

环境

什么样的过器组合有什么关系?

合同

必须存在哪些源域?

质量

标记变化是如何检测的?

恢复

哪些失败可能会再次尝试?

拥有权

谁维护了提取器和方案?

Discuss production requirements

FAQ

为了进行基础评估,

作为实践的真相来源,使用当前的文档和代表性来源的有效载荷.

Browse DuckDuckGo documentation

达克戈搜索API返回了什么?

终点返回一个包含请求元数据和源SERPHTML有效载荷的JSON包.它不定义下游记录方案;你的应用程序拥有提取和方案维护.

子子的布局改变,谁拥有取?

当DuckDuckGo改变页面时,在推动更改之前,测试您的提取器与代表性反应.

我可以控制哪些DuckDuckGo过器?

在本页面上使用的文档控制器是查询的q,国家和语言的kl,接口语言的 kad,安全搜索的 kp,时间范围的df. 删除您不需要的可选过器.

源源的有效载荷已经符合我的方案吗?

答案保存源SERPHTML用量在JSON封装中.应用程序决定要提取哪些字段,如何建模它们,以及如何版本结果的方案.

我申请申请未能申请的情况应该如何处理?

在阅读机器之前检查HTTP状态,保留足够的请求文本来调查故障,并使用适合工作流程的限度重试行为. 视响应分析和验证为明确的应用步骤.

什么时候考虑托管数据?

当您的团队想要捕获请求时间时,选择API,并将运行提取,方案,存储和安排. 当您想在托管数据号为WebScrapingAPI提供一致的查询集,序列,方案,质量流程和交付时,请考虑WebScrapingAPI.

你的第一份来源捕获

测试一项DuckDuckGo查询,对待你的团队计划维护的方案.

开始使用记录的终端点,或者与我们的团队谈论已达成的托管数据工作流程.