【问题标题】:Result count in SEDE doesn't match with Stack Exchange's APISEDE 中的结果计数与 Stack Exchange 的 API 不匹配
【发布时间】:2021-02-14 20:11:53
【问题描述】:

我使用 this 查询 Stack Exchange 资源管理器并得到 12946 的结果,我正在尝试通过 Stack Exchange API 带来相同的问题计数:

@concat('search/advanced?page=',dataset().PageNumber,'&pagesize=100&fromdate=1561939200&todate=',current date,'&order=desc&sort=activity&site=stackoverflow&filter=!)5aShmihVOxZoyNN9TVy065dCekm','&q=',dataset().TagsList)

但是,API 结果仅返回约 7000 个问题而不是 12000+。 不带 q 参数的基本 API:https://api.stackexchange.com/2.2/search/advanced?page=1&pagesize=100&fromdate=1561939200&order=desc&sort=activity&site=stackoverflow&filter=!)5aShmihVOxZoyNN9TVy065dCekm

注意: 我正在使用 Azure 数据工厂中的 until 活动来检索符合以下标签的所有问题,如果响应中的 has_moretrue,我将增加页码。

我传递了两批标签,因为q 过滤器存在限制。

【问题讨论】:

    标签: stackexchange-api


    【解决方案1】:

    这可能是因为 Stack Exchange 数据资源管理器 (SEDE) 每周更新一次(FWIW,计数现在是 13k+)。因此,使用特定标签标记的问题数量不同的事实是合理的。详情请见the FAQ

    您也可能会计算两次甚至三次相同的问题!确保将其在 items 数组中的项放入一个新数组中并过滤掉重复项。

    【讨论】:

    • 有没有办法以编程方式从 Data Explorer 中提取数据?
    • @user3240560 您可以下载 CSV 格式的结果,然后对其进行解析。首先,您需要运行一次查询,以便缓存结果,然后 GET https://data.stackexchange.com/stackoverflow/csv/query_id
    • 我可以在代码中使用这个apidata.stackexchange.com/stackoverflow/csv/query_id来获取csv数据然后解析它吗?
    • @user3240560 正如我所说,您需要向页面发出 GET 请求。响应将是 CSV。
    猜你喜欢
    • 2019-01-23
    • 2019-04-04
    • 2023-01-21
    • 2017-09-16
    • 2022-01-20
    • 2019-06-21
    • 1970-01-01
    • 1970-01-01
    • 2017-07-14
    相关资源
    最近更新 更多