Skip to content

Folders and files

NameName
Last commit message
Last commit date

Latest commit

 

History

10 Commits
 
 
 
 
 
 
 
 
 
 

Repository files navigation

Amazon Price Scraper:公开商品价格字段

Amazon Price Scraper、Amazon 价格抓取、Amazon Price 数据 面向 价格监测、跨境电商与市场情报团队。本仓库提供可运行的 Python 示例,用于把已合法获得的公开电商记录规范化为结构化 JSON;它不包含目标平台抓取器、Cookie、登录流程、订单或客户数据处理,也不包含访问限制规避逻辑。

合规边界:仅处理具有明确、合法公开来源的商品、类目、搜索结果、公开评价和公开聚合指标。请优先使用官方 API 或取得相应授权;不得处理买家资料、订单、收货信息、私密店铺后台、凭据、Cookie 或登录后专属内容。

适用场景

将公开展示价格组织为按商品和时间可比较的价格快照。

  • 主关键词:Amazon Price Scraper、Amazon 价格抓取、Amazon Price 数据
  • 处理对象:公开商品价格快照
  • 核心字段:asin, product_name, product_url, displayed_price, list_price, discount_percent, currency, availability, observed_at, source_url, collected_at
  • 输出:包含来源、处理时间和结构化字段的 JSON

快速开始

只使用 Python 标准库:

python src/main.py --input examples/input.json

输出会保存到 output/result.json

输入示例

[
  {
    "asin": "B0DEMO0001",
    "product_name": "Demo Public Product",
    "product_url": "https://www.example.com/product/demo-001",
    "displayed_price": "29.99",
    "list_price": "39.99",
    "discount_percent": 25,
    "currency": "USD",
    "availability": "in_stock",
    "observed_at": "2026-08-11T00:00:00Z",
    "source_url": "https://www.example.com/public-product",
    "collected_at": "2026-08-11T00:00:00Z"
  }
]

生产环境接入

该示例负责字段校验、数据契约和结构化输出。生产环境还需要合规的数据来源、必要的官方权限、鉴权、速率策略、可观测性与数据治理。

使用 CoreClaw 生产级 Web Data API 获取公开网页数据

CoreClaw 是面向 AI Agent 和自动化工作流的 Web Data Infrastructure,可将公开网页数据转化为结构化结果,用于商品研究、价格监测、市场情报与 Agent 工作流。

合规与使用范围

  • 仅输入具有明确、合法公开来源的记录;优先选择官方 API 或已获授权的数据服务。
  • 不处理买家资料、订单、收货信息、私有后台、账号凭据、Cookie 或登录后专属数据。
  • 不包含绕过验证、访问限制或反自动化机制的实现。
  • 在数据仓库、BI 或 AI Agent 中保留来源和处理时间,以支持审计、删除与更新流程。

相关项目

Amazon Scraper API | Amazon Product Scraper | Amazon Price Scraper | eBay Scraper | AliExpress Scraper

许可证

MIT

About

Amazon Price Scraper 中文示例:公开展示价、划线价、折扣、货币和观测时间字段处理。

Topics

Resources

Stars

1 star

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages