每个产品一行
给它一个搜索词、一个分类页面,或者一组混在一起的 ASIN 与产品链接。它们都会以相同的列返回。
你需要的产品数据早已在亚马逊的页面上。AllyHub 把它取下来,变成你真正能用的东西。
按顺序来说:一行是什么、它包含什么、它能拆分到多细、什么永远不会被收录、它在哪些地方可用,以及它接下来会去向哪里。
给它一个搜索词、一个分类页面,或者一组混在一起的 ASIN 与产品链接。它们都会以相同的列返回。
传入 ASIN 或产品 URL,每条记录都会带上该产品的畅销排名(Best Sellers Rank)。如果换成关键词搜索或分类页面,页面上并没有这个数字可供采集。
尺寸、颜色和包装选项各自拥有独立的一行,带各自的价格、库存状态和图片——而不是用父商品 listing 的默认值来代表所有变体。
用范围来设定你的条件——低于 $50、四星及以上、仅 Prime——AllyHub 在运行过程中会跳过其余一切。不会再有你本来就会删掉的数据被带回来。
amazon.com、.co.uk、.de、.co.jp 等等都接受相同的指令,并返回相同的结构。切换市场时无需重新配置任何东西。
下载 JSON 或 CSV,或直接从 API 读取结果。无需申请 Amazon API 凭证,也无需等待开发者审批。
从搜索词、分类 URL 或 ASIN 列表,到一个结构化的亚马逊产品数据集。
用日常语言描述范围——一个关键词、一个分类页面、一堆 ASIN。无需填写输入 schema,也无需事先搭建模板。
它会采集标题、ASIN、价格与标价、评分、评论数、品牌、库存状态、图片、特点、卖家名称与评分、配送方式以及送达时间——并边走边翻页。
对它排序、做透视,或导入你的数据仓库。把这次运行保存为 Playbook,它就会按你设定的任何计划重复执行。
其他方案都只有一种用法:给工具它想要的东西,拿回它给出的结果。
在那些竞品工具返回哪怕一行数据之前,你要么在填写 JSON 输入 schema,要么在编写电子表格公式,要么在搭建一个点击式模板。工具本身变成了项目。AllyHub 则按你口头说出来的方式接受请求。

这些工具大多只吃一种输入形式——这个只支持关键词,那个只支持 URL。要同时覆盖一次搜索和一个竞品的 ASIN 列表,你就得跑两个工具,然后再花一下午手工对齐两种不同的输出格式。

卖家、研究人员、商品运营人员和数据团队,他们需要的是亚马逊产品记录,而不是对它的主观看法。
你需要知道你的品类实际定价是多少,以及要有多少条评论才能被看见,而手工逐个查看商品页面,耐心耗尽得远早于产品被看完。把结果集拉进可排序的列,入场门槛就不再是猜测——它变成一个你能在上市评审中指着说的数字。
结论很扎实,但证据却是一堆没人能引用的截图。按固定节奏对同一范围运行,分析就能建立在一份带日期的数据集之上——这是客户或评审委员会可以自行核验的东西。
那份竞品规格表在有人手工做出它的那一周还是准确的。重新运行同一次抓取,对比就会自动刷新,于是路线图论证引用的是本季度的商品目录,而不是去年的。
自研爬虫在亚马逊一动模板时就会坏掉,而且总是在周五坏掉。把 AllyHub 指向相同的范围,每次运行拿到的列都一样——标记结构变了也无需修补选择器。
关于采集亚马逊产品数据以及你能用它做什么的快速解答。
亚马逊产品爬虫会读取商品页面,并把页面上印着的内容——标题、价格、评分、评论数、库存状态、卖家详情——作为结构化记录返回,而不是一个浏览器窗口。AllyHub 接受你描述的范围,为每个产品提取一条记录,并交回一份你可以排序、透视或导入的数据集。
是的。单次查询和小批量抓取在免费方案上不花任何费用。当你开始大规模提取、按计划运行,或把结果接入数据仓库或 BI 工具时,就属于付费方案了。
公开的亚马逊产品页面通常被视为公开可见的信息,而 AllyHub 只读取购物者浏览器本来就能看到的内容。话虽如此,亚马逊的服务条款和 robots 指令对你仍然适用,而且规则因司法管辖区以及你事后如何使用这些数据而异。这不是法律建议;在以此构建商业流程之前,请咨询你自己的法律顾问。
当你向 AllyHub 传入 ASIN 或产品 URL 时,是的。BSR 就印在产品页面本身上,所以它会被收录进每条记录。关键词搜索和分类列表页在任何地方都不显示它,这些运行返回时就不带这一列。当排名是分析的关键时,请直接传入 ASIN。
可以——这些条件是范围的一部分,而不是一次清理环节,因此经过筛选的运行永远不会收集它只会丢弃的行。不过它们必须是商品页面本身就会显示的条件;任何更细的筛选,请你在抓取之后再自行处理。
其他工具交回一堆转储数据,运行一结束就把页面忘得一干二净。AllyHub 保留的是运行本身,而不仅仅是它的输出——把一个已保存的运行指向不同的范围,也无需再设置第二遍。它随时间推移交付更好的结果。