AllyHub
趋势监测

TripAdvisor 数据抓取器

TripAdvisor 页面发布的内容不止星级平均分。AllyHub 返回平均分所掩盖的部分,并附上排名读取日期。

在下方输入内容

TripAdvisor 数据抓取器能做什么

一个房源页面包含排名、五分制评分、一组类别评分,以及一份可以从六个维度切分的评论列表——而大多数导出只返回前两项。AllyHub 则沿着页面逐层处理:条目、其下的评论、拆分后的评分、你要求的切片,覆盖你指定的每一个房源。

条目本身

某个城市或类别的酒店、餐厅或景点,每个都包含其气泡评分、评论数、排名字符串、地址和价格区间。

其下的评论

一条评论作为其房源下方的一行出现:客人写了什么、给出的气泡评分,以及它实际描述的行程。

拆分后的评分

在房源有这些数据的情况下,TripAdvisor 公布的类别评分会作为独立列返回——位置、清洁度、服务、性价比、客房、睡眠质量——同时还有每种旅行者类型给它的评分。

拉取前先切分

一开始就指定切片,其余内容就不会被抓取:星级、一种旅行者类型、人们实际到访的月份、一种语言,或你需要查找的某个词。

十个房源,一张表

同时运行你的竞争组合、某个城市的整个类别,或某个集团自己的组合;房源名称会随每一行一起出现。

然后更进一步

可以导出为 CSV、JSON 或 Excel,也可以保持运行并询问哪些投诉反复出现,或在固定旅行者类型后两个房源有何差异。

如何使用 AllyHub 提取 TripAdvisor 数据

指定地点或粘贴链接,说明要哪些评论,即可将 TripAdvisor 数据以行形式返回。

01

定位你的业务或类别

一个城市和一个类别、一个房源 URL,或一份竞争对手列表。然后说明你想要哪些评论,以及要追溯多久。

02

AllyHub 提取评论数据

每个地点:名称、评分、评论数、排名字符串、地址、价格区间。每条评论:文本、气泡评分、入住月份、发布日期、语言、旅行者类型、子评分,以及任何管理方回复。

03

分析并构建竞争情报

拿走文件,或继续针对同一次拉取提问。将房源集合保存为 Playbook,下一季度的基准就已经建好了。

为什么选择 AllyHub 的 TripAdvisor 数据抓取器

大多数 TripAdvisor 导出只返回一个平均分和一个计数。它们来自的页面所表达的内容远不止这些。

#1 不是评分

排名是根据评论的质量、时效和数量构建的人气位置,其权重 TripAdvisor 并未公布。第四名变成第七名可能意味着竞争对手变活跃了,而不是你变差了,所以每个排名都会附带其类别、总数和日期。

Extract More Than Text

已经拆分的评分

一个五分制单一数字平均了想要不同东西的人。在房源有这些数据的情况下,TripAdvisor 已经将各部分分开——清洁度与性价比、家庭旅客与商务旅客——而每次导出又把它们折回成一个数字。保留这些列,投诉就有了具体指向。

Bulk Extraction, Any Scale

行程早于评论

TripAdvisor 会记录某人何时出行以及何时发布,两者可能相隔数月。一条三月的评论可能描述的是去年八月的入住,早于你想观察其效果的翻新。两个日期都会返回,因此你可以按任一日期来阅读。

From Extraction to Action

一个会变化的类别

季度之间,类别本身也在变化:新房源开业、排名重新洗牌、评论数跃升。将你指定的集合和筛选条件固定到 Playbook 中,比较就仍然成立;而且因为你的 AllyHub 不必再从头开始,重新运行只是容易的那一半。

Workflows That Compound

谁在使用 AllyHub 的 TripAdvisor 数据抓取器

酒店和房源运营商、餐饮集团、酒店业研究人员,以及需要解释某个排名而非仅仅报告它的顾问。

酒店与房源运营商

你下降了三个名次,而业主会议就在周四。平均分几乎没变,所以答案不在平均分里。带上附有日期的排名,以及与竞争对手房源并列的类别评分,你带来的就是理由,而不是一张截图。

餐厅与餐饮集团

集团看起来健康,因为气泡平均分是累积的,而某个门店最近六个月可能一直表现不佳,但总体数字很久都不会承认这一点。单独查看每个地点近期的切片,正在下滑的门店就不再藏在自己的历史里。

旅游与酒店市场研究人员

一项目的地研究需要以相同方式记录两百个房源,而手动复制评分和排名恰恰会引入同行评审者会发现的那类错误。一次性采集它们,并在每一行带上类别和读取日期,这个数据集就可以交给别人。

酒店业顾问与咨询师

客户问为什么路那头的店比他们表现好,而“评论更好”并不是一个发现。将两组类别评分并排放在一起,并按出行人群拆分,差距就会显现为家庭旅客中的性价比,或情侣中的服务——这是他们可以采取行动的地方。

关于 TripAdvisor 数据抓取器的常见问题

人们在 TripAdvisor 上做基准测试前会问:返回什么、这些数字实际意味着什么,以及一次运行止于何处。

什么是 TripAdvisor 抓取器?

它将 TripAdvisor 页面转化为记录——某个地点的房源及其评分和排名,以及其下的评论——这样你就可以排序和比较,而不必逐一点击。AllyHub 接受用平实句子提出的请求,一次运行即可覆盖一个竞争组合或整个类别,并保留普通复制粘贴会丢失的类别评分和出行日期。

AllyHub 的 TripAdvisor 抓取器免费吗?

是的。包含标准条目和评论字段的单个房源可在免费方案上运行。更大的任务则属于付费方案:整个类别或一个竞争组合、更深入的评论拉取、采集时筛选、定期的季度重跑,以及对同一数据的分析处理。

我可以只拉取特定评论吗?

可以,而且在运行前决定比事后排序更好。按星级、旅行者类型、人们入住的月份、语言或关键词缩小范围,只会收集匹配的评论。评论者显示名称会按 TripAdvisor 发布的样子返回,因此请将该文件视为个人数据,只存储工作实际需要的内容。

如果某个条目没有全部这些数据怎么办?

较小的餐厅和景点发布的内容比大型酒店少:没有类别评分,旅行者类型拆分很少或没有,有时没有价格区间。这些字段会返回空值而不是猜测值,因此你可以看到数据在哪里变稀疏,而不会把空缺读成零。

“342 个中的第 1 名”实际意味着什么?

它是 TripAdvisor 针对该城市和类别的热门排名中的一个位置,而不是对质量的裁决。它反映评论有多好、多新以及有多少,并且当其他房源获得评论时它会变动。与评分和评论数一起阅读才有意义;单独阅读则只是一个标题。

它可以一次覆盖整个城市或一个竞争组合吗?

可以,而且这是常见的任务。给它一个类别和一个城市,或指定你正在关注的房源,它就会一次运行全部,并在每一行带上房源名称。将集合和筛选条件保存为 Playbook,季度基准就会自行重新运行。

TripAdvisor 抓取器 — 免费评论与评分数据 | AllyHub