网站抓取

将网站信息导入接待员的知识库。

网站抓取让接待员从现有网站学习:FAQ、服务说明、政策以及网站上发布的其他内容。

来源类型

添加网站来源时,可选择:

类型功能适用场景
单个页面读取一个指定 URLFAQ 页面、定价页面、特定政策
整个网站查找并读取网站中包含业务信息的页面主网站

URL 必须使用 HTTPS。

如何读取整个网站

Reception.ai 会读取网站地图和首页链接,然后选择最可能包含业务信息的页面,例如服务、定价、团队、地点和帮助文章。图库、博客文章和法律声明等页面会被跳过。

扫描运行时间读取页面数
快速扫描引导设置期间最多 15 个
深度扫描添加整个网站或读取网站其余内容时最多 80 个

Facebook、Yelp、Vagaro、Booksy 或 Calendly 页面等预订平台和社交资料页始终会作为单个页面读取。

读取网站其余内容

引导设置只会运行快速扫描,因此不到 1 分钟即可完成。要导入其余页面,可在首页选择 读取网站其余内容,或在网站来源中选择 读取更多页面。深度扫描可能需要几分钟。

状态

处理期间,来源会显示当前步骤,例如抓取或提取。完成后会显示 已就绪 或 错误。

在来源中选择 显示抓取的页面,即可查看已读取的页面。

如果无法读取网站,请检查地址。某些网站会阻止自动访问,例如启用了反机器人保护。此时可添加单独的页面,或将内容作为文件上传。

保持内容最新

网站会随时间变化。对于单个页面,选择 重新处理 即可再次读取。对于整个网站,选择 读取更多页面 即可刷新全部内容。修改网站上的定价、服务或政策后,请执行此操作。