无限滚动很酷,但蜘蛛爬不动你的内容

无限滚动 分页 内容发现

无限滚动这个交互,用户体验确实爽,往下滑内容源源不断,不用点下一页。但你要是拿来做内容站,我劝你三思,因为它在收录上是个老大难。

根本矛盾在于,无限滚动加载出来的内容,对用户是靠滚动触发的,对搜索引擎来说,它压根不知道后面还有内容。爬虫不像人,它不会滚动你的页面。它抓到的就是你初始 HTML 里的那些内容,后面滚动出来的几百条,它一条都看不见。

我见过一个做资讯聚合的站,全站无限滚动,收录量低得可怜。他们的内容其实很丰富,一天更新几百条,但搜索引擎只看到了首页那十来条。你说可惜不可惜。

那有没有办法兼顾。有,就是给无限滚动配一个分页的兜底。用户看到的是无限滚动,爽。但每个滚动加载的位置,你都要给一个真实的、可访问的分页地址,比如 /list?page=2、/list?page=3。用户滚到那儿,你用 JS 把它加载进来。搜索引擎呢,顺着这些分页地址一路爬进去,内容就都能抓到了。关键是分页地址必须是真的能打开、返回 200 的独立页面,不能是 JS 动态拼出来、刷新就丢的。

还有一个更简单的做法,就是别用纯无限滚动,改成加载更多按钮。用户点一下加载一批。按钮背后对应一个分页地址。这样既保住了体验,又给了搜索引擎路标。我自己的站现在都用这个方案,好用,问题少。

再就是 sitemap 的作用在这种场景下特别重要。你把所有内容页都放进 sitemap,哪怕用户界面不方便爬,搜索引擎至少还有一条路能找到它们。无限滚动加 sitemap 兜底,是目前比较稳的组合。

说到底,交互设计要考虑用户,也得考虑爬虫。只顾用户爽,把内容藏起来,搜索引擎是没法替你传播的。

—— 来自 挖的客 - 优秀网站分类目录 的分享

🔗 推荐网站

« 返回文章列表