# robots.txt —— 书法字典 # # 2026-10-04 站长口径: # "搜索引擎不让采集,不让采集的是 s.php 页和 Webjizi_dange3_1.php, # 但其它页面还是可以正常被采集" # "要把这四个也加进" → "都加上" # ⇒ **只有下面这 8 页拒绝采集**(= 全站所有"输入一回、吐一回结果"的查询页); # 别的页面一切照旧(搜索收录、链接预览、各种爬虫都正常)。 User-agent: * Disallow: /s.php Disallow: /Webjizi_dange3_1.php Disallow: /WebShici3_1.php Disallow: /gangbi.php Disallow: /s_m.php Disallow: /s_sl.php Disallow: /zkzd13.php Disallow: /zkzd_m.php # ⚠️ 说明:站长曾点名的 `WebShizi3_1.php` 在站上**不存在**(web/ 下搜 *3_1*.php # 只有 Webjizi_dange3_1.php 与 WebShici3_1.php)→ 这里**没写**它, # 避免留下永远不生效的死条目。 # # ⚠️ 这里与 includes/sec_guard.php 的「爬虫硬拦」是**同一份名单**(SEC_BOT_BLOCK_PATHS): # · 这里 = "规矩地请它别来"(守规矩的爬虫读到就自己停); # · 那边 = "来了也不给" (不守规矩的照样拿不到内容,连 GET 也拦)。 # 两边要**一起改** —— 否则会出现"说了别来、其实还进得来"(或反过来的不一致)。 # # ⚠️ 这些页面会从搜索结果里逐步消失(站长已知悉并确认)。 # 站上其它页面(文章 / 书法家 / 碑帖等)的收录与广告**不受影响**。 # # ⚠️ zhuanke.php 也在收 wd,但它**连守卫都没引**(既不在本名单、也不受限流等各层保护), # 要处理得改那个页面本身,不是在这里加一行。 # # ⚠️ 想全站都拦:把上面 8 行 Disallow 换成一行 `Disallow: /`, # 并把 sec_guard.php 的 SEC_BOT_BLOCK_SCOPE_ALL 改成 true。