官网上线不是「设计稿做完、页面能打开」就算完事。下面这份清单是我们每个项目上线前都要逐条过的,也欢迎你拿去核自己现在这个站——很多问题不用改代码就能发现。
一、能不能被找到
- robots.txt 存在且没有误封。 见过整站被一行 `Disallow: /` 挡住半年的。
- sitemap.xml 真的能访问。 robots 里声明了 sitemap、点开却是 404,是极常见的一种,而且没人会主动发现。
- sitemap 跟随内容更新。 构建期生成的快照,加了新文章不会进去。
- canonical 每页各自声明。 只在根布局里写一次,等于所有子页都在对搜索引擎说「我是首页」。
- 404 页面存在,且没有把错误页返回 200。
- 主流大模型抓取器是否放行(GPTBot、ClaudeBot、PerplexityBot 等)。要不要放行是个商业决定,但至少应该是个决定,而不是没想过。
二、机器读不读得懂
- Organization 结构化数据里有 `legalName`(工商全称),不是只有品牌名。
- `sameAs` 指向你其他的官方站点与账号,让机器确认这些是同一个主体。
- 地址、电话字段是真的。 我们见过公司注册在广州、结构化数据里却写着「上海」的,一直没人发现。
- 面包屑、文章、常见问题各自有对应的结构化数据。
- og 与 twitter 标签齐全,微信、QQ、微博转发时才有像样的卡片。
- llms.txt:一份给大模型读的站点说明。还不是标准,但成本极低。
三、打得开、打得快
- 证书有效且自动续期。 手动续的证书总有一天会在周末过期。
- Core Web Vitals 三项达标(最大内容绘制、交互到下一次绘制、累积布局偏移)。
- 中文字体不要整包加载。 一个中文字体动辄 1–5MB,按真实用字表做子集能减掉七成以上。
- 图片用现代格式并按需缩放。 一张 4MB 的原图放在首页,前面所有优化都白做。
- 移动端零横向溢出。 用真机或无头浏览器逐档宽度客观扫描,不要只靠眼睛看。
四、能不能查到出处
- 页脚有公司全称与备案号。 这是背调时第一个被看的地方。
- 站内所有数字口径一致。 首页写 500、案例页写 1000,AI 抓到哪个算哪个。
- 每个对外数字都拿得出证据。 拿不出的,删掉比留着安全——《广告法》对无法举证的表述是有实际风险的,而且被 AI 复述放大之后更难收。
- 案例里的客户名已获授权。 客户的商业信息不归你处置。
- 没有占位符残留。 真见过上线一年的站,案例视频地址还是 example.com。
五、上线之后
- 表单真的能收到。 上线当天自己提交一次,确认落库并有通知。
- 埋点与统计装了并且在跑。
- 备份策略与回滚流程存在,并且演练过一次。 没演练过的备份不算备份。
- 冒烟测试要经过正式入口打(走域名与反向代理),不要打本地端口——打本地端口会一路绿灯放过真故障。
这份清单里最容易被忽略、代价又最大的三项:sitemap 声明了却 404、结构化数据缺工商全称、站内数字口径打架。三项都不需要重做网站就能修。