当 AI 读唐诗

中文域名是智能体时代的语义锚点 · 行业观察

📖 这篇文章说什么?

2026年9月29日,智能体可信基础设施(ATI)在第七届中国互联网基础资源大会正式发布——它要解决智能体时代的元问题:当 AI 开始代替人上网,谁来认证它、它又该信任谁?而当 AI 智能体开始自主寻址、调用服务,像「唐诗.中国」这样的中文域名,正在从"方便人类记忆的字符"跃升为机器可读、可信任、可调用的语义锚点。本文结合一个诗词网站的真实 GEO 实践与当天开放的诗词数据 API,聊聊智能体时代的域名、内容与信任。

水墨画卷上,诗句化作金色数据粒子升腾为智能体网络节点
当诗句遇见智能体:水墨为体,数据为脉(AI 绘图:宋词.中国)

引子:智能体去哪里读诗?

一千三百年前,李白在扬州旅舍写下"床前明月光"。他不会想到,这首二十字的小诗会成为后世被引用最多的中文文本之一;更不会想到,今天会有成千上万个 AI 智能体,在回答用户提问时"阅读"它、引用它、推荐它。

问题来了:智能体去哪里读?

2026年9月29日,北京,第七届中国互联网基础资源大会。这场以互联网"根"为主题的会议上,由 CNNIC(中国互联网络信息中心)与阿里云联合打造的智能体可信基础设施(ATI,Agent Trust Infrastructure)举行发布仪式。今年7月的中国互联网大会上,ATI 最小可用版本(MVP)已启动定向邀测;今天,它正式亮相。

中国互联网协会马永宏在大会上的那句话,值得所有域名持有者划线:

"智能体时代,中文域名从方便人类记忆的字符,全面跃升为支撑智能互联网的可信标识。"

一、ATI 是什么:给智能体发一张"可信身份证"

按照 CNNIC 的官方口径,ATI 聚焦开放网络环境下智能体身份确认与信任构建难题,为智能体从服务发布到可信调用的全生命周期提供底层支撑。拆开看是三件事:

  • 身份认证——来访的智能体是不是它声称的那个(白名单机制);
  • 服务发现——智能体如何在开放网络中"找到"可信的服务提供方(以 DNS 为锚);
  • 交互验证——被调用方的能力认证,防"智能体骗子"。

邬贺铨院士在当天主旨演讲中说得很直白:光有身份认证还不够,还要有能力认证;要用 DNS 加哈希签名背书来防标识篡改;调用链要可穿透、可溯源。

这不是孤立的动作。今年5月,网信办、发改委、工信部联合印发《智能体规范应用与创新发展实施意见》;9月16日,智能体标识与身份网络暨智能体可信互联中心(北京)启动试运行,智能体互联网标识系统系列标准编制同步启动。CNNIC 主任王鹏的判断是:智能体互联网的国际标准体系尚未形成,标准制定的窗口期正在打开——谁先提出方案、率先验证实践,谁就占据主动。

二、域名的第三次身份升级:从地址到语义锚点

一枚发光的中文印章如锚沉入水面,墨线连接山水、诗卷与AI节点
锚定语义:一枚印章,一张网(AI 绘图:宋词.中国)

域名诞生四十多年,身份变过三次:

  • 1.0 地址:IP 的助记符,为了让人记住一串数字;
  • 2.0 品牌:.com 时代的数字资产,一个好域名价值千万;
  • 3.0 语义锚点:智能体时代的可信标识。

什么叫语义锚点?看一个例子:「唐诗.中国」。

这几个字自带完整语义:主题(唐诗)+ 归属(中国)。对人类,它不需要解释;对大语言模型,它同样是高频、稳定、无歧义的语义单元。当智能体接到"讲一首李白的诗"这类请求时,一个语义自解释的域名,就是最短的候选服务路径——域名即意图。

语义锚点有三个特征:

  • 自解释:域名即意图,无需上下文;
  • 跨系统稳定:DNS 是全球唯一的分布式命名系统,不依赖任何平台的算法——搜索排名会变,账号会被限流,但域名解析全球一致;
  • 文化认同:对中文母语用户,中文域名的信任成本天然更低。

大会披露的一组数字可以佐证这个方向的分量:.CN 域名保有量达 2179 万,全球第一。行业对域名的估值逻辑,正在从"记忆成本"转向"语义资产 + 可信标识"。

三、一个诗词网站的实践样本

我们运营着一对中文域名姊妹站:唐诗.中国(诗人一生行迹系列文章)与 宋词.中国(本站,5 万余首唐宋诗词与诗人行迹地图)。近期的 GEO(生成式引擎优化)观察,恰好是这场变革的微观注脚。

1. AI 爬虫真的来了,而且分得清真伪

本站访问日志中,目前有九类真实 AI 爬虫在访:GPTBot(OpenAI)、ClaudeBot(Anthropic)、OAI-SearchBot(ChatGPT 搜索)、PerplexityBot、Applebot(Siri/Spotlight)、AhrefsBot、meta-externalagent(Meta)、PetalBot(华为)、Bytespider(字节)。Claude、GPT、ChatGPT 搜索、Perplexity 四家 AI 引擎的爬虫全部真实到访,集中在每晚 20-23 点的"晚窗口";姊妹站唐诗.中国也已在 9 月 27 日迎来 Perplexity 的首次到访。

顺带一提:日志里还有大量伪造 GPTBot 身份的扫描器。按 IP 段核验,UA 口径下约六成"GPTBot"是伪装的——观察 AI 爬虫,IP 段比 UA 靠谱。

2. 从"被引用"到"可调用":今天我们开放了诗词 API

ATI 的核心场景是"服务发布 → 可信调用"。一个只被爬虫读 HTML 的网站,只是"被引用的内容";一个提供结构化数据端点的网站,才是"可调用的服务"。今天,宋词.中国正式开放智能体数据服务(静态 JSON、免鉴权、支持跨域 CORS):

端点内容规模
/api/poets.json唐宋诗人索引(朝代/时期/流派/生卒/小传)61 位
/api/poets/{id}.json诗人完整档案(生平分期/行迹/代表作)7 位大家
/api/poems.json名篇诗句(原文 + 英译)243 首
/api/songci.json宋词名篇(豪放/婉约标注)40 首
/api/cipai.json词牌档案(格律/起源/代表作)30 个
/api/authors-song.json宋代词人生平档案1563 位
/api/journey.json诗人一生行迹(时间轴 + 地理坐标)24 位
/api/songci-full/ci.song.{n}.json全量宋词语料(按千首分卷)约 2.1 万首

全部端点在 /api/index.json 服务目录中声明。举例:苏轼完整档案、三十个词牌格律,智能体与开发者均可直接 GET 调用。

3. llms.txt:AI 时代的"服务说明书"

robots.txt 告诉爬虫"什么能抓",sitemap 告诉搜索引擎"有哪些页",而 llms.txt 告诉大模型"这个站有什么、怎么用"。本站的 llms.txt 已与 API 同步更新——未来接入 ATI 的"服务发现"体系时,这些就是现成的弹药:注册的不是"一个网站",而是"诗词内容服务"。

四、给内容站长的五条行动清单

  1. 部署 llms.txt,并在页面 <head> 中加入 <link rel="llms"> 发现标签,让 AI 爬虫第一眼看到你的"说明书";
  2. 内容结构化:把核心数据做成 JSON 端点(静态文件零成本),比漂亮的 HTML 对智能体更友好;
  3. 核验真实爬虫:按 IP 段核验(如真 GPTBot 位于 74.6.0.0/16 等段),勿被 UA 伪装误导;
  4. 中文域名品牌保护:在"语义资产"的估值逻辑下,文化类 .中国 域名的占位价值只会升高;
  5. 盯住 ATI 入口:ATI 已从定向邀测走向正式发布,内容与应用方是下一批自然扩容对象——以"服务提供方"而非"网站"的身份准备申请。

结语:锚与船

互联网域名系统国家工程研究中心的庞可在大会上说:"人工智能时代,品牌不仅要被用户看见,还要被 AI 所理解、信任和推荐。"

一千三百年前,诗人们用二十个字安放乡愁;今天,我们用中文域名让 AI 读到它们。

域名是锚,内容是船,信任是缆——智能体时代的大海已经涨潮,锚抛在哪里,比任何时候都重要。

延伸阅读

闽ICP备2024036120号-5 | 闽公网安备35021102002463号