sensedawn

我扫了 35148 个域名,才买下这一个

2026-08-03

这个站的域名叫 sensedawn.com。买它之前,我对着 Verisign 和 IdentityDigital 的官方 RDAP 接口发了 35148 次查询。

不是因为挑剔。是因为第一轮 69 个候选全军覆没之后,我意识到自己对域名市场的认知是错的。

先看结论

十五个批次,35148 个候选,10117 个可注册。

批次 查询 可注册 可用率
AI/出海英文词组合 69 0 0%
纯拼音 .com 25 0 0%
真实单词(希腊/拉丁/太空/航空/影视/具身智能) 296 3 1.0%
神话专名/天文星名/日语/北欧语纯词 330 4 1.2%
英文 .ai 55 2 3.6%
航海隐喻 + 动词前缀 65 6 9.2%
热门长词 + 短词拼接 4188 470 11.2%
直白 AI 词组合 3810 506 13.3%
可念熟词 + 动物意象 6964 1441 20.7%
品牌造词 + 赛道组合 1613 400 24.8%
美词截断变形 3698 1149 31.1%
词根拼接造词 1246 420 33.7%
意象词两词/三词组合 3539 1352 38.2%
AI 意象组合 5173 2250 43.5%
AI 缩写词组合 4040 2108 52.2%

把这张表按可用率排一下,会看到一条非常干净的曲线:

越是"词典里有的词",可用率越接近 0;越是"词典里没有的词",可用率越接近 50%。

这不是巧合,这就是结论本身。

词典已经被扫完了

我原本以为,冷僻词还有机会。于是扫了 296 个真实单词——不是 clouddata 这种,是我特意从希腊语、拉丁语、天体力学、航空工程、电影胶片工艺、机器人学里挑出来的冷僻词。

296 个里剩下 3 个。

被注册掉的包括这些:

然后我换了个方向,去扫神话专名、天文星名、日语美学词、北欧语——想着这些至少不在英文词典里。330 个,剩下 4 个,而且全是 fracastoriuscircumzenithal 这种没法当品牌用的长词。

没了的包括:

这些词的 .com 全部有主。 不是被某个热爱瑞典语的人注册的——是被程序批量扫走的。域名投资者早就把全世界所有语言的词典都跑了一遍。

所以第一个结论是:"找一个还没被注册的好听的词"这件事,在 2026 年已经不存在了。 不管你翻哪本词典,哪门语言。

能拿到的,都是爬虫看过一眼后放过的

真正有意思的发现,在反过来看的时候。

我扫的每一批组合里,有些词几乎在每个可用组合里都出现,有些词一个都没剩。这个分布不是随机的——它是域名投资者词表的负片

一批"意象词 + 角色词"的组合(skynomad 那种构词法)扫下来:

再看一批 AI 相关的:

emerge 这个词特别说明问题。对大模型领域来说,"涌现能力"(emergent abilities)是最核心的概念之一;同时它就是一个普通英文词,普通人也认识。它按理说不该有货。

但它有货,因为域名投资者的词表是按"通用商业价值"排序的,他们不懂垂直领域。同样的还有 gyro(陀螺仪——无人机和具身智能的核心部件)、kite(风筝——低空经济的天然意象)、helix(螺旋)。这些词在通用商业语境里平平无奇,在特定赛道里是核心词。

这就是唯一还剩下的套利空间:你比爬虫更懂你自己的行业。

一个我自己犯的错

这一段才是我真正想记下来的。

扫到中后段,我一直在找"既有意象又不冷僻"的词,把 llmgptrag 这类当下天天在说的缩写完全漏掉了。有人随手搜了一下 llmdawn.com,还在。

我第一反应是"那我扫一遍"。扫完之后,llm 系统里只出现了 4 个可用组合,而且 llmdawn 不在其中。

它压根没进过扫描队列。

原因是我在生成候选时写了一个可读性过滤器,其中一条规则是「不允许四个连续辅音」——用来挡掉 thalassyx 那种没法念的东西。而 llmdawn 的前四个字母是 l-l-m-d,四个辅音,被直接丢弃。gpt 系同理,所有 gpt + 辅音开头的组合全部消失。

这条规则本身没错:缩写是按字母读的(L-L-M-dawn),它不该套用给单词设计的音节规则。错的是我让一个自动过滤器替我做了判断,而它不会告诉我它删了什么。

修掉规则重扫,同一批词出来 2108 个可用,可用率 52.2%——是所有批次里最高的。

这个教训比域名本身有价值得多:

任何自动筛选都在替你做判断。它的输出你看得见,它丢掉的东西你看不见。 当结果不符合直觉时,先怀疑筛选器,而不是先怀疑世界。

我当时给出的结论是"AI 相关的好域名已经没了",而真相是"我的正则表达式把它们全删了"。如果没有人随手搜那一下,这个错误结论会一直站着。

方法:RDAP,不是 whois

顺便说下方法,因为它很简单,任何人都能复现。

查域名是否被注册,别用 whois——输出格式各家不同,还有速率限制。用 RDAP(Registration Data Access Protocol),它是 ICANN 强制要求的标准接口,返回 JSON,语义明确:

各顶级域的 RDAP 端点从 IANA 的官方 bootstrap 文件拿,不要猜:

curl -s https://data.iana.org/rdap/dns.json

常用的几个:

.com/.net  https://rdap.verisign.com/com/v1/domain/{name}
.ai        https://rdap.identitydigital.services/rdap/domain/{name}
.dev/.app  https://pubapi.registry.google/rdap/domain/{name}

一个最小的批量查询:

check() {
  code=$(curl -s -o /dev/null -w "%{http_code}" --max-time 20 \
    "https://rdap.verisign.com/com/v1/domain/$1.com")
  [ "$code" = "404" ] && echo "可注册  $1.com"
}
export -f check
cat names.txt | xargs -P 16 -I{} bash -c 'check {}'

并发 16 到 20 是安全的,实测 6964 个候选跑完约 9 分钟。

一定要加一条对照测试:拿一个随机乱码域名去查,确认它返回 404。我扫到一批 69 个候选全部返回"已被占"时,第一反应是脚本坏了——查了乱码域名确实返回 404,才确认那 69 个是真的全没了。结果太整齐的时候,先验证工具。

最后

sensedawn.comsense + dawn:先感知,后破晓。两个词都是最基础的英语,不用解释,也不绑定任何一代技术。

它能被我买到,唯一的原因是:在爬虫眼里,它不值钱。

这也是我从三万五千次查询里得到的最实在的一条:

你现在能买到的每一个域名,都是被程序看过一眼、判断"没有商业价值"之后放过的。 所以不要指望域名本身升值。它的价值,100% 来自你往上面注入了什么。

买域名这件事,唯一值得花的时间是想清楚要做什么。剩下的,四十分钟和四十小时的结果不会有本质差别——我花了后者,所以可以负责地这么说。

← 回到首页