今早刷到两条推送,愣了一下。
一条来自国家数据局:7 月 28 日的 2026 数博会新闻发布会上,副局长余英明确表示,"鼓励基于词元应用的商业模式创新,探索词元交易等新型交易模式",而这一届数博会的主题本身就是"词元——数据要素价值释放新路径"。
另一条来自杭州:就在 7 月 27 日,杭州市司法局公开征求《杭州市人工智能产业发展促进条例(草案)》意见,全国首次在地方立法层面引入词元(Token)概念,并作出促进生产、配置、使用的制度安排。
把这两件事放在一起看,再加上北京亦庄那家 6 月投产、一期日产能 1.4 万亿词元的"北京壹号词元工厂"——政策定调、地方立法、底层产能三股力量在同一时间段汇拢,词元经济从试点走向立法,已经不是传闻,而是正在发生的产业结构重组。
对做 GEO(生成式引擎优化)的一人公司来说,这意味着我们过去理解的"流量优化",正在从锦上添花变成基础设施。
先把事实摆清楚:词元是怎么走到立法层面的
很多人对"词元"的印象还停留在"大模型计费单位",但过去一个季度发生的事,把它推到了完全不同的位置。
- 2026 年 3 月:国家数据局正式将 AI 领域的计量单位 Token 定名为"词元"。
- 2026 年 3 月:国内日均词元调用量突破 140 万亿,相比 2024 年初的 1000 亿,两年增长超千倍。
- 2026 年 6 月 9 日:北京首家词元工厂在亦庄投产,由软通动力运营,一期日产能 1.4 万亿词元,远期目标 10 万亿;全市日均词元调用量超 200 万亿。
- 2026 年 7 月 27 日:杭州《人工智能产业发展促进条例(草案)》公开征求意见,首次在地方立法中引入词元概念。
- 2026 年 7 月 28 日:国家数据局在数博会发布会上明确"探索词元交易等新型交易模式",并提出推动形成"数据飞轮"效应。
💡 国家数据局对"数据飞轮"的定义很关键:以模型应用牵引数据供给、以数据赋能模型迭代。在这个闭环里,词元不仅是计量单位,更是连接数据、算力、模型和应用的结算纽带——用户按词元付费,收益反哺数据供给和模型研发。
换句话说,词元正在成为智能时代的价值标尺。而杭州草案更进一步:支持企业建设词元生产平台、交易结算平台、对外服务平台,推动词元服务在制造、政务、教育、医疗、金融、消费等重点行业示范应用。
这对 GEO 从业者意味着什么
我做 GEO 咨询这两年,最大的体感是:AI 搜索引用的不是"页面",而是页面里可被抽取、可被信任、可被计量的高质量信源。
过去我们做 GEO,优化目标是"让 AI 更愿意引用你"。但在词元经济的语境下,这件事的本质变了——你产出的每一条高质量内容,都是可计量、可定价、可交易的词元资产。
举一个具体的场景。当 AI 搜索回答用户"一人公司怎么选型 AI 办公系统"时,它会从全网抽取信源,按词元计量调用。如果你的内容被认定为高质量信源,那么每一次被调用,理论上都对应着词元经济里的价值回流——当然,具体的计费与分成机制,目前公开材料尚未给出统一细则,杭州草案也还在征求意见阶段。
但方向已经清晰:GEO 从"顺手做"的流量优化,变成"按词元计费"的资产经营。
对一人公司而言,这是利好,也是挑战。利好在于:小团队只要能持续产出高质量信源,就有机会在词元经济体系里拿到定价权;挑战在于:过去那种"堆量 + 蹭热点"的内容策略,在词元资产的逻辑下会迅速贬值。
⚠️ 三个最容易踩的坑
坑一:把"被 AI 引用"等同于"词元资产"
被引用 ≠ 高质量信源。国家数据局正在推进高质量数据集建设,截至 2026 年 6 月,全国已建成超 12 万个高质量数据集,数据总体量超过 1565 拍字节,并已对 12 个数据集、超 4563 万条数据完成检测。认定标准是客观存在的,而且会越来越严。
如果你产出的内容经不起"高质量信源"的基准检测,那么在词元经济的定价体系里,它的估值会很低——甚至不被计入。
坑二:单一平台依赖
词元交易规则、高质量信源认定标准,目前还在形成期。杭州草案开了地方立法的头,但全国性的认定细则尚需时间。如果只押注某一个平台的词元计价规则,政策微调就可能让你的"资产"缩水。
这跟一人公司做 AI 办公选型是一个道理:核心客户数据留本地,不锁死单平台。
坑三:把 GEO 当成纯技术问题
词元经济立法之后,GEO 的本质会从"技术优化"回到"内容资产经营"。没有真实业务流、没有原创洞察、没有可信数据的内容,再怎么优化也变不成词元资产。我见过太多人花大价钱买 GEO 工具,但内容本身没有可被人引用的独特价值——这在词元经济里就是空气。
一人公司的行动清单
如果你做 GEO,或者正在考虑把内容业务升级为词元资产经营,下面这三步本周就能启动:
1. 跑一遍 GEO 基线监测
参照春雪旅游在 GEO 首测中的做法——8 项测试拿了 5 项 B 级,说明即便是标杆案例,也有约三成内容未达优。先看清自己站在哪,才知道优化空间在哪。
具体做法:
- 选 8-10 个你最核心的业务关键词
- 在主流 AI 搜索(豆包、Kimi、通义、DeepSeek 等)中提问
- 记录你的内容是否被引用、以什么形式被引用、引用的是哪一段
- 按 A/B/C/D 四级自评
2. 建立"高质量信源"自检机制
对照国家数据局高质量数据集的建设标准,问自己三个问题:
- 我的内容有独家数据吗?(哪怕是你自己业务的脱敏数据)
- 我的内容有可验证出处吗?(引用权威来源、标注时间)
- 我的内容有结构化表达吗?(让 AI 容易抽取)
3. 关注立法与平台规则的演进
- 搜"杭州 人工智能产业发展促进条例 草案"跟踪词元相关条款的最终落地
- 关注国家数据局数博会(2026 年 8 月 28-30 日贵阳)的后续发布
- 留意北京亦庄词元工厂的开放接口——亦庄已在探索以词元交易为基础的数据定价模式,并规划了词元分发调度中枢
📌 词元经济立法窗口刚开,早做基线的人能拿到更早的定价权。但这不是让你 All in,而是让你从今天开始,用"词元资产"的视角重新审视自己产出的每一篇内容。
写在最后
我前天给一个做独立 SaaS 的朋友做 GEO 诊断,他问我:"我现在开始做,晚不晚?"
我的回答是:词元经济立法才刚起步,远没到晚的程度;但"随便写写就能被 AI 引用"的红利期,确实在关闭。
北京亦庄词元工厂一期日产能 1.4 万亿词元,远期 10 万亿;杭州用地方立法把词元定为独立的经济要素;国家数据局把数博会主题定为"词元"。这三件事传递的信号是一致的——词元正在成为智能时代的价值标尺,而 GEO 从业者,就是这批标尺的第一批校准员。
校准员的价值,取决于你手里有没有真东西。
所以与其焦虑"要不要跟进词元经济",不如今晚就做一件事:打开 AI 搜索,搜一个你最熟悉的业务关键词,看看你的内容排在第几位、以什么形式被呈现。
这个结果,就是你词元资产估值的起点。