2013年,谷歌提出”知识图谱”概念,斯诺登事件震动全球,大数据刚刚从一个技术名词变成商业热词。
那一年,中山大学孙伟教授团队发表研究成果,提出了一套名为”数据空间”的技术架构——分布式多签名存储、标准化数据定义、动态标签、加密与细粒度访问控制。更关键的是,这套架构的核心原则只有四个字:个人数据主权。
在此之前,”数据主权”这个词还几乎不存在于中文语境里。欧盟的GDPR要到五年后才正式生效。
两年后的2015年,德国工业联合会联合弗劳恩霍夫协会发起了”Industrial Data Space”计划——比这家德国国家级产学研联合体的启动,早了整整两年。
德国的实践:主权驱动,工业先行
德国的工业数据空间(后发展为国际数据空间协会,IDSA)从一开始就带着浓厚的工业基因。
三个核心原则:标准化、互操作性、数据主权。没有任何一个关于”大数据”或”AI”的口号,全部围绕一个命题展开——如何在不交出控制权的前提下共享数据。
IDSA的架构设计有几个今天看来仍然很高明的决策:
第一,连接器(Connector)作为核心。数据不是直接发给需求方的,而是通过一个标准化的”可信连接器”传输。连接器不负责判断数据内容,只负责执行事前约定的使用控制策略——数据可以用于什么目的、使用后必须何时删除、是否允许转发给第三方。这解决了”数据给了别人就控制不住”的信任死结。
第二,角色分离。数据提供方、数据使用方、身份认证方、认证中心、应用商店——每个角色的职责和接口都是标准的。这不是技术上的天才设计,而是制度工程学上的明智选择:把治理责任拆分成标准模块,谁认证、谁授权、谁审计,一清二楚。
第三,在制造、医疗、能源三大领域同时铺开试点。Catena-X汽车供应链数据空间是其中最有名的案例——宝马、奔驰、大众加上博世、大陆等一级供应商,通过统一的数据空间接口共享碳排放数据、零部件追溯信息。不是因为”政策要求”,而是算过了账:供应链数据标准化的协同成本,远低于多对多定制对接的总成本。
中国的节奏:后发,但加速
中国在数据空间领域的政策推进是一个明显加速的曲线。
2016年:数据空间概念首次进入”十三五”国家科技创新规划。
2023年10月:国家数据局成立。
2024年8月:第一批数据空间建设试点公布。
2024年11月:《可信数据空间发展行动计划(2024—2028年)》发布,三大核心能力一锤定音——可信管控、资源交互、价值共创。
这个推进节奏有多快?IDSA从2015年概念到2019年IDS 3.0架构花了四年,中国从国家数据局成立到试点落地不到一年。这不是技术成熟度的差异,是制度推进力度的差异。
从专利数据也能看出结构变化:2019年至2024年上半年,中国在全球数据空间相关专利申请中的占比持续攀升,已超过德国。产能正在从”跟随”转向”并行”甚至”领跑”。
演进三阶段:从封闭到生态
数据空间的演进可以概括为三个阶段:
第一阶段:封闭生态。少数成员、预设信任、静态规则。比如一个汽车企业+其核心供应商的封闭数据圈。
第二阶段:开放接入。参与者可以动态进出——Catena-X的模式。上下游企业按需加入、按规则使用数据、按约定分配价值。
第三阶段:多生态协同。多个数据空间之间的互操作。汽车供应链数据空间和保险数据空间之间怎么通信?金融数据空间和政务数据空间之间怎么互认?——这是当前最核心的技术和政策挑战。
中国正处于从第二阶段向第三阶段跃迁的关键期。规则尚未固化的时候,参与的每个主体都有机会影响规则本身。
IDSA用了八年证明了一件事——数据空间的瓶颈从来不是技术,是共识。中国用两年加速证明了一件事——共识一旦到位,工程落地可以极快。