7月24日,钱江世纪公园,ZODA House正式启用。
这座与国际最前沿AI社区空间范式接轨的沿江建筑,吸引了百余位全球顶尖开发者、创业者和学术专家,共同开启一场关于开源生态的“头脑风暴”。它将成为灵感碰撞、黑客松(Hackathon)和技术闭门会的承载地。
今年5月18日,数搭国际数据开源社区(ZODA)正式亮相。ZODA House的启用,标志着短短60余天,这一生态从线上走向了线下。

与Hugging Face、魔搭社区等聚焦“模型开源”的开源社区不同,ZODA聚焦的,是高质量数据集、模型评测体系与全球专家网络建设,致力于打造面向下一代人工智能的数据开源社区。
如果说DeepSeek和通义千问让杭州证明了其在开源模型领域的顶尖实力,那么ZODA的能力“递进”,意味着杭州正在从“开源模型”走向“开源数据”。这条路径,或许才是“全国人工智能创新发展第一城”真正的护城河。
要说清楚ZODA和ZODA House的分量,得先看清杭州的AI家底。
当北京拼算力、上海拼芯片、深圳拼硬件制造时,杭州押注了“开源”。这不仅是技术路线的选择,更像是这座“全国人工智能创新发展第一城”写在基因里的某种特质。DeepSeek和通义千问两大开源模型,已把杭州推至全球AI开源的第一方阵。开源,早已是杭州AI最硬的底牌。
但开源生态不能止于模型。过去两年,行业流行“堆参数、扩规模”。但如今风向已经变了,AI竞争正在从拼参数、拼规模,转向拼数据、拼场景。
为什么数据如此重要?在ZODA社区生态负责人孟卓飞看来,在整个AI模型生产周期中,超过80%的时间花在数据准备和处理上,没有高质量、标准化的数据,再强的模型也难以落地。“模型的训练范式已经相对收敛,真正决定模型能力上限和不同厂家核心差异化的点,是数据的质量和品位。”
围绕AI发展的“算法—算力—数据”铁三角中,杭州在模型和算力方面已有先发优势,但数据环节缺少标志性开源平台。ZODA的出现,正好补上这块拼图。

据悉,ZODA之名,取意Z-Generation(Z世代)、Open-source(开源)、DAtasets(数据集)三个关键词——代表着最具创新精神的年轻一代,以开源协作的方式,共同定义数据的未来。其核心发起单位整数智能,正是由钱江世纪城“最初的伙伴”浙大计算机创新研究院孵化,多年来面向大模型、具身智能等前沿AI场景,提供从数据采集、数据清洗、数据标注、质量审核到成品数据集交付的全流程服务,将行业知识、专家经验和复杂场景数据转化为可训练、可评测、可交付的高质量数据集,并进一步提供Benchmark数据定制与大模型深度评测服务,持续验证和提升模型能力。
未来两年,ZODA的目标是,数据集累计下载量超2亿次,专家规模超100万人,发布200个以上评测榜单,覆盖100个以上国家和地区,吸引超200家AI企业入驻,带动AI数据产业规模突破100亿元。
而“数据开源”的能力,已经产生了实实在在的吸引力。一周前,清华系创业团队趋境科技最终选址杭州,在钱江世纪城建设AI Token工厂,关键考量之一正是ZODA的存在。
“这将是一个完整的闭环。”据趋境科技相关负责人介绍,万卡级Token工厂将与钱江世纪城芯模社区的算力适配、ZODA的数据与评测能力形成“芯片—模型—数据—Token”的完整链条,让钱江世纪城成为全国少有的具备全链条AI基础设施服务能力的区域。
如果说之前的模型开源是让模型代码“可见”,那么ZODA要做的是让数据“可用”且“可信”。
ZODA的打法很清晰,不是做一个单纯的数据仓库,而是围绕“高质量数据集、模型评测体系、全球专家网络”三大核心使命,通过串联科研、产业、专家三大生态,构建开放协作的 AI 数据与评测网络。
这套模式有个通俗解释,即“市场出题、科研共创、专家把关、全球开源、产业应用”。从金融、制造、机器人等行业征集真实数据需求,由ZODA联合高校和实验室组建项目团队,开展数据采集、加工、评测和标准制定,经过专家评审后面向全球发布。最终吸引开发者持续使用和迭代,形成行业标准。
ZODA House的启用,则让这个开源生态从线上延伸至线下。它不是办公空间,而是社区的“线下操作系统”——人才集聚器、项目加速器、场景连接器、全球会客厅。ZODA House面向全球顶尖开发者、创业者与学术专家,通过技术沙龙、黑客松(Hackathon)、闭门研讨打破物理隔阂,在行业研讨、极客交锋与生态共创中高频碰撞灵感,汇聚产业力量。

ZODA House启用当天,ZODA House迎来首批生态共建者——诺亦腾机器人、Mindverse(心洲科技)、共绩算力等10家企业正式集结。值得一提的是,诺亦腾机器人是一家面向具身智能与人形机器人产业的数据企业,此次带来了MOV-多模态大空间交互数据集的开源计划。这些企业的集体选择,意味着ZODA House正在成为一个“引力场”,把AI产业链上不同环节的创新力量汇聚到钱塘江畔。
可以说,从“模型开源”到“数据开源”,杭州正用“开源”这把钥匙,试图解开全球AI产业高地的那把“锁”。
显然,在“数据开源”这个新赛道上,钱江世纪城的布局逻辑清晰可见。
2017年图灵小镇规划建设,2023年AIGC智算中心上线2300P算力,2025年芯模社区启航。从算力筑基到芯模联动,再到今天的数据开源,一条产业演进路径已然成形,钱江世纪城在全国率先完成“芯—模—数—用”全链条AI产业拼图。
如今,ZODA社区和芯模社区构成了钱江世纪城AI产业生态的“一体两翼”。芯模社区解决“算力从哪来、模型怎么跑”——7.6万平方米的空间集聚10余种主流芯片、90余种大模型,入驻AI企业占比84%。ZODA社区解决“数据从哪来、模型好不好”——通过高质量开源数据集和覆盖全部主流模型的评测基准,为AI提供精准的“标尺”。

“模”与“数”合在一起,就是一个完整的闭环。高质量数据训练出更聪明的模型,模型在芯模社区验证芯片性能,芯片的优化反过来支撑更大规模的数据处理。这种深度协同,被业界形象地称为“模数共振”。
而ZODA House的存在,正是为这种“融合”提供一个“加速器”,让更多数据企业在这里碰撞、共创,让高质量数据的“开源”从理想变成现实。
钱江世纪城相关负责人介绍,随着ZODA House的启用,芯模社区与ZODA社区的“融合”正式按下加速键。这不仅是物理空间的相邻,更是底层要素的深度打通。未来,两者将共同打造“芯模数用”全链条生态:在“芯”的层面,国产芯片提供底层算力支撑;在“模”的层面,开源大模型提供算法底座;在“数”的层面,ZODA提供高质量语料与权威评测;在“用”的层面,依托萧山1700多家规上工业企业的真实场景,推动AI从实验室走向生产线。
这种“模数共振”的杭州实践,正是国家“数据-模型-场景应用”良性循环战略在区域层面的先行先试。
当ZODA House的灯光亮起,映照在钱塘江面上。从这里出发,杭州的“开源”故事,正源源不断地讲给世界听。
