AI+空间智能数据基础设施

世界模型
空间数据引擎

朗慧科技深耕3D空间智能,构建涵盖3D场景、点云、空间语义、数字孪生四大领域的18个高质量多模态数据集,覆盖照片建模、无人机航摄、激光点云、NeRF/3DGS重建全链路,为世界模型与空间智能提供从感知到生成的坚实训练底座。

18
高质量数据集
725万+
多视角照片
2000km²
航摄覆盖
1TB+
点云数据
world-model-training.py
import langhuiai as lh

# 加载3D场景多视角照片数据集
photos = lh.space.load_dataset(
  'photo-modeling',
  views=12,
  resolution='4K'
)

# 加载激光点云数据
pointcloud = lh.space.load_pointcloud(
  sensor='LiDAR',
  density='毫米级',
  area=1000000
)

# 加载空间语义标注
semantic = lh.space.load_semantic(
  level='实例/部件',
  classes=200
)

# 加载NeRF/3DGS训练对
nerf_pairs = lh.space.load_nerf(
  task='新视角合成'
)

print("✅ 世界模型训练数据加载完成")
AI+世界模型前沿进展

2025-2026 世界模型突破性进展

从Sora到Genie 2,从3DGS到V-JEPA,世界模型正成为通向AGI的关键路径,空间理解能力迎来质的飞跃

x:128.5
y:42.3
z:89.1
OpenAI 2025

Sora 2视频世界模型

OpenAI发布的Sora 2将视频生成推向新高度,能模拟物理世界规律,生成长达1分钟的连贯视频。被视作"视觉世界模型"的里程碑,可理解重力、碰撞、光影等物理常识,向AGI迈出关键一步。

1分钟视频 · 物理模拟
θ:45°
φ:120°
r:0.85
DeepMind 2025

Genie 2交互式3D世界

Google DeepMind发布Genie 2,单张图像即可生成可探索的3D虚拟世界,支持键盘控制角色移动、跳跃、交互。世界模型可在单帧图像上推理出可达1分钟的可玩3D环境。

单图生成 · 可交互3D
σ:0.012
λ:1.5e-4
PSNR:32
SIGGRAPH 2025

3D高斯泼溅(3DGS)突破

3DGS技术在新视角合成上全面超越NeRF,训练速度提升100倍,渲染达实时级。SIGGRAPH 2025多项论文将3DGS应用于动态场景、大尺度室外重建、可编辑3D内容生成。

100倍加速 · 实时渲染
t:0.5s
v:2.3m/s
a:0.8
Meta AI 2025

V-JEPA视频世界模型

Yann LeCun团队的V-JEPA 2基于联合嵌入预测架构,通过自监督学习从视频中学习物理世界规律,无需标注即可理解物体持久性、运动规律。被视作通向AGI的关键路径。

自监督 · 无需标注
N:1.2M
V:50K
E:200
CoRL 2026

具身智能世界模型

机器人领域世界模型取得突破,NVIDIA GR00T等模型让机器人通过"想象"未来场景学习操作技能。基于百万级3D场景数据训练,机器人可在未见过的环境中零样本执行任务。

零样本 · 具身智能
FPS:60
GPU:40GB
LOD:4
NVIDIA 2026

Omniverse数字孪生

NVIDIA Omniverse成为工业数字孪生标准平台,支持城市级、工厂级实时仿真。2026年集成生成式AI能力,可自动生成孪生场景、预测设备故障、优化生产流程。

城市级孪生 · 实时仿真
朗慧空间数据布局

长沙朗慧科技世界模型数据战略

深耕3D场景、点云、空间语义、数字孪生四大领域,构建从多源采集到智能标注的全链路空间数据基础设施

3D场景数据产品

多视角照片建模、无人机倾斜摄影、NeRF/3DGS训练对数据,覆盖物体/建筑/城市多尺度3D场景。

725万+ 多视角照片

点云数据产品

激光雷达LiDAR点云、毫米波雷达数据,含语义标注与实例分割,支撑高精度空间感知与建图。

1TB+ 毫米级点云

空间语义数据产品

园区/校园/工厂/古建/城市多场景高精语义数据,含实例级、部件级精细标注。

200+ 语义类别

数字孪生数据产品

城市/工厂/园区数字孪生数据底座,支持实时仿真、预测维护与协同决策。

2000km² 孪生覆盖

多源采集网络

整合无人机、激光雷达、多视角相机、移动测量车等多源采集设备,覆盖室内外全场景

高精重建技术

自研NeRF/3DGS/MVS重建算法,毫米级精度,支持大尺度场景实时重建与渲染

AI辅助标注平台

AI驱动的大规模语义标注平台,支持自动分割、实例识别、语义理解,效率提升10倍

全链路合规授权

严格遵循数据安全法规,所有空间数据均经授权采集,提供合规交付方案

空间数据集矩阵

18个核心数据集 · 覆盖四大空间智能领域

聚焦3D场景、点云、空间语义、数字孪生四大领域,构建世界模型训练数据底座

全部 · 18
3D场景 · 5
点云数据 · 4
空间语义 · 5
数字孪生 · 4
3D场景

照片建模数据集

多视角照片重建3D模型数据,覆盖物体、建筑与场景,支撑照片级三维重建与NeRF训练。

1200+模型 725万照片
3D场景

无人机建模数据集

无人机航拍倾斜摄影与正射影像数据,支撑大范围城市与地形三维重建。

2000km² 1600万航片
NeRF/3DGS

NeRF训练对数据集

图像到3D的高质量配对数据,含相机位姿、深度图、新视角合成监督信号,支撑NeRF/3DGS训练。

多视角配对 位姿标注
3D场景

3D模型拆分数据集

三维模型部件级拆分与装配数据,支撑可编辑3D生成与结构化重建。

部件级 可编辑
生成式

文本到3D生成数据集

文本-3D模型对齐数据,含Prompt、材质、几何描述标注,支撑文本生成3D内容AI训练。

文本对齐 3D生成
点云

激光点云建模数据集

激光雷达LiDAR点云数据,含语义标注,支撑高精度空间感知与建图。

1TB+ 毫米级
点云

自动驾驶点云数据集

车载LiDAR采集的户外大场景点云,含3D边界框、目标跟踪标注,支撑自动驾驶感知。

道路场景 3D框标注
点云

室内点云数据集

室内场景LiDAR扫描点云,含房间、家具、设备等实例分割标注,支撑室内导航与重建。

室内场景 实例分割
点云

毫米波雷达数据集

4D毫米波雷达点云数据,补充LiDAR在恶劣天气下的感知能力,支撑全天候自动驾驶。

全天候 4D雷达
语义

园区/校园/工厂高精语义

多场景高精语义数据集,含实例与部件级标注,覆盖建筑、道路、植被、设施等类别。

200+类 多场景
语义

古建/文物三维语义

古建筑、文物三维模型语义标注数据,含构件、纹饰、材质等精细标注,支撑数字化保护。

古建构件 文物精细
语义

城市级语义分割数据

大范围城市航拍语义分割数据,覆盖建筑、道路、车辆、行人等城市要素。

城市级 语义分割
语义

3D实例分割数据集

三维点云实例分割标注数据,支持物体级、部件级的精细3D理解,支撑机器人操作。

实例级 部件级
语义

全景分割数据集

2D/3D全景分割标注数据,融合语义分割与实例分割,支撑场景全方位理解。

全景 融合标注
孪生

工厂数字孪生数据集

智慧工厂三维孪生数据,含设备模型、产线布局、运行状态等多维信息,支撑工业元宇宙。

设备级 实时状态
孪生

城市数字孪生数据集

城市级三维数字孪生数据底座,含建筑、道路、管网、交通等城市要素,支撑智慧城市应用。

城市级 全要素
孪生

园区数字孪生数据集

产业园区、校园、景区三维孪生数据,含建筑、绿化、设施、人流等动态信息。

园区 动态人流
孪生

能源设施孪生数据集

电力、油气、新能源等能源设施三维孪生数据,支撑设备运维与故障预测。

能源设施 运维预测
数据样例

空间数据标注格式

展示3D场景、点云、空间语义、数字孪生四类数据的JSON标注结构

3D场景
点云
空间语义
数字孪生
scene-annotation.json
应用场景

AI+空间智能典型应用

基于朗慧世界模型/空间数据集的六大典型AI应用场景

三维重建

基于多视角图像或点云数据进行三维重建,构建高精度数字模型,支撑文化遗产、工业、建筑等领域数字化。

具身智能机器人

基于空间语义理解实现机器人自主导航、避障与操作,支持工业、服务、物流等多场景机器人应用。

数字孪生

构建城市、工厂、园区的数字孪生模型,支撑实时仿真、预测维护与协同决策,赋能工业元宇宙。

3D内容生成

基于文本或图像生成3D模型,加速游戏、影视、元宇宙内容创作,AI驱动内容生产革命。

AR/VR交互

基于空间感知实现AR/VR内容叠加与交互,支撑教育、培训、文旅等沉浸式应用。

自动驾驶

基于点云与多视角数据训练自动驾驶感知模型,支撑高等级自动驾驶的环境理解与决策。

常见问题

FAQ

关于世界模型/空间数据集的常见问题解答

世界模型/空间数据集覆盖哪些内容?

朗慧世界模型/空间数据集涵盖3D场景、点云数据、空间语义、数字孪生四大领域,18个核心数据集。包括照片建模、无人机航摄、NeRF/3DGS训练对、激光点云、自动驾驶点云、室内点云、毫米波雷达、园区/校园/工厂/古建/城市高精语义、3D实例分割、全景分割、工厂/城市/园区/能源孪生等,总计725万+多视角照片、1TB+点云数据、2000km²航摄覆盖。

数据适用于哪些AI应用场景?

适用于三维重建、具身智能机器人、数字孪生、3D内容生成、AR/VR交互、自动驾驶等六大典型场景。支撑世界模型、NeRF/3DGS、空间理解、具身智能等AI大模型的训练,为通用人工智能(AGI)提供空间理解能力训练数据,已服务多家科研机构与企业。

数据采集精度和覆盖范围如何?

采集精度达到毫米级(激光点云)、厘米级(无人机航摄)、4K/8K超高清(照片建模)。覆盖范围包括:室内外全场景、城市级大范围(2000km²航摄覆盖)、多尺度(物体/建筑/园区/城市)。采集设备涵盖无人机、激光雷达、多视角相机、移动测量车、4D毫米波雷达等多源传感器。

数据质量如何保证?

采用"专家审核+AI辅助"双重质控体系。自研AI辅助标注平台进行自动分割、实例识别、语义理解,效率提升10倍;专业团队对标注质量进行多轮审核。语义标注覆盖率达92%,重建精度达毫米级,数据更新频率为季度,确保数据的时效性与准确性。

支持哪些数据交付格式?

支持图像格式(JPEG/PNG/TIFF/RAW)、3D模型格式(OBJ/PLY/GLTF/FBX/USD)、点云格式(LAS/LAZ/PCD/PLY)、标注格式(JSON/XML/COCO/KITTI/NuScenes)、孪生数据格式(USD/Industry Foundation Classes)等多种交付方式。支持定制化交付与API接入。

商务合作

构建数字孪生新世界
共筑AI空间数据基础设施

联系朗慧数据专家,获取完整世界模型/空间数据集目录、试用权限及定制化解决方案

18
核心数据集
725万+
多视角照片
2000km²
航摄覆盖