AI在线 AI在线

3D视觉

3D视觉大模型SpatialLM开源,实时识别场景内容

在人工智能领域,3D视觉与空间理解技术正成为推动具身智能、自主导航及虚拟现实等应用的关键。 2025年3月,杭州群核科技在GTC2025全球大会上宣布正式开源其自主研发的3D视觉大语言模型 SpatialLM,引发业界广泛关注。 这一模型以其强大的空间认知能力和低成本的数据处理方式,为机器人训练、建筑设计及AR/VR等领域带来了革命性突破。
4/16/2025 10:01:17 AM
AI在线

3D 视觉派:斯坦福具身智能人物关系图

作者 | 赖文昕 陈彩娴编辑 | 陈彩娴2009 年,当苏昊第一次走进位于斯坦福 Serra Mall 353 号的盖茨大楼时,他刚经历完一场对人工智能的思想挣扎。 那时他刚参加完搭建 ImageNet。 导师李飞飞从普林斯顿转到斯坦福任教后,他也随之从美国东部来到硅谷。
9/6/2024 3:02:00 PM
赖文昕

新能源时代,国产3D视觉「冲击」保守的汽车行业

在改革开放背景上成长起来的汽车产业,经历了飞速发展,但大量中外合资车企的涌入,也铸就了行业保守的底色,天然对国产供应商比较排斥。 汽车制造业是机器视觉成熟应用的行业之一,但长期以来,国内传统燃油车产线上,举目皆是国外的视觉设备,且占据着最优质的应用场景。 日益茁壮的国产视觉厂商,在车厂有关“进口”、“技术认可”、“成熟应用案例”等的权衡中,不免落入下风。
3/5/2024 5:28:00 PM
刘路遥
  • 1