← 司南实验室模型索引 › RoboVLMs(KosMos P.H.)
清华大学 / 字节跳动 Research / 中科院自动化所 等

RoboVLMs(KosMos P.H.)

可商用 7/8 已核实
8 个必填字段里有 1 个待核实,前台用徽标标出、不用默认值填空。已核实字段的来源列在下方。

基本事实

发布日期
2024-12 1 来源
参数量
待核实 0 来源
架构
VLM + 动作专家 0 来源
许可证
Apache-2.0(代码与模型卡) 2 来源
商用
可商用 0 来源
权重
huggingface.co ↗ 1 来源
代码
github.com ↗ 1 来源
论文
arxiv.org ↗ 0 来源
输入模态
rgb · language 0 来源
动作空间
末端位姿增量 + 夹爪 0 来源
跨本体
Open X-Embodiment 预训练;CALVIN / SimplerEnv / 真机 0 来源
预训练数据(小时)
待核实 0 来源
目标形态
单臂 0 来源
架构 · 把任意 VLM 变成 VLA 的框架;表现最好的是 KosMos 主干 + 策略头;Nature Machine Intelligence 2026
来源 · 2 条来源
release_date,license,arch_notes,code_url https://github.com/Robot-VLAs/RoboVLMs 官方页面 · 抓取 2026-09-05 · 尚未存快照 README:initial release 12/11/24;Apache-2.0 license;KosMos VLM backbone;Nature Machine Intelligence
weights_url,license https://huggingface.co/api/models/robovlms/RoboVLMs 模型仓库页 · 抓取 2026-09-05 · 尚未存快照 模型卡 license: apache-2.0;checkpoints kosmos_ph_oxe-pretrain.pt 等

教程

还没有教程。首篇计划:在租用的 RTX 4090 上跑通本模型,附实测延迟报告。

记录历史

2026-09-05
来源抓取
release_date,license,arch_notes,code_url · weights_url,license

延迟与成本

成本 = 延迟 p50 ÷ 1000 × 租价 ÷ 3600 × 1000
硬件p50 msp95 ms峰值显存每千次推理成本 ¥样本
NVIDIA RTX 4090
¥1.68/h · 共绩算力 (2026)
无延迟数据 无数据
NVIDIA RTX 5090
¥2.4/h · 润云 2.4 / 共绩 2.5 / 并行智算云 2.98 (2026)
无延迟数据 无数据
NVIDIA A100 80GB
无租价
无延迟数据 无数据
NVIDIA Jetson AGX Thor
无租价
无延迟数据 无数据
NVIDIA H100 80GB
无租价
无延迟数据 无数据
还没有这个模型的延迟测量 · 数据来自文献、维护者实测或众包 CLI 上传;三者都还没有。

适配本体

只有有证据的格子才上色。橙点表示厂商声明的目标形态,那是声明,不是核实过的适配。

Unitree G1Unitree H1智元 精灵 G1松灵 Piper 机械臂SO-101Franka FR3 / PandaFourier GR-2WidowX 250 SGoogle Robot(Everyday Robots)ALOHA 2 / Cobot Magic(双臂)Galaxea R1 ProFranka Emika Panda
RoboVLMs(KosMos P.H.)
图例 官方声明支持社区复现成功理论可微调不支持未知 厂商声明的目标形态 2 / 12 格有明确状态
SinanLab · 司南实验室方向清晰,判断有据。