清华大学 / 字节跳动 Research / 中科院自动化所 等
RoboVLMs(KosMos P.H.)
可商用 7/8 已核实
8 个必填字段里有 1 个待核实,前台用徽标标出、不用默认值填空。已核实字段的来源列在下方。
基本事实
- 发布日期
- 2024-12 1 来源
- 参数量
- 待核实 0 来源
- 架构
- VLM + 动作专家 0 来源
- 许可证
- Apache-2.0(代码与模型卡) 2 来源
- 商用
- 可商用 0 来源
- 权重
- huggingface.co ↗ 1 来源
- 代码
- github.com ↗ 1 来源
- 论文
- arxiv.org ↗ 0 来源
- 输入模态
- rgb · language 0 来源
- 动作空间
- 末端位姿增量 + 夹爪 0 来源
- 跨本体
- Open X-Embodiment 预训练;CALVIN / SimplerEnv / 真机 0 来源
- 预训练数据(小时)
- 待核实 0 来源
- 目标形态
- 单臂 0 来源
架构 · 把任意 VLM 变成 VLA 的框架;表现最好的是 KosMos 主干 + 策略头;Nature Machine Intelligence 2026
来源 · 2 条来源
release_date,license,arch_notes,code_url https://github.com/Robot-VLAs/RoboVLMs 官方页面 · 抓取 2026-09-05 · 尚未存快照 README:initial release 12/11/24;Apache-2.0 license;KosMos VLM backbone;Nature Machine Intelligence
weights_url,license https://huggingface.co/api/models/robovlms/RoboVLMs 模型仓库页 · 抓取 2026-09-05 · 尚未存快照 模型卡 license: apache-2.0;checkpoints kosmos_ph_oxe-pretrain.pt 等
教程
还没有教程。首篇计划:在租用的 RTX 4090 上跑通本模型,附实测延迟报告。
记录历史
2026-09-05
来源抓取
release_date,license,arch_notes,code_url · weights_url,license
延迟与成本
成本 = 延迟 p50 ÷ 1000 × 租价 ÷ 3600 × 1000
| 硬件 | p50 ms | p95 ms | 峰值显存 | 每千次推理成本 ¥ | 样本 |
|---|---|---|---|---|---|
NVIDIA RTX 4090 ¥1.68/h · 共绩算力 (2026) | — | — | — | — 无延迟数据 | 无数据 |
NVIDIA RTX 5090 ¥2.4/h · 润云 2.4 / 共绩 2.5 / 并行智算云 2.98 (2026) | — | — | — | — 无延迟数据 | 无数据 |
NVIDIA A100 80GB 无租价 | — | — | — | — 无延迟数据 | 无数据 |
NVIDIA Jetson AGX Thor 无租价 | — | — | — | — 无延迟数据 | 无数据 |
NVIDIA H100 80GB 无租价 | — | — | — | — 无延迟数据 | 无数据 |
还没有这个模型的延迟测量 · 数据来自文献、维护者实测或众包 CLI 上传;三者都还没有。
适配本体
只有有证据的格子才上色。橙点表示厂商声明的目标形态,那是声明,不是核实过的适配。
| Unitree G1 | Unitree H1 | 智元 精灵 G1 | 松灵 Piper 机械臂 | SO-101 | Franka FR3 / Panda | Fourier GR-2 | WidowX 250 S | Google Robot(Everyday Robots) | ALOHA 2 / Cobot Magic(双臂) | Galaxea R1 Pro | Franka Emika Panda | |
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| RoboVLMs(KosMos P.H.) |
图例 官方声明支持社区复现成功理论可微调不支持未知 厂商声明的目标形态 2 / 12 格有明确状态
方向清晰,判断有据。