跳到正文
原文
The Decoder· Matthias Bastian·· 3 小时前AI 评分49

Reka AI 发布全能模型 Rho-1:单一模型处理文本、图像、视频与机器人控制

Reka AI's omni-model Rho-1 handles text, images, video, and robot control in a single model

AI 导读

Reka AI 发布研究预览版 Rho-1,这是一个 19B 参数的全能模型,可在单个共享上下文窗口中以 token 形式处理和生成文本、图像、视频及机器人控制动作,无需工具调用或外部模型。模型能实时生成连续视频并即时响应新指令,还通过逆向动力学模型从普通网络视频中提取控制信号来弥补机器人训练数据不足。Rho-1 使用 320 块 H100 GPU 训练约三个月。

来源:The Decoder · the-decoder.com