← 返回主页
Z-MAX v1.0.4 · 仿真联调

模型性能报告

Client/Server架构 · 三模型基准 · 实时仿真联调

仿真联调架构

┌─ 小芳 (Mac M1 · ROS2 Client) ─────────────────────┐ │ │ │ 📷 摄像头节点 → /camera/rgb │ │ 💪 力传感器 → /force_torque │ │ ✋ 触觉阵列 → /tactile │ │ 📡 接收Action ← /robot/action │ │ │ └────────────────────┬─────────────────────────────┘ │ gRPC / TCP Bridge ┌────────────────────┴─────────────────────────────┐ │ 静静 (WSL RTX4060 · gRPC Server) │ │ │ │ 🧠 SmolVLA 450M (~215ms/帧) │ │ 🧠 ACT 52M (~8.4ms/帧) │ │ 🧠 MLP-1024 (<5ms/帧) │ │ 📊 性能监控 · 数据记录 · 在线评估 │ │ │ └──────────────────────────────────────────────────┘

已训练模型总览

模型数据集步数参数量最终Loss降幅
SmolVLA-FlowMatchinglerobot/pusht200450M2.10
SmolVLA-FlowMatchinglerobot/metaworld_mt50300450M2.10
SmolVLA-MLP-1024lerobot/metaworld_mt5050014.7M0.08581.1%

推理性能基准

指标SmolVLA (450M)ACT (52M)MLP-1024 (14.7M)
GPU显存(加载)0.93 GB0.22 GB
GPU显存(峰值)0.97 GB0.28 GB
推理延迟214.7 ms8.4 ms<5 ms
帧率(FPS)4.7119.2200+
架构VLM+FlowMatchingTransformerMLP-1024

测试环境: WSL2 · RTX 4060 8GB · CUDA 11.8 · PyTorch 2.7.1 | 延迟含GPU同步, 20轮平均, 预热5轮

适用场景推荐

场景推荐模型推理位置延迟原因
固定重复操作ACT 52MOrin本地8.4ms极快+省显存
多任务/多指令SmolVLA 450MWSL(gRPC)215msVLM理解自然语言
快速原型验证MLP-1024Orin本地<5ms极简+极快
精细力控操作SmolVLA 450MWSL(gRPC)215msFlowMatching轨迹平滑
离线仿真调试任意WSL本地无网络延迟

Client/Server 通信协议

信号方向格式频率带宽
RGB图像Client→Server3×512×512, JPEG30Hz~2MB/s
力/力矩Client→Serverfloat32[6]1000Hz24KB/s
触觉阵列Client→Serverfloat32[16]100Hz6.4KB/s
动作指令Server→Clientfloat32[50×6]10Hz12KB/s

传输层: gRPC (protobuf) | 延迟预算: 网络<5ms + 推理=总延迟