MemHarness:GRPO驱动的开源LLM智能体记忆重构框架
MemHarness是一套面向LLM Agent的开源记忆增强完整工程框架。MemHarness借鉴人类重构式记忆认知理论,在记忆检索和动作生成之间增加校验、改写重构步骤,不直接复用原始记忆...
MemHarness是一套面向LLM Agent的开源记忆增强完整工程框架。MemHarness借鉴人类重构式记忆认知理论,在记忆检索和动作生成之间增加校验、改写重构步骤,不直接复用原始记忆...
Cosmos 3 Edge是NVIDIA推出的Cosmos 3系列轻量化4B参数全模态物理AI世界模型,专为边缘嵌入式、消费级显卡、工业边缘设备打造,是完整世界模型家族中端侧专属版本,基于Nem...
MineExplorer 是美团 longcat 团队联合上海交通大学共同开源的Minecraft 开放世界大模型智能体评测基准,项目整体由仿真沙箱环境、自动任务生成流水线、标准化评测执行模块...
MiniCPM-Robot由面壁智能OpenBMB开源,包含MiniCPM-RobotManip、MiniCPM-RobotTrack两大VLA模型,搭配PhyAI推理框架,支持本地离线运行,可实现机械臂视觉操作、四足机器狗...
Xiaomi-Robotics-U0是小米机器人实验室38B参数自回归世界基础模型,统一文生图、图像编辑、多视角场景、具身迁移、机器人交互视频生成,搭载FlashAR高速推理,完整开源,适...
Robostral Navigate 是法国AI企业Mistral AI发布的8B参数单目视觉具身导航大模型,也是Mistral首款面向机器人物理行动的专用视觉语言动作(VLA)模型。
LingBot-Video 是蚂蚁灵波基于Apache 2.0协议、面向具身智能的首款开源MoE混合专家大规模视频生成模型,同步开放完整代码、权重模型、提示词改写工具与技术报告。
LingBot-Vision是蚂蚁灵波开源自研自监督ViT视觉骨干套件,首创掩码边界建模,专为密集空间感知打造,配套LingBot-Depth2.0深度模型,支持深度估计、语义分割、视频分割、深...
LiveWorld 是阿德莱德大学、浙江大学、澳大利亚国立大学等多校联合团队发布的解耦式生成视频世界模型,项目配套自研行业首个针对视野外动态评测的基准数据集 LiveBench,用...
Qwen-Robot Suite 是阿里巴巴通义千问团队2026年6月16日正式发布的全套具身智能机器人基础模型套件,也是千问大模型体系首款覆盖机器人操作、移动、物理推演全链路的一体化...
ACE-Ego-0 是由大晓机器人(ACERobotics-VLA)联合香港中文大学MMLab、清华大学、上海交通大学联合研发并开源的以人为中心视觉-语言-动作(VLA)具身机器人基础框架。
Kairos-HomeWorld是大晓机器人联合港中文MMLab、深圳河套学院开源的全球首个全屋三维可交互世界模型,采用四阶段分层生成架构,可通过文本指令生成符合中国家庭特征的全屋3...
Qwen‑VLA是阿里通义千问推出的开源通用视觉‑语言‑动作统一具身智能模型,基于Qwen多模态基座构建,通过四阶段训练实现视觉感知、语言理解与连续动作生成的端到端融合,单...
Wall-X 是由 X-Square-Robot 团队在 GitHub 开源的一套端到端具身智能机器人基础模型工程体系,核心依托自研 WALL-OSS 模型,搭建起从数据采集、模型训练、算法推理到真机部...
HY-Embodied-0.5-X 是腾讯混元Hunyuan团队联合腾讯Robotics X实验室共同研发并正式开源的具身多模态基础大模型,项目完整托管于GitHub开源社区,全程开源开放,面向全球开发...