做视频AI导航网
做视频AI导航网
AI导航
  • 热门工具
  • Agent智能体
  • Skills技能
  • AI大模型
  • AI创作
  • AI工具集
视频Video
  • 素材下载
  • 创作灵感
Github神器
  • 导航
  • 资讯
  • 视频素材
  • 视频模版
  • 音乐音效
  • Luts调色预设
  • 整合包
首页/
打开 MD 链接

Meshy - 面向大模型强化学习的无中心服务化训练框架

8
用TransferQueue统一数据与控制流,在同一套服务拓扑中切换同步、异步与全异步RL
评分
产品类型:服务化大模型强化学习训练框架核心架构:独立服务加TransferQueue数据与控制平面训练模式:同步、有限离策略与全异步底层组件:SGLang与torchtitan推荐环境:NVIDIA GPU、CUDA 12.9、Python 3.12+开源状态:GitHub公开,仍处早期版本
Meshy是OpenBMB开源的大模型强化学习训练框架,把推理、训练和Rollout拆成独立服务,并通过Tra…
AI编程开发|Meshy框架·大模型训练·开源框架·强化学习

项目定位

Meshy是一套给大模型强化学习研究者使用的服务化训练框架。它把推理、训练和Rollout都做成独立服务,服务之间通过TransferQueue交换数据和控制信号,不依赖一个中央Driver搬运RPC或张量。

为什么值得关注

  • 同一拓扑切换训练节奏:改变生产与消费节奏,就能覆盖同步、有限离策略和全异步RL。
  • 组件可独立扩缩:推理、Rollout和训练服务可以按瓶颈单独调整资源。
  • 减少中央调度压力:TransferQueue同时承担数据面和控制面。
  • 复用成熟底层:推理基于SGLang,训练部分建立在torchtitan之上。
  • 提供现成Recipe:仓库包含GRPO、数学任务等示例,方便研究者复现实验。

Docker快速体验

官方给出的最短路径是使用预构建镜像。准备支持CUDA 12.9的NVIDIA GPU与容器工具后运行:

docker pull ztonyzhao/meshy:0.1.0-alpha
docker run --gpus all -it --rm ztonyzhao/meshy:0.1.0-alpha

进入环境后,可从最小GRPO示例开始:

python scripts/launch.py --recipe recipe.grpo_gsm8k

适合谁

适合研究强化学习、奖励建模、Rollout服务、分布式训练和异步策略优化的团队。它不是面向普通用户的模型启动器,也不能替代数据清洗、奖励设计、实验监控和安全评估。

使用提醒

项目仍处早期Alpha阶段,对CUDA、GPU、容器和分布式训练经验要求较高。正式投入集群前,应先在小规模Recipe上验证版本、显存、通信、检查点恢复和指标一致性,并锁定镜像与依赖版本。

常见问题(FAQ)

Meshy是什么?
Meshy是OpenBMB开源的服务化大模型强化学习框架,将推理、训练和Rollout拆成独立服务。
Meshy和传统RL训练框架有什么不同?
它用TransferQueue连接数据与控制流,通过改变服务节奏在同一拓扑中切换同步、有限离策略和全异步训练。
Meshy需要什么环境?
官方当前推荐NVIDIA GPU、CUDA 12.9,并提供Docker方案;手动安装面向Ubuntu 24.04和Python 3.12+。
Meshy适合普通用户部署模型吗?
不适合。它主要面向大模型强化学习研究和训练基础设施,普通推理部署应选择Ollama、LM Studio、vLLM或SGLang。
Meshy已经适合生产集群吗?
项目仍处早期Alpha阶段,生产使用前要验证版本、通信、检查点恢复、监控和指标一致性。
0 讨论
热门最新
总结
暂无总结
0 / 600
细中粗

相关网站

热门最新

Ollama – 把开放大模型装进自己电脑,也能随时切换云端算力

推荐!从本地离线推理到云端大模型,用一套命令和API接通应用、编辑器与Agent

推荐!一条命令下载并运行开放大模型,用本地REST API接入应用和Agent;电脑算力不够时,还能无缝调用O…

0

MiniCPM5-2B – 131K上下文的开源端侧Agent模型

约25.2亿参数、Apache 2.0许可,支持推理、代码、工具调用与多种本地部署框架

MiniCPM5-2B是OpenBMB开源的稠密大语言模型,拥有约25.2亿总参数、131072上下文,支持推…

0

OpenRouter – 一个 API 接入多家主流与开源大模型

推荐!一个入口比较并调用多家大模型,搭建 Agent 时切换模型更方便

OpenRouter 提供统一 API、模型比较、供应商路由和 Playground,可快速接入多家主流与开源…

0

GLM-5.3-Flash – 智谱原生多模态开源大模型

以18B激活参数提供前沿级编程、Agent与视觉能力

推荐!GLM-5系列首个原生多模态模型,320B总参数、18B激活参数,支持视觉编码、Agent、专业办公与长…

0

Mirendil – AI自我改进与自动化研究平台

构建专门服务AI研究的模型与实验平台,探索自动化AI研发和数据飞轮。

构建专门服务AI研究的模型与实验平台,探索自动化AI研发和数据飞轮。

0

LingBot-VA – 把视频理解、动作建模和机器人控制连到一起的具身智能大模型

面向通用机器人控制的因果视频-动作世界模型页面,聚焦具身智能、世界模型与机器人学习方向

聚焦具身智能、机器人控制与视频动作世界模型方向的前沿大模型页面。

0

MiMo – 想看小米如何把大模型做成完整平台,这个官方入口很值得收藏

小米打造的大模型与开放平台门户,覆盖旗舰模型、API 接入、Code、Studio 与 Agent 生态能力

MiMo 是小米面向模型展示、开发接入与生态布局打造的大模型官方入口,覆盖 MiMo-V2.5、MiMo AP…

0

HarnessEval-W – 把世界模型评测变成可追溯证据链的开源Agent基准

从固定指标走向会规划、会调查、能给出证据链的评测系统

HarnessEval-W以Agent化评测流程动态路由Skills、调用诊断工具并生成证据树,为世界模型提供…

0

DeepSeek-V4-Flash-Vision-Exp – 开源多模态视觉Agent模型

让V4-Flash真正看懂图片、截图与图表

DeepSeek实验性多模态模型,支持图文混合输入、截图与图表理解、工具调用和视觉Agent任务,并开放Hug…

0

LLaDA-Image – 纯图片预训练的开源文生图与指令编辑模型

6B DiT统一文生图与指令编辑,Base追求质量,Turbo只需2至4步

LLaDA-Image是Inclusion AI推出的6B开源图像模型,同一套权重支持文生图、VQ条件生成和指…

0
所有的成功,都源自一个勇敢的开始
不辜负每一个勇敢的开始
做视频AI导航网 © 2026闽ICP备16009488号-1