返回信息流
新闻事件
B标准70
InfoQ
1 个来源

腾讯 UniRL 框架 2.4X 性能优化实践将在 AICon 深圳站分享

腾讯多模态 RL Infra 负责人朱文熙将在 AICon 深圳站分享 UniRL 框架的 2.4X 端到端性能优化实践。该框架针对 Diffusion RL 与 LLM RL 的 Infra 差异,通过架构设计、自研算子、训推一致性和异步引擎等全链路工程实践,解决了训练稳定性与性能问题。

主报道

InfoQ

主报道来源