继续寻找队友一起上路 - 为实现 agi 努力奋斗

特别感概,想起上一次来论坛,还是3年前的事情了。当时正在转型做 cuda 编程,开始研究 tvm,研究的一头雾水又没有什么好的队友可以一起探讨,就想着看能不能找一些队友一起学习,没想到一发帖子就拉了一堆人。

可惜没研究多长时间,大模型就来了,急急匆匆的又开始转型研究起了大模型训练技术。 最近有了点成果,我们发布了我们的轻量级的开源的RL强化学习框架,远比 verl 轻量,只有区区1.5w行代码,很容易入门。大家如果对RL强化学习有兴趣的,继续欢迎技术探讨。

项目地址:LoongSage