Jinn's Hub
about / blog / sources / projects / EN /
所有标签

标签: "AMD"

    长序列 MoE RL 训练:从第一性原理到 MI300X
    从第一性原理重新推导 Yan Bai 的长序列 MoE RL 优化(Path B 重计算、 linear cross-entropy、 FSDP2、 chunked expert-parallel overlap), 以及它们在 AMD MI300X / MI355X 上各自意味着什么。
    FlyDSL 笔记 · Layout 之下的 BasisAttr
    上一篇 FlyDSL 精读把 layout 代数收在了五个词上, 这篇补的是更深一层的子概念 —— Fly_Basis 类型和 BasisAttr。 是什么、 为什么 layout 需要、 以及 mentor 给我的'完善它'任务从哪条线进入最干净。
    TritonForge:面向多轮 Agent 任务的 Server-based RL 训练与评测闭环
    基于 slime + Megatron 的端到端 Server-based RL 框架,聚焦 Triton 内核生成,支持 NVIDIA 与 AMD 双生态
© 2026 • Jinn's Hub 🔬
Press Esc or click anywhere to close