机器学习¶
模型、训练、调参与踩坑记录。
-
自回归模型:BERT / GPT 与 Prefix-LM 架构详解
序列建模三大范式、双向 vs 因果注意力、Prefix-LM 为何是 VLA 的选择;含可交互注意力掩码 / 自回归生成 demo。
-
采样一张图 = 数值积分一条 ODE。五种经典求解器同台竞技:固定步长、收敛阶、Dopri5 自适应配速;含浏览器内真实积分 demo 与可复现实验数据。
模型、训练、调参与踩坑记录。
自回归模型:BERT / GPT 与 Prefix-LM 架构详解
序列建模三大范式、双向 vs 因果注意力、Prefix-LM 为何是 VLA 的选择;含可交互注意力掩码 / 自回归生成 demo。
采样一张图 = 数值积分一条 ODE。五种经典求解器同台竞技:固定步长、收敛阶、Dopri5 自适应配速;含浏览器内真实积分 demo 与可复现实验数据。