对比

对比

方法与模型的正面对比,数字来自原论文。

强化学习 · Self-distillation in RLVR vs Privileged-context teachers vs Dense token-level rewards

SDPG vs SDAR vs AntiSD:特权教师信号该怎么花

RLVR 一轨迹一比特。SDPG 在判对轨迹上照搬提示教师,SDAR 逐 token 门控照搬,AntiSD 奖励分歧而非照搬:同一特权教师信号的三种花法。

语音合成 · VALL-E vs NaturalSpeech 2 vs SwanVoice

VALL-E、NaturalSpeech 2、SwanVoice 对比

同为零样本 TTS,三篇论文赌的是三个生成单元:VALL-E 把语音当 codec 语言模型,NaturalSpeech 2 用扩散生成连续隐向量,SwanVoice 一次生成整段对话。