开源发布
XLNet 论文与 XLNet-Large 权重公开
Google Brain 与卡内基梅隆大学研究者提出 XLNet,并同步开放 XLNet-Large 检查点和 TensorFlow 代码。
MODEL
XLNet 是面向语言理解的预训练表示模型。它对不同因子分解顺序的排列取期望,以自回归目标利用双向上下文,同时避免在预训练输入中加入下游任务不会出现的掩码标记;骨干网络继承 Transformer-XL 的相对位置编码与段级记忆。首发开放 XLNet-Large 检查点和 TensorFlow 代码,Base 检查点随后于 2019 年 7 月开放。
按时间倒序整理已验证的发布与公司动态。
开源发布
Google Brain 与卡内基梅隆大学研究者提出 XLNet,并同步开放 XLNet-Large 检查点和 TensorFlow 代码。