NLP 基础与 Scaling · 论文 · 第 2 组
待复核本分块共 14 条,稳定上限为 100 条。
| 论文 | Slug | 难度 | 可信状态 | 简介 |
|---|---|---|---|---|
| Sycophancy 2023 — RLHF 模型为什么爱顺着用户说 | sycophancy-2023 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| T0 — 让 50 个人各写各的提示词,模型反而更会听新指令 | t0-2021 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| T5 — Text-to-Text Transfer Transformer | t5 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| TabPFN — 一秒解决小表格分类的 Transformer | tabpfn-2023 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| TD3 — 给 DDPG 装两副刹车,连续控制终于稳了 | td3-2018 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Transformer — 让每个词一次看完整句话 | transformer | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Attention Is All You Need — 用 self-attention 重写序列建模 | transformer-2017 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Transformer-XL — 让 Transformer 像 RNN 那样把上下文滚动传下去 | transformer-xl-2019 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Tree-of-Attention — 把长上下文拆成树再分支注意 | tree-of-attention-2026 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| VALL-E — 3 秒音频样本就能克隆你的声音 | vall-e-2023 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| VideoMLA — 给长视频生成压缩 KV 缓存 | videomla | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Whisper — 用 68 万小时”野生”音频教会模型听懂全世界 | whisper-2022 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Word2Vec — 词向量奠基 | word2vec | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| XLNet — 把句子打乱顺序读,借此同时拿到 AR 和双向 | xlnet-2019 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |