数据库 · 论文 · 第 1 组
待复核本分块共 83 条,稳定上限为 100 条。
| 论文 | Slug | 难度 | 可信状态 | 简介 |
|---|---|---|---|---|
| ARIES 1992 — 数据库崩溃后怎么把账目对回来 | aries-1992 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| ART 自适应基数树 — 内存数据库为主索引重新选材 | art-2013 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Aurora — 把数据库的下半身换成日志机 | aurora | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| B-Tree 1972 — 磁盘友好的索引结构 | b-tree-1972 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| BadgerDB — 把键和值分开存的 Go 原生 KV 库 | badger | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Wisconsin Benchmark — 给数据库出一套可重复的体检题 | benchmarking | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| ANSI SQL 隔离级别批判 — 教科书的隔离定义其实有漏洞 | berenson-1995-isolation | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Bernstein 1981 并发控制综述 — 把分布式数据库的 20+ 算法整成两条主线 | bernstein-1981-cc | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Bigtable — 把巨大表格切到上千台机器上 | bigtable | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Bigtable 2006 — Google 把行级随机读写做到 PB 级的存储系统 | bigtable-2006 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Bigtable 二十年回顾 — 从三维表到云数据库 | bigtable-revisit-2024 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Btrfs — Linux 上”写时复制 B-tree”的工业级文件系统 | btrfs-2013 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Calvin — 先排队再执行的分布式事务系统 | calvin | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Calvin 2012 — 先排好顺序再执行,让跨分区事务不再走 2PC | calvin-2012 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Cascades 1995 — 用规则 + Memo 拼装一个可扩展查询优化器 | cascades-1995 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Cassandra 2010 — 把 Dynamo 的 P2P 骨架和 Bigtable 的列族数据模型拼成一个东西 | cassandra-2010 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Cassandra 最终一致性取舍 — 可用性、延迟和新鲜度不能都拿满 | cassandra-eventual-tradeoff | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| ClickHouse — 把列存 OLAP 推到硬件极限 | clickhouse | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| CockroachDB 2020 — 没原子钟也能做全球强一致 SQL 数据库 | cockroachdb-2020 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Codd 1970 — 关系模型奠基 | codd-1970 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Codd 1979 — 给关系模型补上”语义” | codd-1979-extending | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Columnar Storage Formats 2023 — Parquet/ORC 的体检报告 | columnar-storage-formats-2023 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Comer 1979 — B-Tree 综述:为什么这棵树到处都有 | comer-1979-btree | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| CouchDB — 把 HTTP + 多版本 + 多主复制揉成离线优先数据库 | couchdb | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| C-Store — 把数据按列存,分析查询直接快十倍 | cstore-2005 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Data Lake Management 2019 — 数据湖从文件堆变成可治理资产 | data-lake-management-2019 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Delta Lake 2020 — 给对象存储补上事务日志 | delta-lake-2020 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| DeWitt-Gray 1992 — 并行数据库取代专用机的宣言 | dewitt-gray-1992 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| DiskANN — 单机十亿向量近邻检索(图存 SSD) | diskann-2019 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Dremel 2010 — BigQuery 和 Parquet 背后的嵌套列式分析 | dremel-2010 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Dremel 十年回顾 — BigQuery 背后的交互式云数仓路线 | dremel-decade-2020 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| DuckDB — 把 OLAP 数据库塞进你的 Python 进程 | duckdb-2019 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Dynamo — 让购物车永远能写入的分布式存储 | dynamo | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Dynamo 2007 — 让购物车在机器故障时也能写入 | dynamo-2007 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Efficient Compile 2011 — 把 SQL 查询编译成贴近 CPU 的机器码 | efficient-compile-2011 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Eswaran 1976 — 串行化与谓词锁的源头 | eswaran-1976 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| F1 2013 — 把 Spanner 包成 SQL,扛起 AdWords 全部账单 | f1-2013 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| FAISS 2017 — 用 GPU 在十亿向量里找最近邻 | faiss-2017 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| FastLanes Compression Layout — 用标量代码解码千亿整数 | fastlanes-compression | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| FFS — 把磁盘几何写进文件系统 | ffs-1984 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| FoundationDB — 把事务、日志和存储拆开,再用仿真守住正确性 | foundationdb | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| FoundationDB 2021 — 把数据库拆成五个角色,再用一个 seed 烧十年 bug | foundationdb-2021 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Gray 1978 — 数据库操作系统讲义,事务/2PL/2PC/恢复一次讲完 | gray-1978-notes | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Gray 1981 — 把”事务”提升为通用抽象 | gray-1981-transaction | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Haystack 2010 — Facebook 小文件照片存储 | haystack-2010 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Hekaton — SQL Server 的内存原生 OLTP 引擎 | hekaton-2013-sigmod | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| HNSW — 多层近邻图让向量检索从 O(N) 降到近似 O(log N) | hnsw-2018 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Learned Index Structures — 把数据库索引看成会预测位置的模型 | index-structures | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| INGRES 1976 — Berkeley 平行实现的关系数据库 | ingres-1976 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Kafka — 把消息系统降维成只追加的日志文件 | kafka | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Lakehouse 2021 — 把数据湖和数仓合成一套开放平台 | lakehouse-2021 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Leis 2015 — 用真实数据打脸所有数据库的查询优化器 | leis-2015-optimizers | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| LMDB 2011 — 把数据库直接 mmap 进内存的嵌入式 KV 存储 | lmdb-2011 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| LSM-Tree 1996 — 写优化存储引擎 | lsm-tree-1996 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Milvus 2021:把向量搜索做成数据库 | milvus-2021 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| MonetDB/X100 — 让数据库一次处理一向量行而不是一行 | monetdb-x100-2005 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Morsel-Driven Parallelism — 把 SQL 查询切成小口分给多核 | morsel-driven-2014 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| MVCC — 让读写互不挡路的版本账本 | mvcc | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Adaptive Optimization of Very Large Join Queries — 100 张表也敢精确求解 | neumann-2015-large-joins | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Product Quantization — 把向量切碎再压成几个字节 | product-quantization-2011 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| RocksDB 2017 — 把 LSM-Tree 的”空间放大”压到极低的工业经验 | rocksdb-2017 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| LSM-tree 与 RocksDB — 把所有写都变成顺序写 | rocksdb-lsm | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| SCADS — 用户涨一万倍也不改应用的存储愿景 | scads-database-2008 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| ScaNN — 让向量量化只精修「客户会看到的那一面」 | scann-2020 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Selinger 1979 — 基于代价的查询优化 | selinger-1979 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| SEQUEL 1974 — 让数据库”听懂”近似英语的查询 | sequel-1974 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Silo — 多核内存数据库里的高速短事务 | silo-oltp-2013 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| SILT — 0.7 字节内存索引一条记录的 flash 键值存储 | silt-2011 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Skip List — 用抛硬币代替平衡树 | skip-list-1990 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Snowflake — 云数仓把存储和计算拆开 | snowflake | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Snowflake 2016 — 把数仓拆成 storage / compute / services 三层 | snowflake-2016 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| SPANN — 内存放中心、SSD 放向量的十亿级近邻检索 | spann-2021 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| SQLite — 嵌入式数据库 30 年怎么活下来的 | sqlite-2022 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Stonebraker 2010 SQL vs NoSQL — 慢的是老实现,不是 SQL | stonebraker-2010-sqlnosql | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| System R 1976 — 第一个跑起来的关系数据库 | system-r-1976 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| TiDB 2020 — 给 Raft 加一个”旁听生”,让一份数据同时跑事务和分析 | tidb-2020 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| TigerBeetle — 只能记账但把记账做到极致的金融数据库 | tigerbeetle | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| UCB CS186 Fall 2024 — 数据库内核阅读路线 | ucb-cs186-fa2024 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Velox — Meta 统一执行引擎 | velox-meta-2022 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Vertica 2012 — C-Store 论文走向产品的七年改造账 | vertica-2012 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Volcano — 把’算子可组合’与’并行可分离’拼成执行器范式 | volcano | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| Volcano 1994 — 把 SQL 执行写成 next() 拉式数据流 | volcano-1994 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |
| WCO Joins 2020 — 把最坏情况最优连接搬进关系数据库 | wco-joins-relational-2020 | unknown | UNVERIFIED | 暂无独立描述;可先从标题与正文定位开始。 |