跳转到内容

数据库 · 论文 · 第 1 组

待复核

返回论文全景索引

本分块共 83 条,稳定上限为 100 条。

论文Slug难度可信状态简介
ARIES 1992 — 数据库崩溃后怎么把账目对回来aries-1992unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
ART 自适应基数树 — 内存数据库为主索引重新选材art-2013unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Aurora — 把数据库的下半身换成日志机auroraunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
B-Tree 1972 — 磁盘友好的索引结构b-tree-1972unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
BadgerDB — 把键和值分开存的 Go 原生 KV 库badgerunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Wisconsin Benchmark — 给数据库出一套可重复的体检题benchmarkingunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
ANSI SQL 隔离级别批判 — 教科书的隔离定义其实有漏洞berenson-1995-isolationunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Bernstein 1981 并发控制综述 — 把分布式数据库的 20+ 算法整成两条主线bernstein-1981-ccunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Bigtable — 把巨大表格切到上千台机器上bigtableunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Bigtable 2006 — Google 把行级随机读写做到 PB 级的存储系统bigtable-2006unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Bigtable 二十年回顾 — 从三维表到云数据库bigtable-revisit-2024unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Btrfs — Linux 上”写时复制 B-tree”的工业级文件系统btrfs-2013unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Calvin — 先排队再执行的分布式事务系统calvinunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Calvin 2012 — 先排好顺序再执行,让跨分区事务不再走 2PCcalvin-2012unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Cascades 1995 — 用规则 + Memo 拼装一个可扩展查询优化器cascades-1995unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Cassandra 2010 — 把 Dynamo 的 P2P 骨架和 Bigtable 的列族数据模型拼成一个东西cassandra-2010unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Cassandra 最终一致性取舍 — 可用性、延迟和新鲜度不能都拿满cassandra-eventual-tradeoffunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
ClickHouse — 把列存 OLAP 推到硬件极限clickhouseunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
CockroachDB 2020 — 没原子钟也能做全球强一致 SQL 数据库cockroachdb-2020unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Codd 1970 — 关系模型奠基codd-1970unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Codd 1979 — 给关系模型补上”语义”codd-1979-extendingunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Columnar Storage Formats 2023 — Parquet/ORC 的体检报告columnar-storage-formats-2023unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Comer 1979 — B-Tree 综述:为什么这棵树到处都有comer-1979-btreeunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
CouchDB — 把 HTTP + 多版本 + 多主复制揉成离线优先数据库couchdbunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
C-Store — 把数据按列存,分析查询直接快十倍cstore-2005unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Data Lake Management 2019 — 数据湖从文件堆变成可治理资产data-lake-management-2019unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Delta Lake 2020 — 给对象存储补上事务日志delta-lake-2020unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
DeWitt-Gray 1992 — 并行数据库取代专用机的宣言dewitt-gray-1992unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
DiskANN — 单机十亿向量近邻检索(图存 SSD)diskann-2019unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Dremel 2010 — BigQuery 和 Parquet 背后的嵌套列式分析dremel-2010unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Dremel 十年回顾 — BigQuery 背后的交互式云数仓路线dremel-decade-2020unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
DuckDB — 把 OLAP 数据库塞进你的 Python 进程duckdb-2019unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Dynamo — 让购物车永远能写入的分布式存储dynamounknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Dynamo 2007 — 让购物车在机器故障时也能写入dynamo-2007unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Efficient Compile 2011 — 把 SQL 查询编译成贴近 CPU 的机器码efficient-compile-2011unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Eswaran 1976 — 串行化与谓词锁的源头eswaran-1976unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
F1 2013 — 把 Spanner 包成 SQL,扛起 AdWords 全部账单f1-2013unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
FAISS 2017 — 用 GPU 在十亿向量里找最近邻faiss-2017unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
FastLanes Compression Layout — 用标量代码解码千亿整数fastlanes-compressionunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
FFS — 把磁盘几何写进文件系统ffs-1984unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
FoundationDB — 把事务、日志和存储拆开,再用仿真守住正确性foundationdbunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
FoundationDB 2021 — 把数据库拆成五个角色,再用一个 seed 烧十年 bugfoundationdb-2021unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Gray 1978 — 数据库操作系统讲义,事务/2PL/2PC/恢复一次讲完gray-1978-notesunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Gray 1981 — 把”事务”提升为通用抽象gray-1981-transactionunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Haystack 2010 — Facebook 小文件照片存储haystack-2010unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Hekaton — SQL Server 的内存原生 OLTP 引擎hekaton-2013-sigmodunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
HNSW — 多层近邻图让向量检索从 O(N) 降到近似 O(log N)hnsw-2018unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Learned Index Structures — 把数据库索引看成会预测位置的模型index-structuresunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
INGRES 1976 — Berkeley 平行实现的关系数据库ingres-1976unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Kafka — 把消息系统降维成只追加的日志文件kafkaunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Lakehouse 2021 — 把数据湖和数仓合成一套开放平台lakehouse-2021unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Leis 2015 — 用真实数据打脸所有数据库的查询优化器leis-2015-optimizersunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
LMDB 2011 — 把数据库直接 mmap 进内存的嵌入式 KV 存储lmdb-2011unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
LSM-Tree 1996 — 写优化存储引擎lsm-tree-1996unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Milvus 2021:把向量搜索做成数据库milvus-2021unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
MonetDB/X100 — 让数据库一次处理一向量行而不是一行monetdb-x100-2005unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Morsel-Driven Parallelism — 把 SQL 查询切成小口分给多核morsel-driven-2014unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
MVCC — 让读写互不挡路的版本账本mvccunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Adaptive Optimization of Very Large Join Queries — 100 张表也敢精确求解neumann-2015-large-joinsunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Product Quantization — 把向量切碎再压成几个字节product-quantization-2011unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
RocksDB 2017 — 把 LSM-Tree 的”空间放大”压到极低的工业经验rocksdb-2017unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
LSM-tree 与 RocksDB — 把所有写都变成顺序写rocksdb-lsmunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
SCADS — 用户涨一万倍也不改应用的存储愿景scads-database-2008unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
ScaNN — 让向量量化只精修「客户会看到的那一面」scann-2020unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Selinger 1979 — 基于代价的查询优化selinger-1979unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
SEQUEL 1974 — 让数据库”听懂”近似英语的查询sequel-1974unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Silo — 多核内存数据库里的高速短事务silo-oltp-2013unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
SILT — 0.7 字节内存索引一条记录的 flash 键值存储silt-2011unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Skip List — 用抛硬币代替平衡树skip-list-1990unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Snowflake — 云数仓把存储和计算拆开snowflakeunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Snowflake 2016 — 把数仓拆成 storage / compute / services 三层snowflake-2016unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
SPANN — 内存放中心、SSD 放向量的十亿级近邻检索spann-2021unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
SQLite — 嵌入式数据库 30 年怎么活下来的sqlite-2022unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Stonebraker 2010 SQL vs NoSQL — 慢的是老实现,不是 SQLstonebraker-2010-sqlnosqlunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
System R 1976 — 第一个跑起来的关系数据库system-r-1976unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
TiDB 2020 — 给 Raft 加一个”旁听生”,让一份数据同时跑事务和分析tidb-2020unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
TigerBeetle — 只能记账但把记账做到极致的金融数据库tigerbeetleunknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
UCB CS186 Fall 2024 — 数据库内核阅读路线ucb-cs186-fa2024unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Velox — Meta 统一执行引擎velox-meta-2022unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Vertica 2012 — C-Store 论文走向产品的七年改造账vertica-2012unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Volcano — 把’算子可组合’与’并行可分离’拼成执行器范式volcanounknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
Volcano 1994 — 把 SQL 执行写成 next() 拉式数据流volcano-1994unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。
WCO Joins 2020 — 把最坏情况最优连接搬进关系数据库wco-joins-relational-2020unknownUNVERIFIED暂无独立描述;可先从标题与正文定位开始。