A Libertine of Computer Science
About This Blog
Categories
Develop (46)
Reading (6)
Research (63)
Tags
Adjustment (13)
Algorithm (13)
Big Data (7)
C&CPP (10)
Compile (2)
Concurrency (3)
CPU (4)
Database (24)
Distribute Computing (13)
Docker (4)
DuckDB (4)
FileSystem (6)
Git (1)
GPU (7)
Hash (1)
HPC (9)
Idiom (1)
Java (4)
Latency (3)
LLM (1)
Memory (6)
Machine Learning (15)
Note (8)
Virtualization (3)
OS (6)
Paper (2)
Parallelism (7)
Pointer (3)
Probability (12)
Python (11)
RDMA (1)
Recommendation (1)
Reinforcement Learning (9)
Shell (3)
Slurm (2)
TensorFlow (1)
Virtualization (3)
Tag: Big Data
Reservoir Sampling [蓄水池抽样算法]
Introduction to Disk-oriented DBMS
Query Suspend and Resume
Revisit Join
Pull-based vs Push-based Query Engine
Understanding of Spark Structured Streaming Execution via Source Code [通过源码理解Spark的结构化流执行]
Log-Structured Merge Trees [LSM Tree 介绍]