view article Article KV Caching Explained: Optimizing Transformer Inference Efficiency not-lain • Jan 30, 2025 • 376
Narratives in LLM Pretraining Data Collection Models & datasets from Characterizing Narrative Content in Web-Scale LLM Pretraining Data (NarraDolma & NarraBERT) • 7 items • Updated 12 days ago • 2
Characterizing Narrative Content in Web-scale LLM Pretraining Data Paper • 2606.19468 • Published Jun 17 • 3
Characterizing Narrative Content in Web-scale LLM Pretraining Data Paper • 2606.19468 • Published Jun 17 • 3
Narratives in LLM Pretraining Data Collection Models & datasets from Characterizing Narrative Content in Web-Scale LLM Pretraining Data (NarraDolma & NarraBERT) • 7 items • Updated 12 days ago • 2
Characterizing Narrative Content in Web-scale LLM Pretraining Data Paper • 2606.19468 • Published Jun 17 • 3
Narratives in LLM Pretraining Data Collection Models & datasets from Characterizing Narrative Content in Web-Scale LLM Pretraining Data (NarraDolma & NarraBERT) • 7 items • Updated 12 days ago • 2