newsHacker NewsTrust 72 · CommunityPublished 1mo agoLive · 1mo ago
Knowledge Distillation of Black-Box Large Language Models (2024)
115points22comments
Why these links exist
Every edge carries a method, confidence, and the source snippet that justified it — so bad links are debuggable.
- LinkedLinked via unknownengineering87/llm-atlas →
- LinkedLinked via unknowndeepseek-ai/DeepSeek-V3 →
- LinkedLinked via unknowndeepseek-ai/DeepSeek-V3-0324 →
- LinkedLinked via unknownTransformer →
- LinkedLinked via unknownLittle Brains, Big Feats: Exploring Compact Language Models →
- LinkedLinked via unknownEfficient Retrieval-Augmented Generation via Token Co-occurrence Graphs →
Covers
paperNuclearQAv2: A Structured Benchmark for Evaluating Domain-Science Competence in Large Language ModelspaperHow Surprising Is Historical Italian to Language Models? Tokenization Tax, Comprehension Tax, and a Simple Mitigationrepoengineering87/llm-atlasmodeldeepseek-ai/DeepSeek-V3modeldeepseek-ai/DeepSeek-V3-0324glossary_termTransformer
Covers (incoming)
paperLittle Brains, Big Feats: Exploring Compact Language ModelspaperEfficient Retrieval-Augmented Generation via Token Co-occurrence GraphspaperGrounding LLM Reasoning under Incomplete Graph EvidencepaperThe Model Organism Lottery: Model Organism Interpretability Strongly Depends on Training Methodologyrepochrisliu298/awesome-on-policy-distillationrepochrisliu298/awesome-llm-unlearningrepotyang816/Awesome-TCM-LLMrepobd4sur/NanopaperGlobally Consistent Coloring Schemes for Language Identificationpapersurprisal is Not a Theory
Related across the graph
repochrisliu298/awesome-llm-unlearningpaperLittle Brains, Big Feats: Exploring Compact Language Modelsrepochrisliu298/awesome-on-policy-distillationglossary_termTransformermodeldeepseek-ai/DeepSeek-V3repobd4sur/Nanorepoengineering87/llm-atlaspaperGrounding LLM Reasoning under Incomplete Graph Evidencerepotyang816/Awesome-TCM-LLMpaperGlobally Consistent Coloring Schemes for Language IdentificationpaperEfficient Retrieval-Augmented Generation via Token Co-occurrence GraphspaperHow Surprising Is Historical Italian to Language Models? Tokenization Tax, Comprehension Tax, and a Simple Mitigationmodeldeepseek-ai/DeepSeek-V3-0324papersurprisal is Not a TheorypaperThe Model Organism Lottery: Model Organism Interpretability Strongly Depends on Training MethodologypaperNuclearQAv2: A Structured Benchmark for Evaluating Domain-Science Competence in Large Language Models
