repoGitHubTrust 82 · PrimaryPublished 1mo agoLive · 22d ago
jaswon/osu-dreamer
a diffusion-based ML model for generating osu! maps from raw audio
Lineage graph
Paper → model → repo connections mined from source citations (Tier-1 exact match).
Why these links exist
Every edge carries a method, confidence, and the source snippet that justified it — so bad links are debuggable.
- PossiblePossibly related (embedding) · 54%LeVo 2: Stable and Melodious Song Generation via Hierarchical Representation Modeling and Progressive Post-Training →
- PossiblePossibly related (embedding) · 48%An Efficient vLLM-Based Inference Pipeline for Unified Audio Understanding and Generation →
- PossiblePossibly related (embedding) · 48%Unified Audio Intelligence Without Regressing on Text Intelligence →
- PossiblePossibly related (embedding) · 45%TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios →
- PossiblePossibly related (embedding) · 46%Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation →
- PossiblePossibly related (embedding) · 48%FreyaTTS Technical Report →
- PossiblePossibly related (embedding) · 47%Encoder-Side Neuron Identification and Amplification for Acoustic Perception in Large Audio-Language Models →
- PossiblePossibly related (embedding) · 51%Audio-Native Speech Recognition with a Frozen Discrete-Diffusion Language Model →
Implements
Implements (incoming)
paperAn Efficient vLLM-Based Inference Pipeline for Unified Audio Understanding and GenerationpaperUnified Audio Intelligence Without Regressing on Text IntelligencepaperTriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific ScenariospaperWan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance GenerationpaperFreyaTTS Technical ReportpaperEncoder-Side Neuron Identification and Amplification for Acoustic Perception in Large Audio-Language ModelspaperAudio-Native Speech Recognition with a Frozen Discrete-Diffusion Language Model
Related across the graph
paperWan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance GenerationpaperEncoder-Side Neuron Identification and Amplification for Acoustic Perception in Large Audio-Language ModelspaperAn Efficient vLLM-Based Inference Pipeline for Unified Audio Understanding and GenerationpaperFreyaTTS Technical ReportpaperLeVo 2: Stable and Melodious Song Generation via Hierarchical Representation Modeling and Progressive Post-TrainingpaperAudio-Native Speech Recognition with a Frozen Discrete-Diffusion Language ModelpaperTriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific ScenariospaperUnified Audio Intelligence Without Regressing on Text Intelligence
