| A | B | C | D | E | F | G | H | I | J | K | L | M | N | O | P | Q | R | S | T | U | V | W | X | Y | ||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
1 | number | title | authors | spot | ||||||||||||||||||||||
2 | Posters & Demos I 9:10 - 10:10 am | |||||||||||||||||||||||||
3 | 88 | The Name-Free Gap: Policy-Aware Stylistic Control in Music Generation | Ashwin Nagarajan, Hao-Wen Dong | P1-1 | ||||||||||||||||||||||
4 | 1 | MGE-LDM: Joint Latent Diffusion for Simultaneous Music Generation and Source Extraction | Yunkee Chae, Kyogu Lee | P1-2 | ||||||||||||||||||||||
5 | 2 | Soundtrack Retrieval for Film Production | Bill Wang, Haven Kim, Leduo Chen, Minje Kim, Julian McAuley | P1-3 | ||||||||||||||||||||||
6 | 3 | Midi-LLM: Adapting Large Language Models for Text-to-MIDI Music Generation | Shih-Lun Wu, Yoon Kim, Cheng-Zhi Anna Huang | P1-4 | ||||||||||||||||||||||
7 | 4 | Advancing Multi-Instrument Music Transcription: Results from the 2025 AMT Challenge | Ojas Chaturvedi, Kayshav Bhardwaj, Tanay Gondil, Benjamin Shiue-Hal Chou, Yujia Yan, Kristen Yeon-Ji Yun, Yung-Hsiang Lu | P1-5 | ||||||||||||||||||||||
8 | 8 | Zero-shot Geometry-Aware Diffusion Guidance for Music Restoration | Jia-Wei Liao, Pin-Chi Pan, Li-Xuan Peng, Sheng-Ping Yang, Yen-Tung Yeh, Cheng-Fu Chou, Yi-Hsuan Yang | P1-6 | ||||||||||||||||||||||
9 | 9 | AIBA: Attention-based Instrument Band Alignment for Text-to-Audio Diffusion | Junyoung Koh, Soo Yong Kim, GYU HYEONG CHOI, Yongwon choi | P1-7 | ||||||||||||||||||||||
10 | 11 | My Music My Choice: Adversarial Protection Against Vocal Cloning in Songs | Ilke Demir, Gerald Pena Vargas, Alicia Unterreiner, David Ponce, Umur A. Ciftci | P1-8 | ||||||||||||||||||||||
11 | 12 | PANDORA: Diffusion Policy Learning for Dexterous Robotics Piano Playing with a Train-only LLM Expressiveness Reward | Yanjia Huang, Renjie Li, Zhengzhong Tu | P1-9 | ||||||||||||||||||||||
12 | 15 | Audio-to-Audio Schrodinger Bridges | Kevin J. Shih, Zhifeng Kong, Weili Nie, Arash Vahdat, Sang-gil Lee, Joao Felipe Santos, Ante Jukić, Rafael Valle, Bryan Catanzaro | P1-10 | ||||||||||||||||||||||
13 | 17 | Hierarchical Tokenization of Multimodal Music Data for LLM-Compatible Semantic Representations | Wo Jae Lee, Emanuele Coviello, Rifat Joyee, Sudev Mukherjee | P1-11 | ||||||||||||||||||||||
14 | 25 | Segment-Factorized Full-Song Generation on Symbolic Piano Music | Ping-Yi Chen, Chih-Pin Tan, Yi-Hsuan Yang | P1-12 | ||||||||||||||||||||||
15 | 27 | When Creative Machines Learn from Each Other | Haven Kim, Yusong Wu, Taylor Berg-Kirkpatrick, Julian McAuley | P1-13 | ||||||||||||||||||||||
16 | 29 | FlashFoley: Fast Interactive Sketch2Audio Generation | Zachary Novack, Koichi Saito, Zhi Zhong, Takashi Shibuya, Shuyang Cui, Julian McAuley, Taylor Berg-Kirkpatrick, christian simon, Shusuke Takahashi, Yuki Mitsufuji | P1-14 | ||||||||||||||||||||||
17 | 31 | Generative Multi-modal Feedback for Singing Voice Synthesis Evaluation | Xueyan Li, Yuxin Wang, Mengjie Jiang, Qingzi Zhu, Jing Zhang, Zoey Kim, Yazhe Niu | P1-15 | ||||||||||||||||||||||
18 | 34 | Bias beyond Borders: Global Inequalities in AI-Generated Music | Ahmet Solak, Florian Grötschla, Luca A Lanzendörfer, Roger Wattenhofer | P1-16 | ||||||||||||||||||||||
19 | 36 | The Ghost in the Keys: A Disklavier Demo for Human-AI Musical Co-Creativity | Louis Bradshaw, Alexander Spangher, Stella Biderman, Simon Colton | P1-17 | ||||||||||||||||||||||
20 | Posters & Demos II 1:10 - 2:00 pm | |||||||||||||||||||||||||
21 | 68 | StylePitcher: Generating Style-Following, Expressive Pitch Curves for Versatile Singing Tasks | Jingyue Huang, Qihui Yang, Fei-Yueh Chen, Randal Leistikow, Yongyi Zang | P2-1 | ||||||||||||||||||||||
22 | 23 | AMBISONIC-DML: Higher-Order Ambisonic Music Dataset for Spatial AI Generation | Seungryeol Paik, Kyogu Lee | P2-2 | ||||||||||||||||||||||
23 | 24 | Video-to-Music Generation for Film Production: A Dataset and Framework | Haven Kim, Leduo Chen, Bill Wang, Hao-Wen Dong, Julian McAuley | P2-3 | ||||||||||||||||||||||
24 | 40 | Discovering Interpretable Concepts in Large Generative Music Models | Nikhil Singh, Manuel Cherep, Patricia Maes | P2-4 | ||||||||||||||||||||||
25 | 41 | Linear RNNs for autoregressive generation of long music samples | Konrad Szewczyk, Daniel Gallo Fernández, James Townsend | P2-5 | ||||||||||||||||||||||
26 | 43 | Music to Video Matching Based on Beats and Tempo | Aleksandr Mikheev, Ilya Makarov | P2-6 | ||||||||||||||||||||||
27 | 47 | Multi-bit Audio Watermarking for Music | Luca A Lanzendörfer, Kyle Fearne, Florian Grötschla, Roger Wattenhofer | P2-7 | ||||||||||||||||||||||
28 | 48 | LEGATO: Large-scale End-to-end Generalizable Approach to Typeset OMR | Guang Yang, Victoria Ebert, Nazif Can Tamer, Luiza Amador Pozzobon, Noah A. Smith | P2-8 | ||||||||||||||||||||||
29 | 49 | MuCPT: Music-related Natural Language Model Continued Pretraining | Kai Tian, Yirong Mao, Wendong Bi, Hanjie Wang, Que Wenhui | P2-9 | ||||||||||||||||||||||
30 | 52 | Composer Vector: Style-steering Symbolic Music Generation in a Latent Space | Xunyi Jiang, Xin Xu | P2-10 | ||||||||||||||||||||||
31 | 53 | Perceptually Aligning Representations of Music via Noise-Augmented Autoencoders | Mathias Rose Bjare, Giorgia Cantisani, Marco Pasini, Stefan Lattner, Gerhard Widmer | P2-11 | ||||||||||||||||||||||
32 | 56 | SepACap: Source Separation for A Cappella Music | Luca A Lanzendörfer, Constantin Pinkl, Florian Grötschla, Roger Wattenhofer | P2-12 | ||||||||||||||||||||||
33 | 57 | Ethics Statements in AI Music Papers: The Effective and the Ineffective | Julia Barnett, Patrick O'Reilly, Jason Smith, Annie Chu, Bryan Pardo | P2-13 | ||||||||||||||||||||||
34 | 59 | Beyond Collaborative Filtering: Using Decoders for Personalized Music Recommendation | Timothy Greer, Nicholas Capel, Emanuele Coviello, Amina Shabbeer | P2-14 | ||||||||||||||||||||||
35 | 60 | Do Joint Language-Audio Embeddings Encode Perceptual Timbre Semantics? | Qixin Deng, Bryan Pardo, Thrasyvoulos N Pappas | P2-15 | ||||||||||||||||||||||
36 | 80 | Adapting Speech Language Model to Singing Voice Synthesis | Yiwen Zhao, Jiatong Shi, Jinchuan Tian, Yuxun Tang, Jiarui Hai, Jionghao Han, Shinji Watanabe | P2-16 | ||||||||||||||||||||||
37 | 62 | MusicSem: A Semantically Rich Language-Audio Dataset of Organic Musical Discourse | Rebecca Salganik, Teng Tu, Fei-Yueh Chen, Xiaohao Liu, Kaifeng Lu, Ethan Luvisia, Zhiyao Duan, Guillaume Salha-Galvan, Anson Kahng, Yunshan Ma, Jian Kang | P2-17 | ||||||||||||||||||||||
38 | Posters & Demos III 3:00 - 4:00 pm | |||||||||||||||||||||||||
39 | 66 | Chord-conditioned Melody and Bass Generation | Alexandra C Salem, Mohammad Shokri, Johanna Devaney | P3-1 | ||||||||||||||||||||||
40 | 67 | Why Do Music Models Plagiarize? A Motif-Centric Perspective | Tatsuro Inaba, Kentaro Inui | P3-2 | ||||||||||||||||||||||
41 | 69 | Embedding Alignment in Code Generation for Audio | Sam Kouteili, Hiren Madhu, George Typaldos, Mark Paul Santolucito | P3-3 | ||||||||||||||||||||||
42 | 70 | Using a Joint-Embedding Predictive Architecture for Symbolic Music Understanding | Rafik Hachana, Bader Rasheed | P3-4 | ||||||||||||||||||||||
43 | 74 | Robust Neural Audio Fingerprinting using Music Foundation Models | Shubhr Singh, Kiran Bhat, Benjamin Resnick, Xavier Riley, John Thickstun, Walter De Brouwer | P3-5 | ||||||||||||||||||||||
44 | 79 | MusPyExpress: Extending MusPy with Enhanced Expression Text Support | Phillip Long, Hao-Wen Dong, Julian McAuley, Zachary Novack | P3-6 | ||||||||||||||||||||||
45 | 93 | Who Gets Heard? Rethinking Fairness in AI for Music Systems | Atharva Mehta, Shivam Chauhan, Megha Sharma, Gus Xia, Kaustuv Kanti Ganguli, Nishanth Chandran, Zeerak Talat, Monojit Choudhury | P3-8 | ||||||||||||||||||||||
46 | 94 | Memership and Dataset Inference Attacks on Large Audio Generative Models | Jakub Proboszcz, Paweł Kochański, Karol Korszun, Katarzyna Stankiewicz, Donato Crisostomi, Giorgio Strano, Emanuele Rodolà, Kamil Deja, Jan Dubiński | P3-9 | ||||||||||||||||||||||
47 | 95 | From Generation to Attribution: Music AI Agent Architectures for the Post-Streaming Era | Wonil Kim, Hyeongseok Wi, Seungsoon Park, Taejun Kim, Sangeun Keum, Keunhyoung Kim, Taewan Kim, Jongmin Jung, Taehyoung Kim, Gaetan Guerrero, Mael Le Goff, Julie Po, Dongjoo Moon, Juhan Nam, Jongpil Lee | P3-10 | ||||||||||||||||||||||
48 | 96 | Asura's Harp: Direct Latent Control of Neural Sound | Kaj Bostrom | P3-11 | ||||||||||||||||||||||
49 | 97 | Conversational Music Recommendation with LLM Tool Calling | SeungHeon Doh, Keunwoo Choi, Juhan Nam | P3-12 | ||||||||||||||||||||||
50 | 100 | No Encore: Unlearning as Opt-Out in Music Generation | Jinju Kim, Taehan Kim, Abdul Waheed, Jong Hwan Ko, Rita Singh | P3-13 | ||||||||||||||||||||||
51 | 101 | Generating Piano Music with Transformers: A Comparative Study of Scale, Data and Metrics | Ábel Ilyés-Kun, Jonathan Lehmkuhl, Nico Bremes, Cemhan Kaan Özaltan, Frederik Muthers, Jiayi Yuan, Christian Schmidt, Karim Abou Zeid | P3-14 | ||||||||||||||||||||||
52 | 105 | Evaluating Multimodal Large Language Models on Core Music Perception Tasks | Brandon James Carone, Iran R Roman, Pablo Ripollés | P3-15 | ||||||||||||||||||||||
53 | 107 | ACappellaSet: A Multilingual A Cappella Dataset for Source Separation and AI-assisted Rehearsal Tools | Ting-Yu Pan, Kexin Phyllis Ju, Hao-Wen Dong | P3-16 | ||||||||||||||||||||||
54 | 109 | Leveraging Diffusion Models For Predominant Instrument Recognition | Charis Cochran, Yeongheon Lee, Youngmoo Kim | P3-17 | ||||||||||||||||||||||
55 | 7 | Semitone-Aware Fourier Encoding: A Music-Structured Approach to Audio-Text Alignment | Chengze Du, JinYang Zhang, Wenxin Zhang | Virtual | ||||||||||||||||||||||
56 | 14 | Rhythmic Stability and Synchronization in Multi-Track Music Generation | Hongrui Wang, Fan Zhang, Zhiyuan Yu, Ziya Zhou, Xi Chen, Yang Wang, Can Yang | Virtual | ||||||||||||||||||||||
57 | 38 | Persian Musical Instruments Classification Using Polyphonic Data Augmentation | Diba Hadi Esfangereh, Mohammad Hossein Sameti, Sepehr Harfi Moridani, Leili Javidpour, Mahdieh Soleymani Baghshah | Virtual | ||||||||||||||||||||||
58 | 61 | CLAM: Safeguarding Authenticity and Addressing Implications for the Music Industry | Arnesh Batra, Krish Thukral, Naman Batra, Dev Sharma, Ruhani Bhatia, Aditya Gautam | Virtual | ||||||||||||||||||||||
59 | 89 | Learning Music Style Through Cross-Modal Bootstrapping | Jingwei Zhao, Ziyu Wang, Gus Xia, Ye Wang | Virtual | ||||||||||||||||||||||
60 | 102 | BNMusic: Blending Environmental Noises into Personalized Music | Chi Zuo, Martin B. Møller, Pablo Martínez-Nuevo, Huayang Huang, Yu Wu, Ye Zhu | Virtual | ||||||||||||||||||||||
61 | 35 | ENHANCING TEXT-TO-MUSIC GENERATION THROUGH RETRIEVAL-AUGMENTED PROMPT REWRITE | Meiying Ding, Brian McFee, Chenkai Hu, Sunny Yang, Juhua Huang | Demo | ||||||||||||||||||||||
62 | 76 | DAWZY: A New Addtion to AI powered "Human in the Loop" Music Co-creation | Aaron C Elkins, Sanchit Singh, Adrian Kieback, Sawyer Blankenship, Uyiosa Philip Amadasun, Aman Chadha | Demo | ||||||||||||||||||||||
63 | 77 | A Loopy Framework and Tool for Real-time Human-AI Music Collaboration | Sageev Oore, Finlay Miller, Chandramouli Shama Sastry, Sri Harsha Dumpala, Marvin F. da Silva, Daniel Oore, Scott C. Lowe | Demo | ||||||||||||||||||||||
64 | ||||||||||||||||||||||||||
65 | ||||||||||||||||||||||||||
66 | ||||||||||||||||||||||||||
67 | ||||||||||||||||||||||||||
68 | ||||||||||||||||||||||||||
69 | ||||||||||||||||||||||||||
70 | ||||||||||||||||||||||||||
71 | ||||||||||||||||||||||||||
72 | ||||||||||||||||||||||||||
73 | ||||||||||||||||||||||||||
74 | ||||||||||||||||||||||||||
75 | ||||||||||||||||||||||||||
76 | ||||||||||||||||||||||||||
77 | ||||||||||||||||||||||||||
78 | ||||||||||||||||||||||||||
79 | ||||||||||||||||||||||||||
80 | ||||||||||||||||||||||||||
81 | ||||||||||||||||||||||||||
82 | ||||||||||||||||||||||||||
83 | ||||||||||||||||||||||||||
84 | ||||||||||||||||||||||||||
85 | ||||||||||||||||||||||||||
86 | ||||||||||||||||||||||||||
87 | ||||||||||||||||||||||||||
88 | ||||||||||||||||||||||||||
89 | ||||||||||||||||||||||||||
90 | ||||||||||||||||||||||||||
91 | ||||||||||||||||||||||||||
92 | ||||||||||||||||||||||||||
93 | ||||||||||||||||||||||||||
94 | ||||||||||||||||||||||||||
95 | ||||||||||||||||||||||||||
96 | ||||||||||||||||||||||||||
97 | ||||||||||||||||||||||||||
98 | ||||||||||||||||||||||||||
99 | ||||||||||||||||||||||||||
100 | ||||||||||||||||||||||||||