Pith. sign in

Paper Citation Record · LEDGER

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models

As of 17 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2508.19514.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2508.19514 v1

Coverage vector

measured 37 of 37 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T16:55:00.742512Z

measured 37 of 37 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-16T06:30:59.297886+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

37 of 37 outbound references displayed

  • verified exact0
  • verified fuzzy14
  • unresolved23
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 10477540-6dc0-4212-83af-8f16599990ca · outbound

This paper cites Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.610051Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.610051Z digest=sha256:e79d7da9cb7dd277f8ea5cab17bfd8f1bb5f165a1e295ad26a64015c3b68f3e2

Observation f4ada9a7-2fe4-4deb-b747-a2a5384298d9 · outbound

This paper cites Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.614509Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.614509Z digest=sha256:89cd05e50fda73f655df1c1584ec2573ff5e3a0555f7e866dcd501b0e3cc230d

Observation ae3f328d-7c54-4003-a195-0735b70d595d · outbound

This paper cites Visual instruction tuning,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Visual instruction tuning,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.618724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.618724Z digest=sha256:9d2af431a29ebaabcc5f7963a4c58010718048660c08c20e17e0b38f15e0ac8a

Observation 4045a1a5-c532-4a2c-8a78-d268c3859b30 · outbound

This paper cites Music understanding llama: Advancing text-to-music generation with question answering and captioning,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Music understanding llama: Advancing text-to-music generation with question answering and captioning,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.142731Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.622548Z digest=sha256:21fa38c0d53641448685ffe55c53d079d94a8bb1486aa2157b199b92a89306a0

Observation 59c75b42-48eb-48d2-87b9-7f7698e8b669 · outbound

This paper cites The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision).

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision)

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.626491Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.626491Z digest=sha256:397b9c707b170bf524c3730d93459eb864bcbfe3b8c7371a2a313f0178f17cec

Observation fe2c1a58-46d8-4487-a809-986289938d0b · outbound

This paper cites Sparks of Artificial General Intelligence: Early experiments with GPT-4.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Sparks of Artificial General Intelligence: Early experiments with GPT-4

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.630570Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.630570Z digest=sha256:1e77bb2544d001568d5614c92366cf5518638b24b82b21c7fe171750703d7349

Observation 34441854-4cd0-4d46-89b0-15308cfd3a14 · outbound

This paper cites Emergent Abilities of Large Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Emergent Abilities of Large Language Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.635201Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.635201Z digest=sha256:71c417765053fe86f4f4cb38141193100122be7ed51ca8c83122940b41598596

Observation 262decf8-710f-43bd-be06-fe78fe43b54d · outbound

This paper cites Are emergent abilities of large language models a mirage?,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Are emergent abilities of large language models a mirage?,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.131495Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.639037Z digest=sha256:4e2f585b22c6e004aef69200cf944df27142523cd824c5a9d25fca7dd19d1055

Observation 1d10eb41-f03e-42e0-ab17-e4128f0a4ac8 · outbound

This paper cites MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.642522Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.642522Z digest=sha256:7e1314ff9a8da25fdafe5a21ee7547df2da1e6c61135029702f586ea086f783d

Observation 129069ac-5752-435a-9e4c-0b853ec8577a · outbound

This paper cites Gemini: A Family of Highly Capable Multimodal Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Gemini: A Family of Highly Capable Multimodal Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.646295Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.646295Z digest=sha256:677aa8853c69af8b329ce532242a70fca327b8b392d9c0e83fe8342f93b746d6

Observation 5006fb8b-d366-4c3b-8fb2-ad19b5083db2 · outbound

This paper cites GPT-4 Technical Report.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models GPT-4 Technical Report

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.649874Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.649874Z digest=sha256:aa7727d8029a02e125dad1ba8507a6c475678677a76fec2017fe81ebd5a23c9b

Observation 3c453831-ba0c-4fc6-9704-297907ee87b7 · outbound

This paper cites Robust speech recognition via large-scale weak supervision,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Robust speech recognition via large-scale weak supervision,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.120792Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.653693Z digest=sha256:30b52d948b5d4742663b2b63ba9430252e696aa355fab18a3142134abac14a20

Observation efef8181-422e-4586-9f7d-fa6569c74dcd · outbound

This paper cites SALMONN: Towards Generic Hearing Abilities for Large Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models SALMONN: Towards Generic Hearing Abilities for Large Language Models

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.656983Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.656983Z digest=sha256:1ab5c4380859b5185ddc94325971a025b523a89c692cbeae5ed97777de7164c3

Observation 42f46c3a-22f1-41f1-844d-f6bf23acd84a · outbound

This paper cites LLark: A Multimodal Instruction-Following Language Model for Music.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models LLark: A Multimodal Instruction-Following Language Model for Music

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.660561Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.660561Z digest=sha256:14ef6b92aa011528481ad6bb6917be4aa63564e70f69cd486c4ecf5f7837747d

Observation e92829cb-bc2a-4ac6-9ba4-778ed3a070e2 · outbound

This paper cites LP-MusicCaps: LLM-based pseudo music captioning,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models LP-MusicCaps: LLM-based pseudo music captioning,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.110539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.664042Z digest=sha256:dcebcdbeb2a98ef9b980ea6588460c91276557a67a5f7213c7bf0ca0b7866b2f

Observation 50aa2320-a300-4898-8782-0ab956596268 · outbound

This paper cites The million song dataset,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models The million song dataset,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.100065Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.667291Z digest=sha256:b796a7106900b5ab12bbdf9d975af0cb047cf4c0923501b6325f28a5d315fe83

Observation d977618f-5619-4888-9e72-9b7f6641563c · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.671094Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.671094Z digest=sha256:7ab09de0047a843233de3c267f71de98ac3a9327c24eee278ab7e5c1108ffe91

Observation 5531cbcf-57c1-4ad0-b9fa-847cc4d1668f · outbound

This paper cites G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.674220Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.674220Z digest=sha256:55de3763089ffcf89364661f2455640366df52e2c06776a47ef4a1a4422f3167

Observation af970079-8a50-49e8-af52-0046379447a4 · outbound

This paper cites GPT-4 as an Effective Zero-Shot Evaluator for Scientific Figure Captions.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models GPT-4 as an Effective Zero-Shot Evaluator for Scientific Figure Captions

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.677916Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.677916Z digest=sha256:74e4bfb793173683b1bf0df42515e70db72ff5c35faaddc8acdc2a51520c4300

Observation e548c8d3-f505-48f0-9597-cef2c5130f96 · outbound

This paper cites Is GPT-4 a reliable rater? Evaluating Consistency in GPT-4 Text Ratings.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Is GPT-4 a reliable rater? Evaluating Consistency in GPT-4 Text Ratings

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.681892Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.681892Z digest=sha256:9f7ceddad3827cc0dd5c42111ff7bfa13b436d934b936f45cef73044420b3e04

Observation 54974810-816b-49f2-9399-b89a999f057f · outbound

This paper cites Large Language Models Are Human-Level Prompt Engineers.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Large Language Models Are Human-Level Prompt Engineers

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.685492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.685492Z digest=sha256:81b62aeeabba7ab6a466f0e00895313f090dc1abe5eaa62d0e0cc9b597aac4ea

Observation 656c485a-649a-44a5-b09c-51d442055395 · outbound

This paper cites Learning to answer questions in dynamic audio-visual scenarios,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Learning to answer questions in dynamic audio-visual scenarios,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.088578Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.689040Z digest=sha256:ed36499bab3a5f1042b196bc50df2d45b85b9bdfc7380ec6941354bdc66161bf

Observation 54eb1332-d0ec-43b7-853d-0746e6b9efe9 · outbound

This paper cites MusicAgent: An AI Agent for Music Understanding and Generation with Large Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models MusicAgent: An AI Agent for Music Understanding and Generation with Large Language Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.692237Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.692237Z digest=sha256:8566fb614ed44cdc3b04899b2a5c1f4cc636ffb7d13efe0d92f5a389fae566b5

Observation 14afe033-7a0f-4226-88a7-acecc3e5ce64 · outbound

This paper cites Multi-level and multi-scale feature aggregation using pretrained convolutional neural networks for music auto-tagging,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Multi-level and multi-scale feature aggregation using pretrained convolutional neural networks for music auto-tagging,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.077554Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.696287Z digest=sha256:409c8e4bd6cdb3dca105817f8421b3e973740a56e94cb879353227254a8783b9

Observation e690701b-98e8-41f8-8bb4-19ddca150416 · outbound

This paper cites Modeling beats and downbeats with a time-frequency transformer,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Modeling beats and downbeats with a time-frequency transformer,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.067010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.699578Z digest=sha256:875a744f59d92eac49b453839478e42c741306b6f5c574109b6f3bbd25229be5

Observation f05d1fa9-4b76-4a75-9cb0-0c4ea9125a37 · outbound

This paper cites SpecTNT: A time-frequency transformer for music audio,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models SpecTNT: A time-frequency transformer for music audio,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.055680Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.703283Z digest=sha256:57abd78ef0986fec8532874c572184c7c55ef63fd3d7fdc3b337e52f91fb41cd

Observation 9403c1a8-940e-47fd-ab58-4ddc54795fd6 · outbound

This paper cites To catch a chorus, verse, intro, or anything else: Analyzing a song with structural functions,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models To catch a chorus, verse, intro, or anything else: Analyzing a song with structural functions,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.044611Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.706806Z digest=sha256:acf4631bae9c9134faa010c6c1375cc249de67c0f45dee0faee53c3f6b8e84c5

Observation c4a321f6-e2e2-4800-83e7-b3f5fa7aba01 · outbound

This paper cites Multitrack music transcription with a time-frequency perceiver,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Multitrack music transcription with a time-frequency perceiver,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.033382Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.710679Z digest=sha256:0ceeaf3ec4fb903c7f374c8318dfc3ba3943dd25e134cd84f771dbb40d3fcd59

Observation 2e1cef87-0924-48b2-a0e4-f079504bee16 · outbound

This paper cites an unresolved cited work.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-08-15T16:55:01.022465Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.713847Z digest=sha256:e1efb69f9a845525b3029ee3bca84482e73ea9d71ea7c576c2c9546b6c5d1da9

Observation 6e07b77f-cd16-401a-931c-8e1e0100c77d · outbound

This paper cites 20 years of automatic chord recognition from audio,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models 20 years of automatic chord recognition from audio,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.011627Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.716843Z digest=sha256:16d02934f7fcbdb82d132ee398d6c3a115b3a4fc5f867e5b4c4806c7e6a5e00e

Observation 4bfeb0cb-32c0-48d1-9faf-c11a4ed29d6c · outbound

This paper cites MuSFA: Improving music structural function analysis with partially labeled data,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models MuSFA: Improving music structural function analysis with partially labeled data,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:00.999377Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.720019Z digest=sha256:a5e2d0dffead014a7a60540ff024af6e3cd4abd8c9cd1f1c5de34632e9674a08

Observation 2ad78803-2d6a-4636-96b2-e959d5f5ca2a · outbound

This paper cites Retrieval-Augmented Generation for Large Language Models: A Survey.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Retrieval-Augmented Generation for Large Language Models: A Survey

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.723357Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.723357Z digest=sha256:6059af99b1c8f7d08374409258b9747790f8dc32cec1ee33c62a4f022194f083

Observation e7ed74b5-709c-452f-a67c-b9860ae88b7e · outbound

This paper cites AudioCaps: Generating captions for audios in the wild,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models AudioCaps: Generating captions for audios in the wild,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:00.987584Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-15T16:55:00.726981Z digest=sha256:267f81835328ae89aa13b6a62eaae1d2740c2e629f120d3e634fd1f05b459fd8

Observation 3bd0454b-def0-45eb-96bb-21a58a407176 · outbound

This paper cites Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.730521Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.730521Z digest=sha256:c0a33c09ade147fa62d8400ac243d8d8d1959cd481d4a31841fadc6c864725a6

Observation b9354e97-2e6c-45df-86c9-2c763a02fd2c · outbound

This paper cites WavCaps: A ChatGPT-Assisted Weakly-Labelled Audio Captioning Dataset for Audio-Language Multimodal Research.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models WavCaps: A ChatGPT-Assisted Weakly-Labelled Audio Captioning Dataset for Audio-Language Multimodal Research

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.733987Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.733987Z digest=sha256:98ed5abce509851c05afa5c16ea1fa45a2139dda2b58256d05c87d0b78ea16bd

Observation 604ac2b8-eff3-40f8-b587-f5f336a97abd · outbound

This paper cites MusicLM: Generating Music From Text.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models MusicLM: Generating Music From Text

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.738577Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.738577Z digest=sha256:1b3f215321e5b4928185a74369933ebb1e7ad9cc1f621a3a6ad531a1ab4e149c

Observation dd285438-4001-4c93-9b8a-73057c6a238d · outbound

This paper cites LoRA: Low-Rank Adaptation of Large Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models LoRA: Low-Rank Adaptation of Large Language Models

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.742512Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.742512Z digest=sha256:5a8d533c8e0ae814ffd99ec816cb70f053183b60906a7ec8c09333c997b2f6d0

Pith citing papers

No inbound Pith citation observations are available.