Pith. sign in

Paper Citation Record · LEDGER

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models

As of 20 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2508.19514.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2508.19514 v1

Coverage vector

measured 37 of 37 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T16:55:00.742512Z

measured 37 of 37 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

37 of 37 outbound references displayed

  • verified exact0
  • verified fuzzy14
  • unresolved23
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 10477540-6dc0-4212-83af-8f16599990ca · outbound

This paper cites Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.610051Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.610051Z digest=sha256:877099c7b974e25f96bb972507d6af9e226a92d49af0a1dba13c1c1fafffea6c

Observation f4ada9a7-2fe4-4deb-b747-a2a5384298d9 · outbound

This paper cites Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.614509Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.614509Z digest=sha256:27a22fd8436e8d7203c862748cc21dd5c9b6757e7cb25ea8dbdc01e792e8c2d0

Observation ae3f328d-7c54-4003-a195-0735b70d595d · outbound

This paper cites Visual instruction tuning,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Visual instruction tuning,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.618724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.618724Z digest=sha256:50492cae4dbb1fb1084ab3ac1234c1067b55195a645f735c7d5d39d0647b16f2

Observation 4045a1a5-c532-4a2c-8a78-d268c3859b30 · outbound

This paper cites Music understanding llama: Advancing text-to-music generation with question answering and captioning,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Music understanding llama: Advancing text-to-music generation with question answering and captioning,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.142731Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.622548Z digest=sha256:f09a2206759c5766ce6e63a9b49299b8ac438a3727eee0d73824a83b19778c0b

Observation 59c75b42-48eb-48d2-87b9-7f7698e8b669 · outbound

This paper cites The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision).

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision)

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.626491Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.626491Z digest=sha256:9787d5d9f642b49f881148e992be5083721da6ca40c9792d83f66bab41563460

Observation fe2c1a58-46d8-4487-a809-986289938d0b · outbound

This paper cites Sparks of Artificial General Intelligence: Early experiments with GPT-4.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Sparks of Artificial General Intelligence: Early experiments with GPT-4

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.630570Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.630570Z digest=sha256:8534428803dbcfd225aad9ff0acfc30d25d5cd0537b20743515a0ba63b5f50e9

Observation 34441854-4cd0-4d46-89b0-15308cfd3a14 · outbound

This paper cites Emergent Abilities of Large Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Emergent Abilities of Large Language Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.635201Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.635201Z digest=sha256:90451c862eec35d727d190a0d0a50296331c7354e972454fd64949a16843d1f3

Observation 262decf8-710f-43bd-be06-fe78fe43b54d · outbound

This paper cites Are emergent abilities of large language models a mirage?,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Are emergent abilities of large language models a mirage?,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.131495Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.639037Z digest=sha256:9cdeaf445dc17b88722d87e667fb579d8dd3ccefcf1c3a05f538bf23b39dd417

Observation 1d10eb41-f03e-42e0-ab17-e4128f0a4ac8 · outbound

This paper cites MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.642522Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.642522Z digest=sha256:7889d318ed4d532cd5e0a45cb260e0957b086adff643a251a6374e071ab3ee25

Observation 129069ac-5752-435a-9e4c-0b853ec8577a · outbound

This paper cites Gemini: A Family of Highly Capable Multimodal Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Gemini: A Family of Highly Capable Multimodal Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.646295Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.646295Z digest=sha256:566879d3278c7892ea9ea739ec15a33d117c9c11f1abed80576c310e71fc0e37

Observation 5006fb8b-d366-4c3b-8fb2-ad19b5083db2 · outbound

This paper cites GPT-4 Technical Report.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models GPT-4 Technical Report

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.649874Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.649874Z digest=sha256:721e1b182a235142d61be205b39ae799b83032d4068cc190c12d1ffcb7de4247

Observation 3c453831-ba0c-4fc6-9704-297907ee87b7 · outbound

This paper cites Robust speech recognition via large-scale weak supervision,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Robust speech recognition via large-scale weak supervision,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.120792Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.653693Z digest=sha256:67df4d4be62f689d6fa460da41e09f5de550d958bb79125915c2645ebeb992a4

Observation efef8181-422e-4586-9f7d-fa6569c74dcd · outbound

This paper cites SALMONN: Towards Generic Hearing Abilities for Large Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models SALMONN: Towards Generic Hearing Abilities for Large Language Models

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.656983Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.656983Z digest=sha256:032344d8aec5b2d35b3c14fe772af643070ea16526ad741f9153ddf7bb93af0a

Observation 42f46c3a-22f1-41f1-844d-f6bf23acd84a · outbound

This paper cites LLark: A Multimodal Instruction-Following Language Model for Music.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models LLark: A Multimodal Instruction-Following Language Model for Music

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.660561Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.660561Z digest=sha256:e72ef8506404f8fa0f32665380737b4ab78d63609d970af7e8611c49ba243aaf

Observation e92829cb-bc2a-4ac6-9ba4-778ed3a070e2 · outbound

This paper cites LP-MusicCaps: LLM-based pseudo music captioning,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models LP-MusicCaps: LLM-based pseudo music captioning,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.110539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.664042Z digest=sha256:8a17660e255849c27c5002e8a309c465b482bc900f2e1b732b44c1fb4b1b6cc5

Observation 50aa2320-a300-4898-8782-0ab956596268 · outbound

This paper cites The million song dataset,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models The million song dataset,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.100065Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.667291Z digest=sha256:7551b89a37f7317b262276108610ee55bec575ba31027408284b4af2ac4abe5a

Observation d977618f-5619-4888-9e72-9b7f6641563c · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.671094Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.671094Z digest=sha256:3e1ef163041cd8cc75872e69338981a0eede5a53c566569b8c9d60408b7f30d4

Observation 5531cbcf-57c1-4ad0-b9fa-847cc4d1668f · outbound

This paper cites G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.674220Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.674220Z digest=sha256:2392eb159c29cfa81d90fd261704f26b39a32186f2f6c66e09800ba1d1e36e77

Observation af970079-8a50-49e8-af52-0046379447a4 · outbound

This paper cites GPT-4 as an Effective Zero-Shot Evaluator for Scientific Figure Captions.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models GPT-4 as an Effective Zero-Shot Evaluator for Scientific Figure Captions

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.677916Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.677916Z digest=sha256:5c6a0a072a8fa0fa5900da7e15a79c728595eb7189f08cb1086f7f8513683853

Observation e548c8d3-f505-48f0-9597-cef2c5130f96 · outbound

This paper cites Is GPT-4 a reliable rater? Evaluating Consistency in GPT-4 Text Ratings.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Is GPT-4 a reliable rater? Evaluating Consistency in GPT-4 Text Ratings

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.681892Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.681892Z digest=sha256:63c8915cedf56c8ff417cab83f57e9f0b368d8de74262d98bba6317fcfc34821

Observation 54974810-816b-49f2-9399-b89a999f057f · outbound

This paper cites Large Language Models Are Human-Level Prompt Engineers.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Large Language Models Are Human-Level Prompt Engineers

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.685492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.685492Z digest=sha256:8f27f30695efa238cc2b4c78b94e25bd5f565901fbf0e99e4fb8139991a54e3e

Observation 656c485a-649a-44a5-b09c-51d442055395 · outbound

This paper cites Learning to answer questions in dynamic audio-visual scenarios,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Learning to answer questions in dynamic audio-visual scenarios,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.088578Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.689040Z digest=sha256:dda6dc0b14102d1c819f58b02f473d9dacf2b4b86580b2112d305acb49bd1c85

Observation 54eb1332-d0ec-43b7-853d-0746e6b9efe9 · outbound

This paper cites MusicAgent: An AI Agent for Music Understanding and Generation with Large Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models MusicAgent: An AI Agent for Music Understanding and Generation with Large Language Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.692237Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.692237Z digest=sha256:58769fdcf0e6967aa37b1534822f5abe0827a0443d1a7231ebc14c0581d95fd7

Observation 14afe033-7a0f-4226-88a7-acecc3e5ce64 · outbound

This paper cites Multi-level and multi-scale feature aggregation using pretrained convolutional neural networks for music auto-tagging,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Multi-level and multi-scale feature aggregation using pretrained convolutional neural networks for music auto-tagging,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.077554Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.696287Z digest=sha256:c09c46772c7f636c97df65468a7ad07c6bba21600784999d7732a55bda22fb71

Observation e690701b-98e8-41f8-8bb4-19ddca150416 · outbound

This paper cites Modeling beats and downbeats with a time-frequency transformer,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Modeling beats and downbeats with a time-frequency transformer,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.067010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.699578Z digest=sha256:76e4d7839d18a1c798e696ffb81f1d591a8cd01b361a5fcd5ad944dbd70b5ab8

Observation f05d1fa9-4b76-4a75-9cb0-0c4ea9125a37 · outbound

This paper cites SpecTNT: A time-frequency transformer for music audio,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models SpecTNT: A time-frequency transformer for music audio,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.055680Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.703283Z digest=sha256:6b71eb0b6d99a4fa9f7a1688c43a46ea248b60cf2d2f03dcc1cdd5049ab362d5

Observation 9403c1a8-940e-47fd-ab58-4ddc54795fd6 · outbound

This paper cites To catch a chorus, verse, intro, or anything else: Analyzing a song with structural functions,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models To catch a chorus, verse, intro, or anything else: Analyzing a song with structural functions,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.044611Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.706806Z digest=sha256:a37db9d5527ff2c90e5dce35dd916de809fa1cbc0ba65ff0170dd0d1c95995f1

Observation c4a321f6-e2e2-4800-83e7-b3f5fa7aba01 · outbound

This paper cites Multitrack music transcription with a time-frequency perceiver,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Multitrack music transcription with a time-frequency perceiver,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.033382Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.710679Z digest=sha256:385197261fbd0f8ecd9cd9e99c13179ce2fe3f6509cb9f4d782be1e617c443fe

Observation 2e1cef87-0924-48b2-a0e4-f079504bee16 · outbound

This paper cites an unresolved cited work.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-08-15T16:55:01.022465Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.713847Z digest=sha256:780f500eb39b3b8b8452e3326c761ba5405d049cb6eb22cf308f2a373a29702e

Observation 6e07b77f-cd16-401a-931c-8e1e0100c77d · outbound

This paper cites 20 years of automatic chord recognition from audio,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models 20 years of automatic chord recognition from audio,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:01.011627Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.716843Z digest=sha256:543440a3ece02ba4ea2ed9828aa43676daa631ac09bc7040bdce2a737417a0f5

Observation 4bfeb0cb-32c0-48d1-9faf-c11a4ed29d6c · outbound

This paper cites MuSFA: Improving music structural function analysis with partially labeled data,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models MuSFA: Improving music structural function analysis with partially labeled data,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:00.999377Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.720019Z digest=sha256:6a64d34171822e8ddaad8b75d3910b6c71b594a30aa1e91e6a9a9752601822e0

Observation 2ad78803-2d6a-4636-96b2-e959d5f5ca2a · outbound

This paper cites Retrieval-Augmented Generation for Large Language Models: A Survey.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Retrieval-Augmented Generation for Large Language Models: A Survey

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.723357Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.723357Z digest=sha256:de7fa65db0dd181593787c56bd141290997d9737e54737a3c2870da6e3197f66

Observation e7ed74b5-709c-452f-a67c-b9860ae88b7e · outbound

This paper cites AudioCaps: Generating captions for audios in the wild,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models AudioCaps: Generating captions for audios in the wild,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T16:55:00.987584Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T16:55:00.726981Z digest=sha256:8cc09ce541a82ec575877ffeb42b7dcb436c94b537bf2b6add2dc0293276d64a

Observation 3bd0454b-def0-45eb-96bb-21a58a407176 · outbound

This paper cites Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.730521Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.730521Z digest=sha256:b592bebab64b7c48b433aefa39dddcbe03357a0f0a16b88715094b71e701e0cf

Observation b9354e97-2e6c-45df-86c9-2c763a02fd2c · outbound

This paper cites WavCaps: A ChatGPT-Assisted Weakly-Labelled Audio Captioning Dataset for Audio-Language Multimodal Research.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models WavCaps: A ChatGPT-Assisted Weakly-Labelled Audio Captioning Dataset for Audio-Language Multimodal Research

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.733987Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.733987Z digest=sha256:36f1fb8e1f5c3a0abbeb1dd56ff654d4fea7249bcf9a76f66334f61cecf8dcbe

Observation 604ac2b8-eff3-40f8-b587-f5f336a97abd · outbound

This paper cites MusicLM: Generating Music From Text.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models MusicLM: Generating Music From Text

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.738577Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.738577Z digest=sha256:9de4a1f769e6361124bcfa1b1b0236fb2b34765777d8a858ab77d7dc3c678746

Observation dd285438-4001-4c93-9b8a-73057c6a238d · outbound

This paper cites LoRA: Low-Rank Adaptation of Large Language Models.

MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models LoRA: Low-Rank Adaptation of Large Language Models

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-15T16:55:00.742512Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T16:55:00.742512Z digest=sha256:69b05b7179a83427042fc48364c7acfeb5dd006b87217c7fe2d7dd688b99e52d

Pith citing papers

No inbound Pith citation observations are available.