{"as_of":"2026-08-16T13:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a0b78f740df2f6c8bf05d2257dd48f5fa312f00c4b3c0f98babbd408493c5062","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:46:11.761268Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04142/citation-record","integrity":"/paper/2608.04142/integrity","json":"/paper/2608.04142/citation-record.json","paper":"/paper/2608.04142"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05139","last_updated":"2025-02-07T18:15:57Z","snapshot_observed_at":"2026-08-14T10:00:02.244477Z","submitted_at":"2025-02-07T18:15:57Z","title":"Meta Audiobox Aesthetics: Unified Automatic Quality Assessment for Speech, Music, and Sound","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05139","snapshot_observed_at":"2026-08-15T14:46:11.677529Z","title":"Meta audiobox aesthetics: Unified automatic quality assessment for speech, music, and sound,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.677529Z"},"links":{"cited_paper":"/paper/2502.05139","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:eea8cbb900a566f37da6fca99440da73a241422d8f2cc336a31522533f0960fb","observation_id":"ddb0213a-39ef-4517-9a9d-cff081c52f83","resolution":{"observed_at":"2026-08-15T14:46:11.677529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.08466","last_updated":"2019-01-17T16:12:43Z","snapshot_observed_at":"2026-08-15T08:25:11.276003Z","submitted_at":"2018-12-20T10:28:00Z","title":"Fr\\'echet Audio Distance: A Metric for Evaluating Music Enhancement Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.08466","snapshot_observed_at":"2026-08-15T14:46:11.682457Z","title":"Fréchet audio distance: A metric for evaluating music enhancement algorithms,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.682457Z"},"links":{"cited_paper":"/paper/1812.08466","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:ab9a8edf4819be5602ad53c3d4061c0f10d9c9cf306c95b1c2496f0cb01afce8","observation_id":"b689e4a8-bdbd-4e0a-aac7-e57230deadbd","resolution":{"observed_at":"2026-08-15T14:46:11.682457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.09430","last_updated":"2017-01-10T18:06:51Z","snapshot_observed_at":"2026-08-14T21:37:30.204671Z","submitted_at":"2016-09-29T17:04:50Z","title":"CNN Architectures for Large-Scale Audio Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.09430","snapshot_observed_at":"2026-08-15T14:46:11.687441Z","title":"Cnn architectures for large-scale audio classification,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.687441Z"},"links":{"cited_paper":"/paper/1609.09430","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:c9ddc4ba625cffba216b2d1cbc083708bf44024ba07292fcf1fae15f809218b6","observation_id":"5e960e02-b2ba-4c67-8ee9-6bf00624f856","resolution":{"observed_at":"2026-08-15T14:46:11.687441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.06687","last_updated":"2024-03-21T21:35:04Z","snapshot_observed_at":"2026-08-15T08:25:14.416737Z","submitted_at":"2022-11-12T15:25:20Z","title":"Large-scale Contrastive Language-Audio Pretraining with Feature Fusion and Keyword-to-Caption Augmentation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.06687","snapshot_observed_at":"2026-08-15T14:46:11.692068Z","title":"Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.692068Z"},"links":{"cited_paper":"/paper/2211.06687","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:33ffa759ccb53424d666333f78dddedf83f799d2d4beac74248c73b8bdce0cff","observation_id":"f60329f6-5bef-4b65-b095-19cb5481d048","resolution":{"observed_at":"2026-08-15T14:46:11.692068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:12.001621Z","title":"Flow matching for generative modeling,","venue":null,"work_id":"590cf1c7-4b5e-4e13-91ef-1eab632f8c5a","year":null},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.696967Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:c5bd89ac8ca81b4e7c1089acad6f2aa59810901c358e24639a75e7f4bb7f5012","observation_id":"a978871c-2960-4c75-97fe-3aa4286669d9","resolution":{"observed_at":"2026-08-15T14:46:12.007083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:11.705263Z","title":"Musiclm: Generating music from text,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.705263Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:de2bc6fb0359079b21f37f0a4e98d717461e590028905d1e37ce22834d935214","observation_id":"eba1935a-b982-421d-a1f2-ab33d093de81","resolution":{"observed_at":"2026-08-15T14:46:11.705263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-13T15:19:04.329360Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-15T14:46:11.713429Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.713429Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:7144a99abe2b953ae65362f6d0282a937c3e04e91fa95d026db3cf11dbe65ea7","observation_id":"a30dda79-60c0-45ca-b789-f0d6c48f1f3a","resolution":{"observed_at":"2026-08-15T14:46:11.713429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:11.709352Z","title":"Available: https://arxiv.org/abs/2301","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.709352Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:97110e450e434b69acfc80a51b8a2df7819200a6f4d31cbcce201ba8649c92e7","observation_id":"909fbc39-6af5-4a53-9ace-8a4d54847b2a","resolution":{"observed_at":"2026-08-15T14:46:11.709352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16669","last_updated":"2025-03-20T19:31:04Z","snapshot_observed_at":"2026-08-16T12:48:08.873711Z","submitted_at":"2025-03-20T19:31:04Z","title":"Aligning Text-to-Music Evaluation with Human Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16669","snapshot_observed_at":"2026-08-15T14:46:11.722546Z","title":"Aligning text-to-music evaluation with human preferences,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.722546Z"},"links":{"cited_paper":"/paper/2503.16669","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:8c5fcb1757ad4eadffb6c31cd570d84b032bf52669b5378af91d21bbe5adc6c2","observation_id":"2074fbd0-2e7d-4229-a1f3-f8e24b944091","resolution":{"observed_at":"2026-08-15T14:46:11.722546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01616","last_updated":"2024-03-05T22:14:14Z","snapshot_observed_at":"2026-08-13T05:33:48.213366Z","submitted_at":"2023-11-02T21:58:55Z","title":"Adapting Frechet Audio Distance for Generative Music Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01616","snapshot_observed_at":"2026-08-15T14:46:11.718188Z","title":"Adapting frechet audio distance for generative music evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.718188Z"},"links":{"cited_paper":"/paper/2311.01616","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:b11a5db443fd67b57069c574ac7d7947ce6d604d980c924d3950bd75d035fe75","observation_id":"ecd47795-b220-44a0-8ec9-90ec698163ff","resolution":{"observed_at":"2026-08-15T14:46:11.718188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15602","last_updated":"2025-03-09T06:46:13Z","snapshot_observed_at":"2026-08-16T12:56:17.563466Z","submitted_at":"2025-02-21T17:19:15Z","title":"KAD: No More FAD! An Effective and Efficient Evaluation Metric for Audio Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15602","snapshot_observed_at":"2026-08-15T14:46:11.731849Z","title":"Kad: No more fad! an effective and efficient evaluation metric for audio generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.731849Z"},"links":{"cited_paper":"/paper/2502.15602","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:d5ad85b8422f3770cce725220b8b31c38d765188fb953cb731ea0c2cbc0be789","observation_id":"1e51b4b9-77e8-4184-b66b-ade221f10d6a","resolution":{"observed_at":"2026-08-15T14:46:11.731849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01454","last_updated":"2021-11-23T06:12:36Z","snapshot_observed_at":"2026-08-15T03:20:34.540578Z","submitted_at":"2021-02-02T11:59:28Z","title":"MAUVE: Measuring the Gap Between Neural Text and Human Text using Divergence Frontiers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.01454","snapshot_observed_at":"2026-08-15T14:46:11.726757Z","title":"Mauve: Measuring the gap between neural text and human text using divergence frontiers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.726757Z"},"links":{"cited_paper":"/paper/2102.01454","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:dca254d60c4ae81f6659d4fbb49682bff79d98528e0d52de5b906ca319bbacc2","observation_id":"97e7799e-7e9b-4b9f-81d9-36db8aa342a9","resolution":{"observed_at":"2026-08-15T14:46:11.726757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-15T04:43:16.361751Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-15T14:46:11.740907Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.740907Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:222bb9f7e21e1f44073703b5a15281cc35c44d93c9c30f202f3ffa098d6ae5b9","observation_id":"4012f6f6-6d1f-4d6c-a569-c5f0ae01a05e","resolution":{"observed_at":"2026-08-15T14:46:11.740907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10970","last_updated":"2024-06-16T15:06:06Z","snapshot_observed_at":"2026-08-14T21:45:34.282495Z","submitted_at":"2024-06-16T15:06:06Z","title":"Joint Audio and Symbolic Conditioning for Temporally Controlled Text-to-Music Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10970","snapshot_observed_at":"2026-08-15T14:46:11.736154Z","title":"Joint audio and symbolic conditioning for temporally controlled text-to-music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.736154Z"},"links":{"cited_paper":"/paper/2406.10970","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:787f2d6a1ed24ee9489e28a45f3357d183c5a49ed78f2ff4f5409b0438895775","observation_id":"79097689-adc6-47e1-9315-e3c9715c9ec1","resolution":{"observed_at":"2026-08-15T14:46:11.736154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.01840","last_updated":"2017-09-05T18:38:33Z","snapshot_observed_at":"2026-08-14T21:26:53.042056Z","submitted_at":"2016-12-06T14:58:59Z","title":"FMA: A Dataset For Music Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.01840","snapshot_observed_at":"2026-08-15T14:46:11.748708Z","title":"Defferrard, K","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.748708Z"},"links":{"cited_paper":"/paper/1612.01840","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:0f60c32c59098aa0a37257226a87143189f28b937b7a813825d0496715fd4c4d","observation_id":"91e6567f-f575-4ffb-b887-0865b1916e49","resolution":{"observed_at":"2026-08-15T14:46:11.748708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:11.961740Z","title":"The mtg-jamendo dataset for automatic music tagging,","venue":null,"work_id":"4efc3e02-fc82-4642-8ad9-e0ca4d4754d4","year":2019},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.745031Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:04377cba4b1040ab8e080346faa0ca94c2e5f88230927555e07a30fae58638b6","observation_id":"b030ecc6-f002-4404-b967-c9c2720cedb3","resolution":{"observed_at":"2026-08-15T14:46:11.966355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04577","last_updated":"2024-03-05T09:12:35Z","snapshot_observed_at":"2026-08-13T04:45:56.006574Z","submitted_at":"2024-01-09T14:29:39Z","title":"Masked Audio Generation using a Single Non-Autoregressive Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04577","snapshot_observed_at":"2026-08-15T14:46:11.757300Z","title":"Masked audio generation using a single non- autoregressive transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.757300Z"},"links":{"cited_paper":"/paper/2401.04577","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:4b94b72c86b6efdf61b6789cf60590e13344c9d1fc0ca520542279ca5b2034c2","observation_id":"4cbdf8c5-f55b-4e23-b556-88b818ec858d","resolution":{"observed_at":"2026-08-15T14:46:11.757300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02569","last_updated":"2019-06-06T13:18:47Z","snapshot_observed_at":"2026-08-16T10:18:46.160993Z","submitted_at":"2019-06-06T13:18:47Z","title":"Gradio: Hassle-Free Sharing and Testing of ML Models in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.02569","snapshot_observed_at":"2026-08-15T14:46:11.752715Z","title":"Gradio: Hassle-free sharing and testing of ml models in the wild,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.752715Z"},"links":{"cited_paper":"/paper/1906.02569","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:5f2004f21cc77ff9995bc7e4165d613132c5fd4f454ae60c2a6a9583ff63edda","observation_id":"631bbbe5-d721-4c37-89be-1ed6e568423e","resolution":{"observed_at":"2026-08-15T14:46:11.752715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:11.948331Z","title":null,"venue":null,"work_id":"b72ccb03-68bc-4dd7-b901-d1fcb333a9af","year":1959},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.761268Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:c6eee70846025af4c190393e47c4a3ae0f0a97f0295e8717d157818c914c56a5","observation_id":"313d7134-83bb-48d5-a8e6-4e3a4345f704","resolution":{"observed_at":"2026-08-15T14:46:11.953231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:46:11.989703Z","title":"Available: https://arxiv.org/abs/2210","venue":null,"work_id":"02eee8b7-ebdc-4887-849f-c29bd0d8f5bf","year":null},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.701282Z"},"links":{"citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:0b65095359d052d18eec223d806eff0288f7a30a35e3a605934e82a173a8fb06","observation_id":"f36505db-cdca-4c98-98b9-4e850ad2d9a2","resolution":{"observed_at":"2026-08-15T14:46:11.993602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2608.04142."}