{"as_of":"2026-08-16T12:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10a7a64cbf88a0666f225e5bda669fd1960bc76d1f5ec0df8d295a58e935db52","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:55:44.823010Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.03464/citation-record","integrity":"/paper/2501.03464/integrity","json":"/paper/2501.03464/citation-record.json","paper":"/paper/2501.03464"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.354217Z","title":"Sound event detection: A tutorial,","venue":null,"work_id":"ecc2d1fd-254d-4925-913e-83e13da2ffbc","year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.701485Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:db146f049e1cd062e66160f9511cc015f8f58080c82552c4b96e8408ba07fca5","observation_id":"6325dd78-87eb-46b4-849f-3577b647ddb0","resolution":{"observed_at":"2026-08-10T21:55:45.361388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.335575Z","title":"Deep learning in music recommendation systems,","venue":null,"work_id":"21e682fc-fe44-4540-a8e5-13f9a039bae3","year":2019},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.706300Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:3a315b46c13d5344a7e91465484ad413feb5e0138e1845a70958ce28d04c9d93","observation_id":"e8d7620d-e248-4380-903f-8897faad861f","resolution":{"observed_at":"2026-08-10T21:55:45.340990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.309349Z","title":"Deep spoken keyword spotting: An overview,","venue":null,"work_id":"7db7c255-39ce-4e45-9aed-a1cd4c8b3d38","year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.710946Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:d292b75433ba067db8a5c20ee44dc079815c8649052ff61cd7810109dd7c2b09","observation_id":"55f08fcf-30d1-475e-b4bc-13443cccd571","resolution":{"observed_at":"2026-08-10T21:55:45.317985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.11154","last_updated":"2020-11-13T19:09:09Z","snapshot_observed_at":"2026-08-13T10:14:31.550038Z","submitted_at":"2020-07-22T01:31:44Z","title":"Rethinking CNN Models for Audio Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.11154","snapshot_observed_at":"2026-08-10T21:55:44.715285Z","title":"Rethinking cnn models for audio classification,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.715285Z"},"links":{"cited_paper":"/paper/2007.11154","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:a2f0c771a0730adf80798d133dd524f3e0e101a13b70b6d13a7c41e48533d2d0","observation_id":"ae89e485-d290-4b1c-b068-07621e0f7c7b","resolution":{"observed_at":"2026-08-10T21:55:44.715285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01778","last_updated":"2021-07-08T20:16:28Z","snapshot_observed_at":"2026-08-14T17:33:12.476362Z","submitted_at":"2021-04-05T05:26:29Z","title":"AST: Audio Spectrogram Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01778","snapshot_observed_at":"2026-08-10T21:55:44.719966Z","title":"Ast: Audio spectrogram transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.719966Z"},"links":{"cited_paper":"/paper/2104.01778","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:17c888ac82544c3d235df9cd7ce0cc85eb1a7617aca40839fdaefcbf7df68cfb","observation_id":"8bab9c2e-488c-4f31-aa61-835f4f7b511c","resolution":{"observed_at":"2026-08-10T21:55:44.719966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.293071Z","title":"Clusterfomer,","venue":null,"work_id":"c413c226-cdaf-4b26-aa92-bdf61057be5f","year":2024},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.724245Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:e7aa1878a5ac56d85faa2c8b1428d50324cbf27660b24e1bcefb14f6ef05e285","observation_id":"36e45f4b-c836-45ff-8fd8-68412a838374","resolution":{"observed_at":"2026-08-10T21:55:45.298682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.273805Z","title":"Hypergraph neural networks,","venue":null,"work_id":"1381fc04-fd7c-4152-9604-09e84568fe5b","year":2019},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.728346Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:43a65306f0dd63c41279c3a65268d2db8e46bec1d9838536622011c63f563f82","observation_id":"657868b8-6b35-4119-8828-f1c116485e82","resolution":{"observed_at":"2026-08-10T21:55:45.278446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:44.731981Z","title":"Vision hgnn: An image is more than a graph of nodes,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.731981Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:9897fc35571ee37b07f5bfdf2d9f3ca6396cf7aa06b0f64b3e613f87f3eb9796","observation_id":"2527155e-813a-46cf-a47e-ade6d9df8b66","resolution":{"observed_at":"2026-08-10T21:55:44.731981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.245084Z","title":"Everything is connected: Graph neural networks,","venue":null,"work_id":"07add9e9-72c0-4cb9-925d-29b3d9943f44","year":2023},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.735725Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:82712c1ecb4cd518c51b429f1e20d967733c928b650df0faead9251bfb08adee","observation_id":"cf5b7c73-2339-46eb-947c-540249751025","resolution":{"observed_at":"2026-08-10T21:55:45.250530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.226487Z","title":"Vision gnn: An image is worth graph of nodes,","venue":null,"work_id":"cf6bfb7f-174f-4d83-a313-b7416ce22464","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.739672Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:206ccefae589f8a5e6354309e0aade2f4261f26b50fd2ede45d197a1ef7e6533","observation_id":"413ecf94-e412-40a2-a503-cd29f94beeb4","resolution":{"observed_at":"2026-08-10T21:55:45.231652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.204751Z","title":"Atgnn: Audio tagging graph neural network,","venue":null,"work_id":"51276100-8370-4b9e-b87a-3859cbb9a598","year":2024},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.743664Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:cf43e2d3f0d9c7561ac8e805b861fc7decd77134e09f618e4ea844d29217f75f","observation_id":"7ad759b0-88b9-4134-86e9-7318da9d3896","resolution":{"observed_at":"2026-08-10T21:55:45.209363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.187810Z","title":"Cmt: Convolutional neural networks meet vision transformers,","venue":null,"work_id":"eb28745a-a5e8-4c77-92c9-0833139e46b3","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.748149Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:d8fa348f4c49461aeec5a5ce22bb06c71993b9cd8db8609fed66993d5c834658","observation_id":"173befea-b864-49be-b000-f17ffac96d88","resolution":{"observed_at":"2026-08-10T21:55:45.193060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-10T21:55:44.752143Z","title":"Gaussian error linear units (gelus),","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.752143Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:44dd8495dc5a0c096933b28fceed64f78c50d52ca9eb4fb5ac775320c2c7a99d","observation_id":"b69da150-041e-422f-a508-39a31f443ab2","resolution":{"observed_at":"2026-08-10T21:55:44.752143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.163565Z","title":"Orthogonal transformer,","venue":null,"work_id":"fd725d8d-4853-4fd8-8c61-8a9fe1f029ed","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.756406Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:6dc7037492a2e912244ffc686079f5d6165454be34a163bb39c43ed33ea7a8f1","observation_id":"324f534c-6715-42b8-94f5-c5c002c1a6d8","resolution":{"observed_at":"2026-08-10T21:55:45.167870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.146468Z","title":"How do vision transformers work?,","venue":null,"work_id":"0f8a289e-2e9c-4ba3-80e9-45f414d76a12","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.760167Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:603efe46e5d8a922e8b68730d0ec1391be179fafcae7301d08b675f587b864d2","observation_id":"9c34f8ae-0218-4d16-a678-9d2f21a54b15","resolution":{"observed_at":"2026-08-10T21:55:45.152758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.131593Z","title":"Srformer: Permuted self-attention for single image super-resolution,","venue":null,"work_id":"69044363-904b-417d-97a2-77cdf44bf7cd","year":2023},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.764081Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:3cd829112419c4613e0a1e534e17f731e363a5460d6f09ea485657e31381d7d4","observation_id":"c0c72d1e-def0-4d27-9dd2-61296b454557","resolution":{"observed_at":"2026-08-10T21:55:45.136937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.116752Z","title":"Audioset,","venue":null,"work_id":"0ef64a98-9d93-4079-8d7b-ce85dec40ffe","year":2017},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.768221Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:1d6f8e0b9df80b2255e11d6f7d90b5c39078329fa19714e6a3d8c4d11ea1e2a7","observation_id":"18ab7291-cd5e-4ae6-8ef1-c72a7307e43b","resolution":{"observed_at":"2026-08-10T21:55:45.120995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.100406Z","title":null,"venue":null,"work_id":"784c528b-4e65-4b00-b6f0-38b5e49f6aa8","year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.772186Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:210e90503c46f766a98a75aea4683ab864afb40cd5a1f4a4c2a7a3a2243ebafa","observation_id":"6b471681-39e3-4c66-8e42-43a06c66660f","resolution":{"observed_at":"2026-08-10T21:55:45.107001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.083630Z","title":"Esc-50: Dataset for environmental sound classification,","venue":null,"work_id":"c92e1881-2b1c-4fd6-b1e4-145570e92a7b","year":2015},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.776136Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:f55a786df3d7a0320b469c27f86e274d952aee58cd80bacccf387b44823ab837","observation_id":"45310162-1495-4a37-942d-16bad4d8a98f","resolution":{"observed_at":"2026-08-10T21:55:45.088783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.064574Z","title":"PSLA: Improving audio tagging with pretraining, sampling, labeling, and aggregation,","venue":null,"work_id":"92483af2-417f-42dd-88c7-3fa02e38cf53","year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.780860Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:fcca3f474e406290503ecf6eb8ab24e449824172dc0ffeb70c72bd280a94e8cc","observation_id":"fd448187-d700-40a2-b395-e01277fb93cb","resolution":{"observed_at":"2026-08-10T21:55:45.070832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-10T21:55:44.785607Z","title":"mixup: Beyond empirical risk minimization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.785607Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:96b6b105fd17ee015ea4be5a30700c41c387971a325383a6a0f701a1865dfbae","observation_id":"6a18f7b1-9544-40d6-955e-e625fff5297c","resolution":{"observed_at":"2026-08-10T21:55:44.785607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-15T18:44:59.455586Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-10T21:55:44.790298Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.790298Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:22dead944a38e75cada6e95eac8ddbee086959a5fcd3d2a2b4b8170f28050acc","observation_id":"7c8d5a98-8fde-479c-baac-b39705c6c96b","resolution":{"observed_at":"2026-08-10T21:55:44.790298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.043303Z","title":"A deep residual network for large-scale acoustic scene analysis.,","venue":null,"work_id":"927c0bf7-bee0-4a5c-9a92-e9405bedd409","year":2019},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.796399Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:6a3bbfe5f189f836379903e7c879b31e859a8eb6e3b09ac518a7a85edef66abc","observation_id":"1c734d9e-c38c-49c4-8cfb-24514d8becdc","resolution":{"observed_at":"2026-08-10T21:55:45.048524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.021757Z","title":"Panns: Large-scale pretrained audio neural networks for audio pattern recognition,","venue":null,"work_id":"a1e76eca-c590-4e79-99db-2fd1504b1728","year":2020},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.800423Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:ace2b49581cfb59be4143791ae744879b9c37edd1b362b0cc6de1c4d0113d0bc","observation_id":"a32afdfd-557b-49f9-a62f-10c52751d507","resolution":{"observed_at":"2026-08-10T21:55:45.027612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.000384Z","title":"Wav2clip: Learning robust audio representations from clip,","venue":null,"work_id":"11532d4a-2ac6-4a8b-84e6-7c49860bb5d9","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.804265Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:f9993e8dbe1c4549014aa6138eda81a0b82960a84e31f40da6f0df32887911e5","observation_id":"6b6313b2-6a26-457e-9874-b3fb74c443ab","resolution":{"observed_at":"2026-08-10T21:55:45.007148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00335","last_updated":"2025-05-11T23:57:58Z","snapshot_observed_at":"2026-08-13T19:30:07.024004Z","submitted_at":"2021-05-01T19:38:30Z","title":"Audio Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.00335","snapshot_observed_at":"2026-08-10T21:55:44.808697Z","title":"Audio transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.808697Z"},"links":{"cited_paper":"/paper/2105.00335","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:636ff431f8b881b08d7e7e9b42cf8050260246444fd6b6bee434d6e26669a3c9","observation_id":"6b0c9c7e-4c83-4f61-858e-6c261e875287","resolution":{"observed_at":"2026-08-10T21:55:44.808697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:44.814147Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.814147Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:b85d68ed7bb80bf0d7811a4a43ff1b1fad221d839e90ff0d53acb1a8d88a2cf6","observation_id":"510729f1-d569-4d93-9d28-5146d7af1fd5","resolution":{"observed_at":"2026-08-10T21:55:44.814147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:44.972635Z","title":null,"venue":null,"work_id":"dcad2a8e-b5a1-4784-af8e-c81b90504eee","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.818155Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:4b2cee0689e277e4163b5f2a31ebf725e53e6a63212eaf97e0332b50888301c2","observation_id":"f220a941-f7bb-4480-b009-0a99628dce3b","resolution":{"observed_at":"2026-08-10T21:55:44.977369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:44.955534Z","title":"ESC: Dataset for Environmental Sound Classification,","venue":null,"work_id":"ea3aedea-1085-4f00-9f6e-7a606d7f8a18","year":null},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.823010Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:7119778c03ecf4b975bf41050baaff73473f18335b4a5e564a379d0e04202f50","observation_id":"16a140a1-6eb7-4f66-9761-11b1ddcdc4ae","resolution":{"observed_at":"2026-08-10T21:55:44.962245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2501.03464."}