{"as_of":"2026-08-20T00:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a8f4db148c0e1aceeca852e1067edd78a935664f87163db8f99c372ef98f1cb","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":3,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":3,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T18:59:42.949686Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-05T12:30:59.891699Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.16505","last_updated":"2025-02-20T00:51:26Z","snapshot_observed_at":"2026-08-19T10:55:33.144857Z","submitted_at":"2024-10-21T20:55:33Z","title":"Do Audio-Language Models Understand Linguistic Variations?","version":2},"cited_work":{"arxiv_id":"2410.16505","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.16505","snapshot_observed_at":"2026-07-05T12:30:59.891699Z","title":"arXiv preprint arXiv:2410.16505 , year=","venue":"cs.SD","work_id":"114eec3c-633d-4356-b4f5-86b011bda974","year":2024},"citing_paper":{"arxiv_id":"2604.18360","last_updated":"2026-07-07T23:45:36Z","snapshot_observed_at":"2026-08-13T09:45:26.814183Z","submitted_at":"2026-04-20T14:50:33Z","title":"Omni-Embed-Audio: Leveraging Multimodal LLMs for Robust Audio-Text Retrieval","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-10T03:23:40.993175Z"},"links":{"cited_paper":"/paper/2410.16505","citing_paper":"/paper/2604.18360"},"observation_digest":"sha256:8f88c365ec76005d55c8ef9862212c14a6df783ac86f743cc29aa532dae07199","observation_id":"51f6eb31-568f-4998-82f0-f50aea123a51","resolution":{"observed_at":"2026-05-10T03:24:14.939177Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16505","last_updated":"2025-02-20T00:51:26Z","snapshot_observed_at":"2026-08-19T10:55:33.144857Z","submitted_at":"2024-10-21T20:55:33Z","title":"Do Audio-Language Models Understand Linguistic Variations?","version":2},"cited_work":{"arxiv_id":"2410.16505","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.16505","snapshot_observed_at":"2026-07-05T12:30:59.891699Z","title":"arXiv preprint arXiv:2410.16505 , year=","venue":"cs.SD","work_id":"114eec3c-633d-4356-b4f5-86b011bda974","year":2024},"citing_paper":{"arxiv_id":"2604.18360","last_updated":"2026-07-07T23:45:36Z","snapshot_observed_at":"2026-08-13T09:45:26.814183Z","submitted_at":"2026-04-20T14:50:33Z","title":"Omni-Embed-Audio: Leveraging Multimodal LLMs for Robust Audio-Text Retrieval","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-05T12:23:39.320662Z"},"links":{"cited_paper":"/paper/2410.16505","citing_paper":"/paper/2604.18360"},"observation_digest":"sha256:43aa95044f2a97b0d0c82ef1ba90e9e32ec884a2a8356d510d9683355ee407bd","observation_id":"649ea68e-4d09-41fd-a86d-adc750fb4305","resolution":{"observed_at":"2026-07-05T12:30:59.896024Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16505","last_updated":"2025-02-20T00:51:26Z","snapshot_observed_at":"2026-08-19T10:55:33.144857Z","submitted_at":"2024-10-21T20:55:33Z","title":"Do Audio-Language Models Understand Linguistic Variations?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16505","snapshot_observed_at":"2026-07-12T18:59:42.949686Z","title":"InAdvances in In- formation Retrieval: 44th European Conference on IR Research (ECIR), pages 397–412","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.18360","last_updated":"2026-07-07T23:45:36Z","snapshot_observed_at":"2026-08-13T09:45:26.814183Z","submitted_at":"2026-04-20T14:50:33Z","title":"Omni-Embed-Audio: Leveraging Multimodal LLMs for Robust Audio-Text Retrieval","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T18:59:42.949686Z"},"links":{"cited_paper":"/paper/2410.16505","citing_paper":"/paper/2604.18360"},"observation_digest":"sha256:afa5a775fe8ae51c1dbc02244f0516710c0c50383cbf10899fe620953ffc0904","observation_id":"4a46be4b-f81e-4621-98ff-aa683d63ea23","resolution":{"observed_at":"2026-07-12T18:59:42.949686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.16505/citation-record","integrity":"/paper/2410.16505/integrity","json":"/paper/2410.16505/citation-record.json","paper":"/paper/2410.16505"},"outbound":[],"paper":{"arxiv_id":"2410.16505","last_updated":"2025-02-20T00:51:26Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-19T10:55:33.144857Z","submitted_at":"2024-10-21T20:55:33Z","title":"Do Audio-Language Models Understand Linguistic Variations?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 3 inbound Pith citation observations for arXiv:2410.16505."}