{"as_of":"2026-08-19T15:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4cb07dcc738cedf48508513c2df3400bb878394c917916d15e7b921399bdfff7","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:22:08.784841Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T17:56:58.130779Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.10999","last_updated":"2025-05-23T10:37:01Z","snapshot_observed_at":"2026-08-16T13:17:54.428873Z","submitted_at":"2024-09-17T09:04:03Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10999","snapshot_observed_at":"2026-08-11T23:19:11.594038Z","title":"Enhancing low-resource language and instruction following capabilities of audio language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02611","last_updated":"2024-12-03T17:41:23Z","snapshot_observed_at":"2026-08-17T20:15:24.350046Z","submitted_at":"2024-12-03T17:41:23Z","title":"AV-Odyssey Bench: Can Your Multimodal LLMs Really Understand Audio-Visual Information?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T23:19:11.594038Z"},"links":{"cited_paper":"/paper/2409.10999","citing_paper":"/paper/2412.02611"},"observation_digest":"sha256:7887c6852e87f28a42850fb02e4b6d941f8992a09dfa5506fc104655a1de3d34","observation_id":"6c44bf4d-c152-429c-8290-4f1a117dabf7","resolution":{"observed_at":"2026-08-11T23:19:11.594038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10999","last_updated":"2025-05-23T10:37:01Z","snapshot_observed_at":"2026-08-16T13:17:54.428873Z","submitted_at":"2024-09-17T09:04:03Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10999","snapshot_observed_at":"2026-08-11T12:56:13.308933Z","title":"Enhancing low-resource language and instruction following capabilities of audio language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13702","last_updated":"2024-12-19T17:36:38Z","snapshot_observed_at":"2026-08-18T10:39:43.720912Z","submitted_at":"2024-12-18T10:45:24Z","title":"Typhoon 2: A Family of Open Text and Multimodal Thai Large Language Models","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T12:56:13.308933Z"},"links":{"cited_paper":"/paper/2409.10999","citing_paper":"/paper/2412.13702"},"observation_digest":"sha256:e2b5d100a9311a1edff76deabe79c4ea797a74418ae0e8bc494fbff1c88e2d80","observation_id":"afb63e51-5556-42cb-8129-10ff2b0f666a","resolution":{"observed_at":"2026-08-11T12:56:13.308933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10999","last_updated":"2025-05-23T10:37:01Z","snapshot_observed_at":"2026-08-16T13:17:54.428873Z","submitted_at":"2024-09-17T09:04:03Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10999","snapshot_observed_at":"2026-08-11T11:13:48.504255Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15712","last_updated":"2025-05-30T16:35:44Z","snapshot_observed_at":"2026-08-18T08:01:18.112437Z","submitted_at":"2024-12-20T09:33:31Z","title":"Contrastive Learning for Task-Independent SpeechLLM-Pretraining","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T11:13:48.504255Z"},"links":{"cited_paper":"/paper/2409.10999","citing_paper":"/paper/2412.15712"},"observation_digest":"sha256:ec97e778f3bff03feefa9753a8c2aa95e20b90490e83e40cb98fe57640f55d01","observation_id":"3057d1ba-c2ca-4ac1-8e8c-e78614a1a48e","resolution":{"observed_at":"2026-08-11T11:13:48.504255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10999","last_updated":"2025-05-23T10:37:01Z","snapshot_observed_at":"2026-08-16T13:17:54.428873Z","submitted_at":"2024-09-17T09:04:03Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10999","snapshot_observed_at":"2026-08-16T05:22:08.784841Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20835","last_updated":"2025-04-29T14:59:42Z","snapshot_observed_at":"2026-08-17T14:11:29.849237Z","submitted_at":"2025-04-29T14:59:42Z","title":"Enhancing Non-Core Language Instruction-Following in Speech LLMs via Semi-Implicit Cross-Lingual CoT Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T05:22:08.784841Z"},"links":{"cited_paper":"/paper/2409.10999","citing_paper":"/paper/2504.20835"},"observation_digest":"sha256:787397f6e5e226cae8dceeafb4892c78b93274086a989bdb8f7f8b69a3f17f13","observation_id":"9c338a2d-068b-4f27-b55c-50c714a857b4","resolution":{"observed_at":"2026-08-16T05:22:08.784841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10999","last_updated":"2025-05-23T10:37:01Z","snapshot_observed_at":"2026-08-16T13:17:54.428873Z","submitted_at":"2024-09-17T09:04:03Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10999","snapshot_observed_at":"2026-08-07T14:51:16.797400Z","title":"Enhancing low-resource language and in- struction following capabilities of audio language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17417","last_updated":"2025-05-23T03:05:47Z","snapshot_observed_at":"2026-08-17T02:24:20.568852Z","submitted_at":"2025-05-23T03:05:47Z","title":"Speechless: Speech Instruction Training Without Speech for Low Resource Languages","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.797400Z"},"links":{"cited_paper":"/paper/2409.10999","citing_paper":"/paper/2505.17417"},"observation_digest":"sha256:cdd232ca2b48da406b968e60260e92b78625c1f3ec351d8a5c7e2f506fe13006","observation_id":"f546cba8-f8c1-4c1a-b2b0-7d4610d039f5","resolution":{"observed_at":"2026-08-07T14:51:16.797400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10999","last_updated":"2025-05-23T10:37:01Z","snapshot_observed_at":"2026-08-16T13:17:54.428873Z","submitted_at":"2024-09-17T09:04:03Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10999","snapshot_observed_at":"2026-08-07T13:21:02.170670Z","title":"Enhancing low-resource language and in- struction following capabilities of audio language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22063","last_updated":"2025-05-28T07:39:25Z","snapshot_observed_at":"2026-08-15T12:41:54.265777Z","submitted_at":"2025-05-28T07:39:25Z","title":"Weakly Supervised Data Refinement and Flexible Sequence Compression for Efficient Thai LLM-based ASR","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:02.170670Z"},"links":{"cited_paper":"/paper/2409.10999","citing_paper":"/paper/2505.22063"},"observation_digest":"sha256:72e7a228c96a0e1fb3c3af82c60b20a4aec320e3d16b3c502d388e84bd6649c7","observation_id":"f84b21eb-086a-4199-95f3-c3341fda2126","resolution":{"observed_at":"2026-08-07T13:21:02.170670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10999","last_updated":"2025-05-23T10:37:01Z","snapshot_observed_at":"2026-08-16T13:17:54.428873Z","submitted_at":"2024-09-17T09:04:03Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10999","snapshot_observed_at":"2026-08-07T11:28:53.960789Z","title":"Enhancing low-resource language and instruction following capabilities of audio language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02443","last_updated":"2025-06-03T05:02:14Z","snapshot_observed_at":"2026-08-13T12:54:08.987275Z","submitted_at":"2025-06-03T05:02:14Z","title":"Breaking the Barriers of Text-Hungry and Audio-Deficient AI","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:53.960789Z"},"links":{"cited_paper":"/paper/2409.10999","citing_paper":"/paper/2506.02443"},"observation_digest":"sha256:f07a3507cbf2f712e525ca4fc542ac24910153370d933e56f225685b7b31f2c5","observation_id":"809a6685-b873-4b14-9281-a9ece5f55ba6","resolution":{"observed_at":"2026-08-07T11:28:53.960789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10999","last_updated":"2025-05-23T10:37:01Z","snapshot_observed_at":"2026-08-16T13:17:54.428873Z","submitted_at":"2024-09-17T09:04:03Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10999","snapshot_observed_at":"2026-08-06T16:47:56.560926Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12705","last_updated":"2025-07-17T00:39:18Z","snapshot_observed_at":"2026-08-13T13:24:03.399635Z","submitted_at":"2025-07-17T00:39:18Z","title":"AudioJudge: Understanding What Works in Large Audio Model Based Speech Evaluation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T16:47:56.560926Z"},"links":{"cited_paper":"/paper/2409.10999","citing_paper":"/paper/2507.12705"},"observation_digest":"sha256:69c857f7740294f2a0bdf3d9e938cb03249182d40c7ddc07adc6f8b28477a953","observation_id":"250c51c1-5224-424b-9189-07f2f9f51ff9","resolution":{"observed_at":"2026-08-06T16:47:56.560926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10999","last_updated":"2025-05-23T10:37:01Z","snapshot_observed_at":"2026-08-16T13:17:54.428873Z","submitted_at":"2024-09-17T09:04:03Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models","version":2},"cited_work":{"arxiv_id":"2409.10999","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.10999","snapshot_observed_at":"2026-08-05T17:56:58.130779Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models","venue":"cs.CL","work_id":"65019bef-9a6d-47eb-b951-191a7e8d2a9a","year":2024},"citing_paper":{"arxiv_id":"2508.15418","last_updated":"2025-08-21T10:20:00Z","snapshot_observed_at":"2026-08-14T16:19:43.372797Z","submitted_at":"2025-08-21T10:20:00Z","title":"LLaSO: A Foundational Framework for Reproducible Research in Large Language and Speech Model","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T17:56:53.680396Z"},"links":{"cited_paper":"/paper/2409.10999","citing_paper":"/paper/2508.15418"},"observation_digest":"sha256:4d00504e5959480824712c7ee17d2f26c21f5b63b33b1013590c5c88d09db8d9","observation_id":"c1022617-f09f-4b4e-a144-18a27dace9ff","resolution":{"observed_at":"2026-08-05T17:56:58.331121Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2409.10999/citation-record","integrity":"/paper/2409.10999/integrity","json":"/paper/2409.10999/citation-record.json","paper":"/paper/2409.10999"},"outbound":[],"paper":{"arxiv_id":"2409.10999","last_updated":"2025-05-23T10:37:01Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:17:54.428873Z","submitted_at":"2024-09-17T09:04:03Z","title":"Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2409.10999."}