{"as_of":"2026-08-05T23:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f64bc1a01d89b803c367d4a1bb59ba219a9d837262ca15bdd3f557eef04095ac","coverage":[{"denominator":6,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T02:57:23.422932Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T12:51:52.021657Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"cited_work":{"arxiv_id":"2604.24954","doi":"10.48550/arxiv.2604.24954","metadata_source":"pith","pith_arxiv_id":"2604.24954","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","venue":"cs.LG","work_id":"ed5d318f-0ca0-467c-8d41-e1c2d6550f1c","year":2026},"citing_paper":{"arxiv_id":"2605.12034","last_updated":"2026-05-13T20:38:46Z","snapshot_observed_at":"2026-07-31T22:09:03.342383Z","submitted_at":"2026-05-12T12:16:11Z","title":"Boosting Omni-Modal Language Models: Staged Post-Training with Visually Debiased Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T03:49:58.240883Z"},"links":{"cited_paper":"/paper/2604.24954","citing_paper":"/paper/2605.12034"},"observation_digest":"sha256:856eef9b2b6441fb129732b35af248dd4513d242180c8bc7549bff4b763bc4b0","observation_id":"4bc8a74b-37ad-4fb0-b97d-7976ffe6066f","resolution":{"observed_at":"2026-05-13T03:52:12.713065Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"cited_work":{"arxiv_id":"2604.24954","doi":"10.48550/arxiv.2604.24954","metadata_source":"pith","pith_arxiv_id":"2604.24954","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","venue":"cs.LG","work_id":"ed5d318f-0ca0-467c-8d41-e1c2d6550f1c","year":2026},"citing_paper":{"arxiv_id":"2605.12034","last_updated":"2026-05-13T20:38:46Z","snapshot_observed_at":"2026-07-31T22:09:03.342383Z","submitted_at":"2026-05-12T12:16:11Z","title":"Boosting Omni-Modal Language Models: Staged Post-Training with Visually Debiased Evaluation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T06:06:20.658030Z"},"links":{"cited_paper":"/paper/2604.24954","citing_paper":"/paper/2605.12034"},"observation_digest":"sha256:0fd236a75dcfea2c897836fbc46611ddc92fc7e4156e010993dd2158b9f85910","observation_id":"3a09842d-106c-43f7-a5de-9176324abb6f","resolution":{"observed_at":"2026-05-15T06:09:50.349599Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"cited_work":{"arxiv_id":"2604.24954","doi":"10.48550/arxiv.2604.24954","metadata_source":"pith","pith_arxiv_id":"2604.24954","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","venue":"cs.LG","work_id":"ed5d318f-0ca0-467c-8d41-e1c2d6550f1c","year":2026},"citing_paper":{"arxiv_id":"2605.14458","last_updated":"2026-05-14T06:54:37Z","snapshot_observed_at":"2026-08-03T14:35:51.351999Z","submitted_at":"2026-05-14T06:54:37Z","title":"OmniDrop: Layer-wise Token Pruning for Omni-modal LLMs via Query-Guidance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T01:36:11.208299Z"},"links":{"cited_paper":"/paper/2604.24954","citing_paper":"/paper/2605.14458"},"observation_digest":"sha256:1211161ebb1de10d68775cc4ea734f0d336c390294a81675eadf41a00e149a6a","observation_id":"3d282a39-dedf-4f93-aee4-09a64aa113f2","resolution":{"observed_at":"2026-05-15T01:38:27.616614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"cited_work":{"arxiv_id":"2604.24954","doi":"10.48550/arxiv.2604.24954","metadata_source":"pith","pith_arxiv_id":"2604.24954","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","venue":"cs.LG","work_id":"ed5d318f-0ca0-467c-8d41-e1c2d6550f1c","year":2026},"citing_paper":{"arxiv_id":"2605.25343","last_updated":"2026-05-25T01:57:43Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-25T01:57:43Z","title":"Toward Native Multimodal Modeling: A Roadmap","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T22:58:38.610609Z"},"links":{"cited_paper":"/paper/2604.24954","citing_paper":"/paper/2605.25343"},"observation_digest":"sha256:1ee63a427a5caa9ed4bb1e8266b17f6a45f24af3c054a0366968007cfeed111e","observation_id":"b4071e9e-7a53-412e-8b2d-d848d5921b11","resolution":{"observed_at":"2026-06-29T23:04:01.949375Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"cited_work":{"arxiv_id":"2604.24954","doi":"10.48550/arxiv.2604.24954","metadata_source":"pith","pith_arxiv_id":"2604.24954","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","venue":"cs.LG","work_id":"ed5d318f-0ca0-467c-8d41-e1c2d6550f1c","year":2026},"citing_paper":{"arxiv_id":"2605.30256","last_updated":"2026-07-28T20:35:17Z","snapshot_observed_at":"2026-08-02T12:51:48.638833Z","submitted_at":"2026-05-28T17:20:01Z","title":"VideoFDB: Evaluating Full-Duplex Vision-Speech Capabilities in Conversational Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T08:28:50.818250Z"},"links":{"cited_paper":"/paper/2604.24954","citing_paper":"/paper/2605.30256"},"observation_digest":"sha256:56d8db8115dc4eaa78f2dad1426bc2b740819de96b86ca71a437e66d2f10d250","observation_id":"870dfe79-622a-48e3-920c-530cf5a75ea9","resolution":{"observed_at":"2026-06-29T08:33:15.302774Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.24954","snapshot_observed_at":"2026-08-02T12:51:52.021657Z","title":"Nemotron 3 nano omni: Efficient and open multimodal intelligence, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.30256","last_updated":"2026-07-28T20:35:17Z","snapshot_observed_at":"2026-08-02T12:51:48.638833Z","submitted_at":"2026-05-28T17:20:01Z","title":"VideoFDB: Evaluating Full-Duplex Vision-Speech Capabilities in Conversational Agents","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T12:51:52.021657Z"},"links":{"cited_paper":"/paper/2604.24954","citing_paper":"/paper/2605.30256"},"observation_digest":"sha256:8ee9c727a1b83c0a5233492cfa9df51aa168a8b1e67a1366eee784c3e4fbf837","observation_id":"50906f4e-c62f-4c97-8f1f-6835e06ec6e8","resolution":{"observed_at":"2026-08-02T12:51:52.021657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"cited_work":{"arxiv_id":"2604.24954","doi":"10.48550/arxiv.2604.24954","metadata_source":"pith","pith_arxiv_id":"2604.24954","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","venue":"cs.LG","work_id":"ed5d318f-0ca0-467c-8d41-e1c2d6550f1c","year":2026},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-07-11T07:46:45.098798Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":1},"reference_index":251,"source":"arxiv_source","source_observed_at":"2026-07-07T23:59:38.702609Z"},"links":{"cited_paper":"/paper/2604.24954","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:a19a68dac0ff22831b3a0f17b008b3ec9910892bbde07db978e5c63838f30ceb","observation_id":"87f5a9af-7634-4947-992d-b46a6c763b69","resolution":{"observed_at":"2026-07-08T00:04:22.669220Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.24954","snapshot_observed_at":"2026-07-11T07:46:49.059192Z","title":"arXiv preprint arXiv:2604.24954 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-07-11T07:46:45.098798Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":2},"reference_index":251,"source":"arxiv_source","source_observed_at":"2026-07-11T07:46:49.059192Z"},"links":{"cited_paper":"/paper/2604.24954","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:1b7727ad23220896a63f78928084e078b4de157444aa045df82368f9d62ec882","observation_id":"6f7192cd-b669-4f83-a14c-a7cf9d12ba4f","resolution":{"observed_at":"2026-07-11T07:46:49.059192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"cited_work":{"arxiv_id":"2604.24954","doi":"10.48550/arxiv.2604.24954","metadata_source":"pith","pith_arxiv_id":"2604.24954","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","venue":"cs.LG","work_id":"ed5d318f-0ca0-467c-8d41-e1c2d6550f1c","year":2026},"citing_paper":{"arxiv_id":"2607.05992","last_updated":"2026-07-07T08:25:29Z","snapshot_observed_at":"2026-08-02T23:12:58.471921Z","submitted_at":"2026-07-07T08:25:29Z","title":"PluraMath: Extending Mathematical Reasoning Evaluation Beyond High-Resource Languages","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-08T19:08:06.748619Z"},"links":{"cited_paper":"/paper/2604.24954","citing_paper":"/paper/2607.05992"},"observation_digest":"sha256:a7a9a6e02f4af659ced18bb8558c69542452a872e34041e530000bed95c14b87","observation_id":"18256e30-b327-48c8-bffc-5c7961ef86db","resolution":{"observed_at":"2026-07-08T19:15:30.183427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:26.184421+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.24954","snapshot_observed_at":"2026-08-01T21:22:43.362060Z","title":"arXiv preprint arXiv:2604.24954 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16107","last_updated":"2026-07-17T16:41:15Z","snapshot_observed_at":"2026-08-02T03:51:58.365110Z","submitted_at":"2026-07-17T16:41:15Z","title":"Audio-Visual Flamingo: Open Audio-Visual Intelligence for Long and Complex Videos","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T21:22:43.362060Z"},"links":{"cited_paper":"/paper/2604.24954","citing_paper":"/paper/2607.16107"},"observation_digest":"sha256:d5639e3471f293f35dc5bb0a60015651482eb9055f7ecce0e22042b1b696e173","observation_id":"69a30c48-55a7-4e38-b11e-07600fb82e9a","resolution":{"observed_at":"2026-08-01T21:22:43.362060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.24954/citation-record","integrity":"/paper/2604.24954/integrity","json":"/paper/2604.24954/citation-record.json","paper":"/paper/2604.24954"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.14624","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T11:28:04.119362Z","title":"Efficient video sampling: Pruning temporally redundant tokens for faster vlm inference","venue":null,"work_id":"9cb6bbac-25c6-4285-a98f-f6433c5502fe","year":2025},"citing_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T02:57:23.422932Z"},"links":{"citing_paper":"/paper/2604.24954"},"observation_digest":"sha256:5f706c1467d63a5d7d45a90900b8f6521abbabb5cf93be63de5eefb282d6a678","observation_id":"25c3deaa-4eef-483a-86de-7683bf222c92","resolution":{"observed_at":"2026-05-12T03:01:18.543471Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17163","last_updated":"2026-05-26T01:50:12Z","snapshot_observed_at":"2026-07-06T21:28:52.660414Z","submitted_at":"2025-05-22T15:25:14Z","title":"OCR-Reasoning Benchmark: Unveiling the True Capabilities of MLLMs in Complex Text-Rich Image Reasoning","version":2},"cited_work":{"arxiv_id":"2505.17163","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17163","snapshot_observed_at":"2026-07-04T21:00:09.510505Z","title":"Ocr-reasoning benchmark: Unveiling the true capabilities of mllms in complex text-rich image reasoning","venue":"cs.LG","work_id":"049a1737-1d31-4d8f-9fe2-6232eb147ff8","year":2025},"citing_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T02:57:23.422932Z"},"links":{"cited_paper":"/paper/2505.17163","citing_paper":"/paper/2604.24954"},"observation_digest":"sha256:792cc0af2a4672d5b5cafbb7cdbcb8e5fc3da8c8e0166f2da8ce402fbf887cbc","observation_id":"97ec84fa-a59a-4613-a0b4-8758b8d3bad6","resolution":{"observed_at":"2026-05-27T02:04:28.324233Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11432-024-4235-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ocrbench: on the hidden mystery of ocr in large multimodal models","venue":"Science China Information Sciences","work_id":"b744bc1a-628b-43e1-8704-7addfd21cfcf","year":1919},"citing_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T02:57:23.422932Z"},"links":{"citing_paper":"/paper/2604.24954"},"observation_digest":"sha256:2ce05dbe18c413bfad87759d8eeaccd1053ac4c6b942048b95e75747de1112a1","observation_id":"4f1600e1-8ece-46d0-9f47-a47c45428527","resolution":{"observed_at":"2026-05-12T03:01:17.442185Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12374","last_updated":"2026-04-14T07:02:32Z","snapshot_observed_at":"2026-07-06T23:00:37.144068Z","submitted_at":"2026-04-14T07:02:32Z","title":"Nemotron 3 Super: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning","version":1},"cited_work":{"arxiv_id":"2604.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.12374","snapshot_observed_at":"2026-07-11T03:07:51.485773Z","title":"Nemotron 3 Super: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning","venue":"cs.LG","work_id":"9218633a-524d-4693-9715-f685e35cd82f","year":2026},"citing_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T02:57:23.422932Z"},"links":{"cited_paper":"/paper/2604.12374","citing_paper":"/paper/2604.24954"},"observation_digest":"sha256:80ed6ab94d96d08ac7df68d0aaf9289e3795db632e296c25e9664d75af5bbe21","observation_id":"6461e1b3-d41a-4c09-a669-70d61a080421","resolution":{"observed_at":"2026-05-12T03:01:18.539530Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.06961","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T00:04:22.683068Z","title":"Open ASR Leaderboard: Towards Reproducible and Transparent Multilingual Speech Recognition Evaluation","venue":null,"work_id":"a725e4ec-3331-4b0a-ae53-2084079eb773","year":2025},"citing_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T02:57:23.422932Z"},"links":{"citing_paper":"/paper/2604.24954"},"observation_digest":"sha256:a58b70e4130492589ae95849da50f66888590b37e4a8b94151e1f71a4e26e157","observation_id":"66e69f25-48c2-415b-a054-bcd20e0da5e6","resolution":{"observed_at":"2026-05-12T03:01:18.535846Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18071","last_updated":"2025-07-28T11:11:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-24T03:50:32Z","title":"Group Sequence Policy Optimization","version":2},"cited_work":{"arxiv_id":"2507.18071","doi":"10.48550/arxiv.2507.18071","metadata_source":"pith","pith_arxiv_id":"2507.18071","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Group Sequence Policy Optimization","venue":"cs.LG","work_id":"3a98b53b-9f52-4d95-adf7-89353c0a9a65","year":2025},"citing_paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T02:57:23.422932Z"},"links":{"cited_paper":"/paper/2507.18071","citing_paper":"/paper/2604.24954"},"observation_digest":"sha256:4683b499b8f3ba0e94fd571e25b39bee1338421ef1a21fcdec5f6e6d134454fe","observation_id":"1ea3270b-503c-4878-affb-3f90dfc0ba9a","resolution":{"observed_at":"2026-05-12T03:01:18.531781Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.24954","last_updated":"2026-05-11T07:26:38Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T19:49:21Z","title":"Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence"},"reference_resolution":{"displayed":6,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":0,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":6},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 6 of 6 outbound references and 10 inbound Pith citation observations for arXiv:2604.24954."}