{"as_of":"2026-08-04T11:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eb9f76e1eaf311a722ef3c76e997d135533c13ed938285315c2ef44206afa5e2","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T19:41:48.225019Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.04371/citation-record","integrity":"/paper/2607.04371/integrity","json":"/paper/2607.04371/citation-record.json","paper":"/paper/2607.04371"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.09557","last_updated":"2026-05-28T14:40:40Z","snapshot_observed_at":"2026-08-03T16:37:32.743096Z","submitted_at":"2026-02-10T16:19:56Z","title":"SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.09557","snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"cited_paper":"/paper/2604.09557","citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:da4d757acdba07196309c2b1cf9502c362f98706bf536930c90040d9dbcfda61","observation_id":"481f871b-300d-4b8d-b7dd-58aa949534f8","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":"Venmugil Elango, Nidhi Bhatia, Roger Waleffe, Rasoul Shafipour, Tomer Asida, Abhinav Khattar, Nave Assaf, Maximilian Golub, Joey Guman, Tiyasa Mitra, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:c4413739f4c519241adcf24084898e195f7d1b8d64ec8426a577439f3753684c","observation_id":"e9445dc3-3ed0-4734-af37-6118be652910","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1515/crll.1883.94.41","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:48:13.154921Z","title":"Yaniv Leviathan, Matan Kalman, and Yossi Matias","venue":null,"work_id":"6f3e862b-8350-4db6-aeb1-1f0315b0ce3a","year":null},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:816fa89fc39db606a2c716511f1d6f6094e0a5209626a23f07b765195693f82b","observation_id":"5c1feb8a-e9cf-41d4-88fa-e0d554fcd4a7","resolution":{"observed_at":"2026-07-11T19:48:13.157049Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T09:20:15.584236+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T09:20:15.584236+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14679","last_updated":"2024-11-04T17:36:38Z","snapshot_observed_at":"2026-07-06T18:49:20.859618Z","submitted_at":"2024-07-19T21:47:57Z","title":"Compact Language Models via Pruning and Knowledge Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14679","snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":"Saurav Muralidharan, Sharath Turuvekere Sreenivas, Raviraj Joshi, Marcin Chochowski, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro, Jan Kautz, and Pavlo Molchanov","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"cited_paper":"/paper/2407.14679","citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:61276097c2e90e2bd927204f3ab174c729f95aa36c552ff6d09b33a3f0444a75","observation_id":"b4c6027c-a690-466f-8a28-fdc5b9ba75e1","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":"org/CorpusID:271328221","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:56a116b6da21d5bd791881b6b4fedecef6f4e02b7cf622240132485b0a5ad331","observation_id":"34c2917f-6c0a-4939-a47e-53946387a420","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":"URL https://doi.org/10","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:a9c6782e06f7ffb96073d2fa473247886d798decda6f8f1a83873c5c5da25b1b","observation_id":"05212816-e4fc-40cd-819c-7773a08d16cd","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12374","last_updated":"2026-04-14T07:02:32Z","snapshot_observed_at":"2026-07-06T23:00:37.144068Z","submitted_at":"2026-04-14T07:02:32Z","title":"Nemotron 3 Super: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12374","snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":"Mohammad Shoeybi, Mostofa Patwary, Raul Puri, Patrick LeGresley, Jared Casper, and Bryan Catan- zaro","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"cited_paper":"/paper/2604.12374","citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:c96b9dc5ecf61c4f6d470036de70f89b262676ab1024a5a14f2a2e674328454b","observation_id":"fe49c38d-1044-44ea-94c9-9c1697f51c5f","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":"Ali Taghibakhshi, Ruisi Cai, Saurav Muralidharan, et al","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:611f029e52dd964ef890ece573b6fd0a98bff727561cfeda5cc55fdd8e484364","observation_id":"052a5d1a-d075-4b19-927d-2ba205bc81ed","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.05482","last_updated":"2022-07-01T23:48:19Z","snapshot_observed_at":"2026-07-06T12:46:30.292996Z","submitted_at":"2022-03-10T17:03:49Z","title":"Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.05482","snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":"Zhihang Yuan, Yuzhang Shang, Yue Song, Qiang Wu, Yan Yan, and Guangyu Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"cited_paper":"/paper/2203.05482","citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:6bce0cc55ab59230e6b153b5bbe40ea6d402e9835e90d5cce09ca242dae40425","observation_id":"75c94ad7-f8fb-4c72-932e-a3b685627ad8","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":"17 Appendix A Mamba SSM Pruning A.1 Method We chose which SSM channels to prune by estimating their contribution to the Mamba layer output in the following manner","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:713b8116b2c4117eab3d200fa30b11aa11e24156ea4f2c0f6f542b30866c4035","observation_id":"69f43dcf-873f-48ff-bbd2-d6eed2f11802","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":"Per-request prefill of the 990K-token prompt is roughly1.2×faster on Super Turbo than on Super","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:957dcfd94ed25c97b8995105928d12d6d09336ce141492d34139ea1aedf84683","observation_id":"1b264ea6-46b9-4a6d-964f-1577307d0d34","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:41:48.225019Z","title":"The projection-based method outperforms the coordinate-selection baselines at each tested latent size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T19:41:48.225019Z"},"links":{"citing_paper":"/paper/2607.04371"},"observation_digest":"sha256:c033797993ee0320429b0fa3ac47a85e6cfc6a70d560077d2653ccd93a5e3024","observation_id":"319c2fb7-d39b-4070-beca-7544883b3811","resolution":{"observed_at":"2026-07-11T19:41:48.225019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04371","last_updated":"2026-07-07T14:13:42Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-11T19:41:47.448393Z","submitted_at":"2026-07-05T16:00:29Z","title":"Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2607.04371."}