{"as_of":"2026-08-06T04:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5e73499f42ddc87e0567f4925713e02e3513c441778d833691e368830e30b5d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":48,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:32:54.589013Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2504.12501","last_updated":"2026-08-03T01:47:58Z","snapshot_observed_at":"2026-08-06T03:14:10.614428Z","submitted_at":"2025-04-16T21:36:46Z","title":"Reinforcement Learning from Human Feedback","version":9},"reference_index":180,"source":"pdf_text","source_observed_at":"2026-05-22T19:27:40.991325Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2504.12501"},"observation_digest":"sha256:5bf30e2fec837c10cd674b8aadc19d5e2a13938d70eb1d5710901aa1a6422ecd","observation_id":"4654259f-d9e2-41d8-aa2b-14305740f5ea","resolution":{"observed_at":"2026-05-22T19:32:00.956328Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T16:32:54.589013Z","title":"NVIDIA Nemotron Nano 2: An Ac- curate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18255","last_updated":"2025-09-02T17:12:12Z","snapshot_observed_at":"2026-08-05T16:32:51.675767Z","submitted_at":"2025-08-25T17:45:06Z","title":"Hermes 4 Technical Report","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T16:32:54.589013Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2508.18255"},"observation_digest":"sha256:cfca21e8622fc481a07ed901748f4fd3c6571a0a2f76d38cf1c0d5a6e792b5b8","observation_id":"38e6e254-9dc3-44c9-ab1a-77991ae6acf8","resolution":{"observed_at":"2026-08-05T16:32:54.589013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2510.03271","last_updated":"2026-05-21T09:16:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-27T07:42:54Z","title":"Decision Potential Surface: A Theoretical and Practical Approximation of Large Language Model Decision Boundary","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T13:22:37.107679Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2510.03271"},"observation_digest":"sha256:8049cf803e6ab697bb7efda79f59f46f72da8a79401cfdb12ab66c08576bd6e6","observation_id":"e2c2fb03-3dec-4539-8903-cc570cddf64c","resolution":{"observed_at":"2026-05-22T13:24:53.337281Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2510.04265","last_updated":"2026-05-12T01:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-05T16:14:03Z","title":"Don't Pass@k: A Bayesian Framework for Large Language Model Evaluation","version":4},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-18T10:04:39.223895Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2510.04265"},"observation_digest":"sha256:d57fdca4337319a5274eccd01eafec201f5ad780787950f4646afaff66b7a4d3","observation_id":"0ee8f9de-ee9f-4629-a551-5e3a89a7a585","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2510.04800","last_updated":"2026-04-21T13:16:20Z","snapshot_observed_at":"2026-08-02T20:03:37.497118Z","submitted_at":"2025-10-06T13:30:07Z","title":"Hybrid Architectures for Language Models: Systematic Analysis and Design Insights","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T10:18:04.431436Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2510.04800"},"observation_digest":"sha256:a72f7f5b68053914cacbc4a8a47959a63527784f962bce5f7c4dc6435851c2db","observation_id":"c946fc06-286f-4caf-b2ba-635ecd109e0e","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-04T10:07:52.588242Z","title":"Nvidia nemotron nano 2: An accurate and efficient hybrid mamba-transformer reasoning model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.11713","last_updated":"2026-06-01T17:06:08Z","snapshot_observed_at":"2026-08-05T06:05:55.167954Z","submitted_at":"2025-10-13T17:59:35Z","title":"Are Large Reasoning Models Interruptible?","version":4},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T10:07:52.588242Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2510.11713"},"observation_digest":"sha256:edf4d2bcfe4245a1a64cd48f6de5b7cad9e02fb507980b19d1320d4b78b34a78","observation_id":"ea39139f-c862-43e6-8735-ebef10df9c6b","resolution":{"observed_at":"2026-08-04T10:07:52.588242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2511.11793","last_updated":"2026-04-21T16:02:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-14T18:52:07Z","title":"MiroThinker: Pushing the Performance Boundaries of Open-Source Research Agents via Model, Context, and Interactive Scaling","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-17T21:44:18.744201Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2511.11793"},"observation_digest":"sha256:09976c211db55c9c700e086379987d8ea171119a62c1aceb1f21a805fd0783f7","observation_id":"1cd05432-0e8e-40b6-928a-cf6eadd7817a","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-03T20:59:18.876864Z","title":"Efficient hybrid mamba- transformer reasoning model.arXiv preprint arXiv:2508.14444, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17384","last_updated":"2026-07-03T23:12:55Z","snapshot_observed_at":"2026-08-04T05:35:32.944363Z","submitted_at":"2025-11-21T16:48:49Z","title":"IndustryNav: Exploring Spatial Reasoning of Embodied Agents in Dynamic Industrial Navigation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T20:59:18.876864Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2511.17384"},"observation_digest":"sha256:c87c8d1a49f014492c3ef2f68f23f3f1ea02421cf569fc9271f7848736798f45","observation_id":"9f214e3c-ab9c-47e3-9bc7-8acec09677b4","resolution":{"observed_at":"2026-08-03T20:59:18.876864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2512.02010","last_updated":"2026-05-09T05:39:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-01T18:59:45Z","title":"Four Over Six: More Accurate NVFP4 Quantization with Adaptive Block Scaling","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-17T02:23:01.845123Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2512.02010"},"observation_digest":"sha256:dc04821e0f5c5610e7323df2b3ec1115e3378b85bbe21f9c6075a5edcda971c2","observation_id":"39204971-65bc-471a-9576-6443205d4771","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2512.14067","last_updated":"2026-04-29T20:52:08Z","snapshot_observed_at":"2026-07-06T22:39:08.850289Z","submitted_at":"2025-12-16T04:12:17Z","title":"Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T22:29:08.669964Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2512.14067"},"observation_digest":"sha256:8bde3a43af2e36bf74b10b9c1257b659558392079f993ce396dcd06dcae853d9","observation_id":"98cf83be-a03a-4e5f-b194-5958f09aaa7a","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2512.20856","last_updated":"2025-12-24T00:24:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-24T00:24:05Z","title":"NVIDIA Nemotron 3: Efficient and Open Intelligence","version":1},"reference_index":204,"source":"arxiv_source","source_observed_at":"2026-05-18T01:40:42.190369Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2512.20856"},"observation_digest":"sha256:cc52b1cbdfbc98d0fcc3a411595f30d687ce6f1bf93872c4f95bb69bf8706c67","observation_id":"99b553f2-8178-49fd-ba05-8e57239343bc","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2601.01322","last_updated":"2026-05-03T05:35:23Z","snapshot_observed_at":"2026-08-02T23:32:22.443147Z","submitted_at":"2026-01-04T01:17:36Z","title":"LinMU: Multimodal Understanding Made Linear","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T18:32:23.951566Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2601.01322"},"observation_digest":"sha256:f49993623823f09f3944ae9e91c9c4492a8914fb3d1b5851b08ae386686cffa9","observation_id":"24a7f68f-aebf-4318-9e37-21fd3684192f","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-03T11:16:00.402950Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07036","last_updated":"2026-06-02T22:18:21Z","snapshot_observed_at":"2026-08-03T11:15:58.528233Z","submitted_at":"2026-01-11T19:19:39Z","title":"Mid-Think: Training-Free Intermediate-Budget Reasoning via Token-Level Triggers","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-03T11:16:00.402950Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2601.07036"},"observation_digest":"sha256:954e256c03637d90acc92614fa5656d13cadab407b51c8394aaa088030fc9781","observation_id":"7318a73e-5827-4c07-823e-f53a9f6e8a28","resolution":{"observed_at":"2026-08-03T11:16:00.402950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-03T10:21:12.407476Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.10457","last_updated":"2026-05-23T00:59:55Z","snapshot_observed_at":"2026-08-03T10:21:08.833277Z","submitted_at":"2026-01-15T14:48:52Z","title":"NSR-Boost: A Neuro-Symbolic Residual Boosting Framework for Industrial Legacy Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T10:21:12.407476Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2601.10457"},"observation_digest":"sha256:51f30c8c9188ca6db933c841388524b95ec1a24c4937617cca83d06d41f437f6","observation_id":"59c6336d-f3f9-4baa-8a0b-aa8dc9d95f56","resolution":{"observed_at":"2026-08-03T10:21:12.407476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-02T21:02:24.871813Z","title":"Nvidia nemotron nano 2: An accurate and efficient hybrid mamba-transformer reasoning model.arXiv preprint arXiv:2508.14444, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06638","last_updated":"2026-06-27T22:21:54Z","snapshot_observed_at":"2026-08-02T21:02:19.396832Z","submitted_at":"2026-02-25T05:23:23Z","title":"HEARTS: Benchmarking LLM Reasoning on Health Time Series","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T21:02:24.871813Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2603.06638"},"observation_digest":"sha256:6544dac7a5a69b3b1e6a3ef325372403cdc1b44a3a9f5d5fc5a7a850ccca9aaa","observation_id":"22420771-f063-4dfc-b94d-42c6650cc472","resolution":{"observed_at":"2026-08-02T21:02:24.871813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2603.10960","last_updated":"2026-03-11T16:47:41Z","snapshot_observed_at":"2026-08-05T22:41:19.935182Z","submitted_at":"2026-03-11T16:47:41Z","title":"Ranking Reasoning LLMs under Test-Time Scaling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T13:33:18.767999Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2603.10960"},"observation_digest":"sha256:e6fd95f7cc9a1c849440fae35817d187a7cbe0db6721f65b98d73d0626cf3204","observation_id":"b3fdaec7-5c4c-42dc-bd21-64a7a799a4cd","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2603.14360","last_updated":"2026-05-13T23:29:01Z","snapshot_observed_at":"2026-08-01T09:38:25.349230Z","submitted_at":"2026-03-15T12:53:09Z","title":"M$^2$RNN: Non-Linear RNNs with Matrix-Valued States for Scalable Language Modeling","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T11:35:43.088803Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2603.14360"},"observation_digest":"sha256:389d2b1065b53582f0e49273934d71959a2f3a8daa3ee758d9d46ca5def33c7c","observation_id":"93bca724-4431-433e-a342-a8519f94dbe0","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2604.03361","last_updated":"2026-04-03T17:38:42Z","snapshot_observed_at":"2026-07-06T22:52:34.609783Z","submitted_at":"2026-04-03T17:38:42Z","title":"The limits of bio-molecular modeling with large language models : a cross-scale evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T20:09:30.460861Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2604.03361"},"observation_digest":"sha256:54227b94d1418e3f0b5e0a279090e472be38366416ac44aeb71f93bbb71124e3","observation_id":"5594f315-8912-4b5e-84f1-cdb508fbca8b","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2604.09258","last_updated":"2026-05-27T08:05:02Z","snapshot_observed_at":"2026-07-12T23:23:17.075790Z","submitted_at":"2026-04-10T12:17:18Z","title":"Nexus: Same Pretraining Loss, Better Downstream Generalization via Common Minima","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T17:53:39.356675Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2604.09258"},"observation_digest":"sha256:5576afb5c39139af393660565000974ed8423e18f4c8408d70d0976fbd4ce34b","observation_id":"75beaa44-4886-496f-ba71-63fc0fc3747e","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2604.21637","last_updated":"2026-07-06T17:24:47Z","snapshot_observed_at":"2026-07-12T18:37:44.672856Z","submitted_at":"2026-04-23T12:53:16Z","title":"Multilinguality at the Edge: Developing Language Models for the Global South","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T21:32:37.544226Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2604.21637"},"observation_digest":"sha256:19eb4490cf6a7d9323ad15017a9f92c123e694b731d68e04b17a03fe08aa215a","observation_id":"d5fdeeda-6c51-40a4-8198-939dfdd6b7db","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2604.22782","last_updated":"2026-04-03T14:56:17Z","snapshot_observed_at":"2026-08-02T15:24:09.520492Z","submitted_at":"2026-04-03T14:56:17Z","title":"Stochastic KV Routing: Enabling Adaptive Depth-Wise Cache Sharing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T19:56:48.015363Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2604.22782"},"observation_digest":"sha256:67f8c1b93ba753499706de58e54b1020e66020da161100e02f9a52c5ffcd7888","observation_id":"a17824ea-0758-4938-a708-8f4afa56a0eb","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2605.07182","last_updated":"2026-05-08T03:20:36Z","snapshot_observed_at":"2026-07-06T23:19:35.885430Z","submitted_at":"2026-05-08T03:20:36Z","title":"Star Elastic: Many-in-One Reasoning LLMs with Efficient Budget Control","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T01:03:28.231935Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2605.07182"},"observation_digest":"sha256:97454b3ed95838c37d94b7712ba136198de03179df083e7ea2d23b90bacb6f7c","observation_id":"a4f69ef1-ecbe-492b-a7e5-0cee6a44a11c","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2605.08301","last_updated":"2026-05-08T11:43:51Z","snapshot_observed_at":"2026-08-05T05:24:07.487261Z","submitted_at":"2026-05-08T11:43:51Z","title":"Priming: Hybrid State Space Models From Pre-trained Transformers","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-12T01:14:01.584159Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2605.08301"},"observation_digest":"sha256:6f4e7a83dd0f89b480ab48cbd05ba24e42355d74f261841bcd0e101e2054dc5c","observation_id":"6f681267-1086-4cd4-bc16-65167b3d0426","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2605.08632","last_updated":"2026-05-09T02:50:58Z","snapshot_observed_at":"2026-08-02T19:42:08.850310Z","submitted_at":"2026-05-09T02:50:58Z","title":"PARD-2: Target-Aligned Parallel Draft Model for Dual-Mode Speculative Decoding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T01:08:14.247342Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2605.08632"},"observation_digest":"sha256:75741cd25c1b4ed406d86c94088285a1e72cce121c84040fe0840ca1f94ee421","observation_id":"30879c91-ab55-4361-9600-5976ffcef276","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2605.12227","last_updated":"2026-06-16T16:53:23Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:04:18Z","title":"A Recipe for Long-Context Reasoning in Large Language Models via On-Policy Optimization and Distillation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-13T05:29:00.576006Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2605.12227"},"observation_digest":"sha256:51cbbbc8c692f3f8187a08c4fc76777d5bd4793211a9087c07c59b8180239b30","observation_id":"a72e98cb-3a6a-48fa-b4e2-b0169b2ef778","resolution":{"observed_at":"2026-05-18T11:02:08.433616Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2605.21299","last_updated":"2026-05-20T15:28:52Z","snapshot_observed_at":"2026-07-06T23:31:46.877766Z","submitted_at":"2026-05-20T15:28:52Z","title":"Tracing the ongoing emergence of human-like reasoning in Large Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-21T05:04:30.829386Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2605.21299"},"observation_digest":"sha256:5834690fb4ebeff49e02f8a9e72fd277a223be5cd187b0234f4d1e5e066f5e5a","observation_id":"6121148a-8c27-4327-ba66-efe3990e90b4","resolution":{"observed_at":"2026-05-21T05:04:37.201302Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2605.21951","last_updated":"2026-05-21T03:35:10Z","snapshot_observed_at":"2026-07-31T14:36:47.956964Z","submitted_at":"2026-05-21T03:35:10Z","title":"Dynamic Mixture of Latent Memories for Self-Evolving Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T07:38:42.113849Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2605.21951"},"observation_digest":"sha256:85d2ac73a0bc26fb59531ba23562d851e01e7876930611963e8db04766365c32","observation_id":"5df7cd2c-c942-4cee-98c2-9fd201ffd2e5","resolution":{"observed_at":"2026-05-22T07:41:14.542617Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2605.26099","last_updated":"2026-06-05T05:36:49Z","snapshot_observed_at":"2026-07-06T23:36:01.564747Z","submitted_at":"2026-05-25T17:55:39Z","title":"Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T21:37:51.638904Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2605.26099"},"observation_digest":"sha256:aba4ae28d6de64109e8a113f1678d4a8ce55a71d4dc893138087d7ac3b9c6b77","observation_id":"e835c4dc-b9f7-461c-8c7f-8dbe20322a3e","resolution":{"observed_at":"2026-06-29T21:43:59.463375Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2605.31268","last_updated":"2026-05-29T13:01:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:01:11Z","title":"Mellum2 Technical Report","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T22:58:35.397914Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2605.31268"},"observation_digest":"sha256:7e0b7d47f39adec950411a7100580eefd4c6ecc9f1e5b4eabdf69e942598d6a6","observation_id":"76e76fe9-05a6-429f-99b3-e0f8f5634542","resolution":{"observed_at":"2026-06-28T23:02:46.484941Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2606.00746","last_updated":"2026-05-30T14:29:43Z","snapshot_observed_at":"2026-07-06T23:41:24.911421Z","submitted_at":"2026-05-30T14:29:43Z","title":"Scaling Parallel Sequence Models to Foundation-Scale Vision Encoders","version":1},"reference_index":175,"source":"arxiv_source","source_observed_at":"2026-06-28T19:23:08.100056Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2606.00746"},"observation_digest":"sha256:bf55d8d78a1abb1010841d7cb4a86c54b6a344889d42b786992e4fe89abe571b","observation_id":"93b6c9c9-5cfb-436e-b376-e50aaeccd57d","resolution":{"observed_at":"2026-06-28T19:32:35.225565Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2606.02001","last_updated":"2026-06-01T09:57:52Z","snapshot_observed_at":"2026-07-06T23:42:30.555538Z","submitted_at":"2026-06-01T09:57:52Z","title":"Scaling Agentic Capabilities via Grounded Interaction Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T15:04:54.247779Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2606.02001"},"observation_digest":"sha256:bcb6c95035f6e4c5231d70ec2fb28586e426c0e109e90834c2c53eb87d9ea012","observation_id":"22087dba-e869-47bc-bb39-3fb19b0cd449","resolution":{"observed_at":"2026-07-01T22:46:19.244060Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2606.05743","last_updated":"2026-06-04T06:14:08Z","snapshot_observed_at":"2026-07-06T23:45:42.379051Z","submitted_at":"2026-06-04T06:14:08Z","title":"Membrane: A Self-Evolving Contrastive Safety Memory for LLM Agent Defense","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-28T00:55:42.688093Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2606.05743"},"observation_digest":"sha256:93cce9245f592fc7614d9e3aa60c3bfac573f210d93edfb2cf5c5c48d0c22f5a","observation_id":"ce84be6c-1f62-4ca9-a62a-6977a54bc33a","resolution":{"observed_at":"2026-07-02T13:46:59.925020Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2606.06712","last_updated":"2026-06-04T20:58:08Z","snapshot_observed_at":"2026-07-06T23:46:28.942186Z","submitted_at":"2026-06-04T20:58:08Z","title":"Data-Efficient Autoregressive-to-Diffusion Language Models via On-Policy Distillation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T01:21:52.821813Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2606.06712"},"observation_digest":"sha256:903fdeb9842b36d078cbdbf8fc4ea533bc5b115dc250f7b2c74d7404efbb3113","observation_id":"1adf6c37-b8f2-449a-890a-21d94f19020a","resolution":{"observed_at":"2026-07-02T13:26:58.867105Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2606.09659","last_updated":"2026-06-08T15:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-08T15:43:16Z","title":"End-to-End Context Compression at Scale","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-27T16:36:54.699174Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2606.09659"},"observation_digest":"sha256:ea49880040c17ba8bf961fc082b09900bcaccfd6eac0086a2258137e0ec40561","observation_id":"19b42d67-3cc8-446b-8b91-218a19741887","resolution":{"observed_at":"2026-07-03T01:17:31.619156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2606.11634","last_updated":"2026-06-10T03:56:03Z","snapshot_observed_at":"2026-08-02T13:37:43.737297Z","submitted_at":"2026-06-10T03:56:03Z","title":"Architecture-Aware Reinforcement Learning Makes Sliding-Window Attention Competitive in Math Reasoning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T10:18:54.163862Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2606.11634"},"observation_digest":"sha256:f75a514441d5ef54734b8d8f4f27d2eba22f4cb861c54f317ab24ac26b111dab","observation_id":"42442150-9b91-4fec-b97a-d2c43be3edfe","resolution":{"observed_at":"2026-07-03T09:47:59.919051Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2607.01727","last_updated":"2026-07-02T05:31:36Z","snapshot_observed_at":"2026-08-05T17:40:54.945334Z","submitted_at":"2026-07-02T05:31:36Z","title":"When Does Generating More Help? Disentangling Fixed-Source Synthesis from Source Expansion in Synthetic Data Scaling","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-03T15:20:51.474398Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.01727"},"observation_digest":"sha256:fec51767288201f2ce1ac6ad30387873a3d1d71eb824d344a6b6779fb6ecc9a6","observation_id":"517c9560-6379-4aff-bf3b-9107df5e39a1","resolution":{"observed_at":"2026-07-03T15:28:33.790022Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-07-12T01:07:20.766474Z","title":"McAfee, Laya Sleiman, Leon Derczynski, Luis Vega, Maer Rodrigues de Melo, Makesh Nar- simhan Sreedhar, Marcin Chochowski, Mark Cai, Markus Kliegl, Marta M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03624","last_updated":"2026-07-03T22:58:54Z","snapshot_observed_at":"2026-08-01T21:59:16.066897Z","submitted_at":"2026-07-03T22:58:54Z","title":"RADIO1D: Elastic Representations for Condensed Vision Modeling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-12T01:07:20.766474Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.03624"},"observation_digest":"sha256:a5f8cd94ef611ba0b44cfad8f05019f7caace8f410e4a86c053d9ecf1d681613","observation_id":"804dbc10-94b1-439c-a10b-d3979b0f1d76","resolution":{"observed_at":"2026-07-12T01:07:20.766474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-07-11T19:17:59.044982Z","title":"Nvidia nemotron nano 2: An accurate and efficient hybrid mamba-transformer reasoning model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04422","last_updated":"2026-07-05T17:31:36Z","snapshot_observed_at":"2026-08-04T03:31:46.106169Z","submitted_at":"2026-07-05T17:31:36Z","title":"Full-Stack FP4: Stable LLM Pretraining with Quantized Projections, Optimizers, and Attention","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T19:17:59.044982Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.04422"},"observation_digest":"sha256:aa8caa436c014ba70d7d8fe36364a593fbd8695c14fdbebb85779a5639aa405c","observation_id":"933fef17-26ff-4e69-97d7-030e7e2ccaac","resolution":{"observed_at":"2026-07-11T19:17:59.044982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2607.05722","last_updated":"2026-07-07T01:09:54Z","snapshot_observed_at":"2026-07-11T03:04:09.555872Z","submitted_at":"2026-07-07T01:09:54Z","title":"Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T03:04:12.500342Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.05722"},"observation_digest":"sha256:bcbdf624490841cf5855f7054c68985b27392fb1faa31aa727421b090d725e0d","observation_id":"63117d4b-6445-4e67-9660-7a94f40a75d7","resolution":{"observed_at":"2026-07-11T03:07:51.292757Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2607.07708","last_updated":"2026-07-08T17:59:59Z","snapshot_observed_at":"2026-08-03T06:15:46.321425Z","submitted_at":"2026-07-08T17:59:59Z","title":"Accurate, Interdisciplinary and Transparent Structure-property Understanding with Deep Native Structural Reasoning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-09T01:58:52.324533Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.07708"},"observation_digest":"sha256:35458be17faa4851adaebdec15a6700dd022df3e7674b679555cc2de55a587c6","observation_id":"6cd1a953-717b-4d4a-b5d6-dea0927ea9e4","resolution":{"observed_at":"2026-07-09T02:05:52.227738Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":"2508.14444","doi":"10.48550/arxiv.2508.14444","metadata_source":"pith","pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","venue":"cs.CL","work_id":"a449edca-bc6c-4333-9b98-84c9578290bf","year":2025},"citing_paper":{"arxiv_id":"2607.07740","last_updated":"2026-07-10T03:53:58Z","snapshot_observed_at":"2026-07-15T23:17:51.274512Z","submitted_at":"2026-07-08T06:23:42Z","title":"Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-10T19:59:46.713277Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.07740"},"observation_digest":"sha256:0761c3cf318b46fccb7a22a2474610b3e4e2ce5cd4a148136d008f81737d7060","observation_id":"ea6df32d-a4a7-4c8b-a6ce-bbeaf37fd116","resolution":{"observed_at":"2026-07-10T20:07:33.529785Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:36.116713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-07-13T06:47:09.927626Z","title":"NVIDIA Nemotron Nano 2: An accurate and efficient hybrid Mamba-transformer reasoning model.arXiv preprint arXiv:2508.14444, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.07740","last_updated":"2026-07-10T03:53:58Z","snapshot_observed_at":"2026-07-15T23:17:51.274512Z","submitted_at":"2026-07-08T06:23:42Z","title":"Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-13T06:47:09.927626Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.07740"},"observation_digest":"sha256:ccd65f121228e6f6262203de537cc7bc7706acb7489c76c945996893373384a5","observation_id":"66aaeaef-bd8a-4b9f-a7cc-8c12d87137ac","resolution":{"observed_at":"2026-07-13T06:47:09.927626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-07-14T15:45:54.532529Z","title":"NVIDIA Nemotron Nano 2: An accurate and efficient hybrid Mamba - Transformer reasoning model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09786","last_updated":"2026-08-02T18:21:10Z","snapshot_observed_at":"2026-08-06T03:15:35.554340Z","submitted_at":"2026-07-08T14:18:26Z","title":"Length Penalties Make Chain-of-Thought Less Monitorable","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-07-14T15:45:54.532529Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.09786"},"observation_digest":"sha256:2af6881dc3eb390787f0c46ec41f453b85b9a559a66ddf01d824823b1291285e","observation_id":"a7d854bc-43f0-4d96-851e-6ecd6459d118","resolution":{"observed_at":"2026-07-14T15:45:54.532529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-02T08:06:10.832885Z","title":"NVIDIA Nemotron Nano 2: An accurate and efficient hybrid Mamba - Transformer reasoning model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09786","last_updated":"2026-08-02T18:21:10Z","snapshot_observed_at":"2026-08-06T03:15:35.554340Z","submitted_at":"2026-07-08T14:18:26Z","title":"Length Penalties Make Chain-of-Thought Less Monitorable","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-02T08:06:10.832885Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.09786"},"observation_digest":"sha256:dd1ac29623fcd62ed155adc5800f3da7b2d3a0b21d279f5795082081ab05e9fe","observation_id":"92468da2-e18a-42fb-b8b8-77b8c3419d85","resolution":{"observed_at":"2026-08-02T08:06:10.832885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-04T04:30:29.444171Z","title":"NVIDIA Nemotron Nano 2: An accurate and efficient hybrid Mamba - Transformer reasoning model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09786","last_updated":"2026-08-02T18:21:10Z","snapshot_observed_at":"2026-08-06T03:15:35.554340Z","submitted_at":"2026-07-08T14:18:26Z","title":"Length Penalties Make Chain-of-Thought Less Monitorable","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T04:30:29.444171Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.09786"},"observation_digest":"sha256:6ccd63e54556677b9b3a0428cd2d1a24e8c5ec5c175f11d22cb3e07d2c231cfd","observation_id":"611fe834-32c6-4fbe-811d-fefe8563d370","resolution":{"observed_at":"2026-08-04T04:30:29.444171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-01T20:02:17.164217Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16777","last_updated":"2026-07-18T11:24:10Z","snapshot_observed_at":"2026-08-01T20:02:15.165469Z","submitted_at":"2026-07-18T11:24:10Z","title":"JOR-Bench: Japanese Operations Research Benchmarks for Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T20:02:17.164217Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.16777"},"observation_digest":"sha256:510f6f3acf38253f7d0c630c808153c75fd3d7ed029b8a11278cd2c4c6179ee3","observation_id":"804ba7b9-efb4-461f-9048-8380c1aa4aed","resolution":{"observed_at":"2026-08-01T20:02:17.164217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-01T04:45:22.713677Z","title":"https://arxiv.org/abs/2508.14444","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22468","last_updated":"2026-07-24T16:32:40Z","snapshot_observed_at":"2026-08-01T04:45:12.108475Z","submitted_at":"2026-07-24T16:32:40Z","title":"Learning to Prepare Molecular Ground States with Transformer Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T04:45:22.713677Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2607.22468"},"observation_digest":"sha256:28bfefc66d0174d0dbe4d50d16c656c4877c761d47f7428382a2acac62eade91","observation_id":"3abac5ac-1298-4f6a-97f1-9a1f3cf88d49","resolution":{"observed_at":"2026-08-01T04:45:22.713677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14444","snapshot_observed_at":"2026-08-05T15:54:11.896996Z","title":"arXiv preprint arXiv:2508.14444 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03624","last_updated":"2026-08-04T13:13:09Z","snapshot_observed_at":"2026-08-06T03:32:19.797622Z","submitted_at":"2026-08-04T13:13:09Z","title":"LoopMTP: A looped transformer guided by latent multi-token prediction","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T15:54:11.896996Z"},"links":{"cited_paper":"/paper/2508.14444","citing_paper":"/paper/2608.03624"},"observation_digest":"sha256:e05a0f24a4ad2b421ef3efb88a06034cd85a69a44f373a4a369a42c9d787655a","observation_id":"da4e1aa0-da80-45c2-827e-94467bb1bb68","resolution":{"observed_at":"2026-08-05T15:54:11.896996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.14444/citation-record","integrity":"/paper/2508.14444/integrity","json":"/paper/2508.14444/citation-record.json","paper":"/paper/2508.14444"},"outbound":[],"paper":{"arxiv_id":"2508.14444","last_updated":"2025-09-02T16:12:36Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T22:15:27.120497Z","submitted_at":"2025-08-20T06:00:57Z","title":"NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 48 inbound Pith citation observations for arXiv:2508.14444."}