{"as_of":"2026-08-07T08:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:577cb1f1d1216e7e2d52d3500580d19a5fd2cf5155dd3001d05046cbb144f7bf","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:31:22.729139Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:24:00.992793Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T19:47:19.779661Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2507.21166","last_updated":"2026-06-22T12:55:50Z","snapshot_observed_at":"2026-08-06T14:24:28.964899Z","submitted_at":"2025-07-25T13:05:01Z","title":"The Ratchet Effect in Silico: How Interaction Drives Cumulative Intelligence in Large Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-19T02:38:27.510872Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2507.21166"},"observation_digest":"sha256:06d4a9e82fc517e361cd3f9f5cf88937fff2cd34b03b75cb20aa3427258ec85e","observation_id":"ccb5f421-5942-4eeb-825f-3faa5fba3ba1","resolution":{"observed_at":"2026-05-19T02:41:59.963326Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-08-05T23:24:00.992793Z","title":"Communications of the ACM, 64(9): 99–106","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2508.05571","last_updated":"2025-08-16T05:36:32Z","snapshot_observed_at":"2026-08-05T23:23:50.987958Z","submitted_at":"2025-08-07T17:02:23Z","title":"iFairy: the First 2-bit Complex LLM with All Parameters in $\\{\\pm1, \\pm i\\}$","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T23:24:00.992793Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2508.05571"},"observation_digest":"sha256:51acd7f49401fb859db8c9719842fb439ac30d027d03a93ad265a8ea6147293e","observation_id":"0f6ef702-e5f0-46a6-ab2c-e20bcfae6475","resolution":{"observed_at":"2026-08-05T23:24:00.992793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-08-05T20:18:44.494542Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10848","last_updated":"2026-07-20T03:32:44Z","snapshot_observed_at":"2026-08-06T09:56:58.864125Z","submitted_at":"2025-08-14T17:18:35Z","title":"Psyche-R1: Towards Reliable Psychological LLMs through Unified Empathy, Expertise, and Reasoning","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T20:18:44.494542Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2508.10848"},"observation_digest":"sha256:04d05899c37e62f92a8d10872804efdc3071b73db8442f1db354e5ed1d9605eb","observation_id":"f3945627-6699-4f27-bd4c-056b30d131c4","resolution":{"observed_at":"2026-08-05T20:18:44.494542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2510.26692","last_updated":"2025-11-01T12:05:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-30T16:59:43Z","title":"Kimi Linear: An Expressive, Efficient Attention Architecture","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-13T23:49:10.555255Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2510.26692"},"observation_digest":"sha256:7c31d6f72dc3b8be266db6fe9e615ce91d95ebf4282ceed618c70b7aaae5f4ce","observation_id":"04169612-8244-4ffe-a3de-011172babba4","resolution":{"observed_at":"2026-05-13T23:49:10.845126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-08-03T11:28:10.091739Z","title":"arXiv preprint arXiv:2506.07900 (2025) 6, 35, 36","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:10.091739Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:acaf4049a99446d67b7d58af70f6a9d52367c68c983298c4b026dfbfb60dfb7e","observation_id":"5de5ce09-d461-4f75-950b-715e05a0634d","resolution":{"observed_at":"2026-08-03T11:28:10.091739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-08-03T02:39:29.867104Z","title":"Minicpm4: Ultra-efficient llms on end devices.arXiv preprint arXiv:2506.07900,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.06274","last_updated":"2026-07-31T10:15:33Z","snapshot_observed_at":"2026-08-06T17:36:40.046219Z","submitted_at":"2026-03-06T13:33:29Z","title":"Stem: Rethinking Causal Information Flow in Sparse Attention","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T02:39:29.867104Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2603.06274"},"observation_digest":"sha256:9a761d3532217dcf5039b8e86fe1fbd88c1bf0e3271f4e6fc09ea23ad92c76a5","observation_id":"d296e113-1cab-4c55-a305-ec7e89177e4c","resolution":{"observed_at":"2026-08-03T02:39:29.867104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-14T23:22:13.847876Z","title":"Minicpm4: Ultra-efficient llms on end devices.arXiv preprint arXiv:2506.07900, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.10757","last_updated":"2026-06-20T10:12:15Z","snapshot_observed_at":"2026-08-05T13:26:31.195049Z","submitted_at":"2026-03-11T13:32:58Z","title":"CodePercept: Code-Grounded Visual STEM Perception for MLLMs","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T23:22:13.847876Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2603.10757"},"observation_digest":"sha256:bb6cefcee5c9fdbc5ae45102c76bd6ecbbdee9a7a4b46ce3c7f358fc3420502f","observation_id":"1951c0dd-a718-4ab9-9611-d085030f0e29","resolution":{"observed_at":"2026-07-14T23:22:13.847876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-08-02T17:05:14.387747Z","title":"arXiv preprint arXiv:2506.07900 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.29759","last_updated":"2026-07-16T04:13:36Z","snapshot_observed_at":"2026-08-05T14:12:48.611419Z","submitted_at":"2026-03-31T14:00:10Z","title":"TSHA: A Benchmark for Visual Language Models in Trustworthy Safety Hazard Assessment Scenarios","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T17:05:14.387747Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2603.29759"},"observation_digest":"sha256:a2586639a521c16e7bc907800a2e4fa412aebff9b34eb8a04423f427936a8403","observation_id":"6d3277bd-8b42-4b8f-921f-5ad96110886f","resolution":{"observed_at":"2026-08-02T17:05:14.387747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2604.10733","last_updated":"2026-04-12T17:12:55Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T17:12:55Z","title":"Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-10T16:05:09.033412Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2604.10733"},"observation_digest":"sha256:4aba5f09719f9d74fbcc32f8eecfa8c5ee139630fff5bc86dd65f43614c71f7f","observation_id":"4cbf2385-dbf6-4e96-a56e-189d90d64de7","resolution":{"observed_at":"2026-05-11T09:21:00.956236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2604.14922","last_updated":"2026-04-16T12:06:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-16T12:06:59Z","title":"LongAct: Harnessing Intrinsic Activation Patterns for Long-Context Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-10T11:17:43.769244Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2604.14922"},"observation_digest":"sha256:7aa174cd7a2a543f3a4320b9fe87c6f7e4cc5c4059729929392ba4598e385e6f","observation_id":"09359c09-4f30-4b56-809f-eea5b947814a","resolution":{"observed_at":"2026-05-10T11:20:10.528750Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2604.27393","last_updated":"2026-04-30T04:05:43Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T04:05:43Z","title":"MiniCPM-o 4.5: Towards Real-Time Full-Duplex Omni-Modal Interaction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-07T09:26:00.413651Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2604.27393"},"observation_digest":"sha256:8f8757a6aa20de5c25cb8d4620d2dbda8c8ed4f8233c797a1333d496a446c591","observation_id":"652dda42-44c6-4334-a8f2-4e992830c7d0","resolution":{"observed_at":"2026-05-12T09:46:26.470172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2604.27607","last_updated":"2026-05-07T10:41:55Z","snapshot_observed_at":"2026-08-04T02:43:28.238788Z","submitted_at":"2026-04-30T08:59:03Z","title":"JaiTTS: A Thai Voice Cloning Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-07T06:34:45.357695Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2604.27607"},"observation_digest":"sha256:f04514c282f85674cee24e96bddb37e825169790fb4b8798d34dc83ba158b734","observation_id":"75b75a62-cd32-43d0-b218-ff70c95f5214","resolution":{"observed_at":"2026-05-12T10:21:28.812132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2604.27607","last_updated":"2026-05-07T10:41:55Z","snapshot_observed_at":"2026-08-04T02:43:28.238788Z","submitted_at":"2026-04-30T08:59:03Z","title":"JaiTTS: A Thai Voice Cloning Model","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-08T03:09:24.541657Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2604.27607"},"observation_digest":"sha256:0b06af94dabdd59e97bdcec9a46e4586d78a949fbc990f497056a56f4a076750","observation_id":"de1f61a3-5a88-45e6-a8d0-b398b8627147","resolution":{"observed_at":"2026-05-11T22:16:26.324947Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2605.09544","last_updated":"2026-05-10T13:56:46Z","snapshot_observed_at":"2026-07-31T07:40:23.585067Z","submitted_at":"2026-05-10T13:56:46Z","title":"TIDE-Bench: Task-Aware and Diagnostic Evaluation of Tool-Integrated Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-12T02:47:31.830410Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2605.09544"},"observation_digest":"sha256:08b37abbf9a9177328db09584a90e0120177eed52cb17268abeb94cbf82a905a","observation_id":"758d74a0-a83a-4139-8020-d652c55ebbf7","resolution":{"observed_at":"2026-05-12T02:51:18.060399Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2605.18753","last_updated":"2026-05-18T17:59:52Z","snapshot_observed_at":"2026-08-02T11:52:59.734226Z","submitted_at":"2026-05-18T17:59:52Z","title":"DashAttention: Differentiable and Adaptive Sparse Hierarchical Attention","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T10:50:12.926232Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2605.18753"},"observation_digest":"sha256:3cd3e5c69f0cd509f2ab7c5c3e32308f068fe98c8fcc17f65fe667c0cc99fa8c","observation_id":"a219ed25-0cbd-4564-a9bb-26d52baf25a1","resolution":{"observed_at":"2026-05-20T10:53:13.541414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2606.04511","last_updated":"2026-06-03T06:42:05Z","snapshot_observed_at":"2026-07-06T23:44:37.797802Z","submitted_at":"2026-06-03T06:42:05Z","title":"SparDA: Sparse Decoupled Attention for Efficient Long-Context LLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T06:28:01.500203Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2606.04511"},"observation_digest":"sha256:982c702f35962c4fe825b37fbfb4d8103bf23a07a666e5739577c8ada1f1cb72","observation_id":"fb1e67fa-e45e-4fff-a9db-5a4576d4bbb3","resolution":{"observed_at":"2026-07-02T07:56:47.849374Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2606.05858","last_updated":"2026-06-04T08:30:49Z","snapshot_observed_at":"2026-08-05T08:55:18.130915Z","submitted_at":"2026-06-04T08:30:49Z","title":"ReverseEOL: Improving Training-free Text Embeddings via Text Reversal in Decoder-only LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-28T01:44:21.625514Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2606.05858"},"observation_digest":"sha256:6858ed2348a5e26852789001d417a5f28ed6bcaf9001cf838bd52a0330f518b0","observation_id":"a256a5ad-8de6-4833-8469-d62c9ea95599","resolution":{"observed_at":"2026-07-02T12:56:57.155569Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":"2506.07900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-02T19:47:19.779661Z","title":"Minicpm4: Ultra-efficient llms on end devices","venue":null,"work_id":"344177ee-2d25-4b76-9c86-71e254c2d162","year":2025},"citing_paper":{"arxiv_id":"2606.06928","last_updated":"2026-06-05T05:43:15Z","snapshot_observed_at":"2026-07-06T23:46:37.903443Z","submitted_at":"2026-06-05T05:43:15Z","title":"VoxCPM2 Technical Report","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T21:18:22.911332Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2606.06928"},"observation_digest":"sha256:e337d54469c3863833c4fbd45f70df2488606f244401a3da6d99592e36d4c47f","observation_id":"03272e28-1165-466c-b3a7-413a108afd97","resolution":{"observed_at":"2026-07-02T19:47:19.781597Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-13T02:22:47.820537Z","title":"Minicpm4: Ultra-efficient llms on end devices.arXiv preprint arXiv:2506.07900,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09530","last_updated":"2026-07-22T14:29:04Z","snapshot_observed_at":"2026-08-06T08:33:56.882642Z","submitted_at":"2026-07-10T15:36:30Z","title":"FreyaTTS: A Compact Tokenizer-Free Flow-Matching Transformer for Turkish-First Speech Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T02:22:47.820537Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2607.09530"},"observation_digest":"sha256:18f8c24721136922ef7aa6e6b7b8d1410bd8914e02463e6c9748e76d8d887f9d","observation_id":"34e4f3d1-0497-4001-9472-eb44270d0f39","resolution":{"observed_at":"2026-07-13T02:22:47.820537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-08-02T07:39:23.532135Z","title":"Minicpm4: Ultra-efficient llms on end devices.arXiv preprint arXiv:2506.07900,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09530","last_updated":"2026-07-22T14:29:04Z","snapshot_observed_at":"2026-08-06T08:33:56.882642Z","submitted_at":"2026-07-10T15:36:30Z","title":"FreyaTTS: A Compact Tokenizer-Free Flow-Matching Transformer for Turkish-First Speech Synthesis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T07:39:23.532135Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2607.09530"},"observation_digest":"sha256:1e537df6ec622537b0419b83b7e96b801516d9bdd5d4683f96d607199dc96aa9","observation_id":"b04f33d3-fe87-4968-8929-4951f9998c8b","resolution":{"observed_at":"2026-08-02T07:39:23.532135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-08-01T13:53:45.274396Z","title":"Minicpm4: Ultra-efficient llms on end devices.arXiv preprint arXiv:2506.07900, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18985","last_updated":"2026-07-25T09:51:58Z","snapshot_observed_at":"2026-08-05T19:56:11.121302Z","submitted_at":"2026-07-21T11:19:21Z","title":"Athena-Brain Technical Report: An Efficient Robot Brain for General Intelligence and Embodied Interaction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T13:53:45.274396Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2607.18985"},"observation_digest":"sha256:99df6fc11bfe0648f483808a4ad0176035787a853164c8334c9fe7daffea8bda","observation_id":"cf04b8b5-2777-4aac-bf33-7f6689985846","resolution":{"observed_at":"2026-08-01T13:53:45.274396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-08-01T02:55:49.147989Z","title":"arXiv preprint arXiv:2506.07900 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25291","last_updated":"2026-07-28T04:57:19Z","snapshot_observed_at":"2026-08-07T07:57:40.290101Z","submitted_at":"2026-07-28T04:57:19Z","title":"CoSA: Accelerating Long-Context Inference via Proxy-Kernel Co-Designed Sparse Attention","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T02:55:49.147989Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2607.25291"},"observation_digest":"sha256:e48adfaa922389b80839a5bcf006395587a4323354f3caca86ba337990c2e83d","observation_id":"1ce58eaf-ac3a-466a-b5f7-694ebba9ac76","resolution":{"observed_at":"2026-08-01T02:55:49.147989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-31T22:14:36.638353Z","title":"Minicpm4: Ultra-efficient llms on end devices.arXiv preprint arXiv:2506.07900, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27958","last_updated":"2026-07-30T10:05:50Z","snapshot_observed_at":"2026-08-03T21:58:13.779422Z","submitted_at":"2026-07-30T10:05:50Z","title":"$\\Sigma$-Mem: An Online Reliability Memory for LLM-based Multi-Agent Systems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T22:14:36.638353Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2607.27958"},"observation_digest":"sha256:938c4da2c80d880b2c3f0d1e55b67d607be93849843ecfd0c786538e22191913","observation_id":"4dd1bdf4-d1db-4729-827d-6cbcdcd68a65","resolution":{"observed_at":"2026-07-31T22:14:36.638353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-07-31T15:38:32.889220Z","title":"Ning, W.; Guo, Y.; Qian, H.; Cheng, J.; Feng, W.; and Zhang, Y.2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28175","last_updated":"2026-07-30T13:12:25Z","snapshot_observed_at":"2026-08-07T05:42:11.124777Z","submitted_at":"2026-07-30T13:12:25Z","title":"AgenticASR: Refining Speech Recognition in Real-World Scenarios via an Agentic Approach","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T15:38:32.889220Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2607.28175"},"observation_digest":"sha256:c25ba16736c0e7094789440f52a3827c2ef7175fce820dc97741505580e2a8e0","observation_id":"fb09b244-1f74-4478-98f3-0d7e36c6118d","resolution":{"observed_at":"2026-07-31T15:38:32.889220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07900/citation-record","integrity":"/paper/2506.07900/integrity","json":"/paper/2506.07900/citation-record.json","paper":"/paper/2506.07900"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-07T05:31:18.875371Z","title":"Phi-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:18.875371Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:0de06bcbdb3b17b038dd78f640b02c64078c5b4118c8e3658d38933637f8e509","observation_id":"4040efea-bba9-40f9-82f9-60fc2ba3ed7f","resolution":{"observed_at":"2026-08-07T05:31:18.875371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19913","last_updated":"2025-02-24T02:55:34Z","snapshot_observed_at":"2026-07-06T19:24:17.628876Z","submitted_at":"2024-09-30T03:32:02Z","title":"Scaling Optimal LR Across Token Horizons","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19913","snapshot_observed_at":"2026-08-07T05:31:19.177588Z","title":"doi: 10.18653/v1/2024.findings-emnlp.74","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.177588Z"},"links":{"cited_paper":"/paper/2409.19913","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:575e20b44e929c6017a201d80cc4318b47c82ecb94725cc11e105378b54f4d49","observation_id":"6a28f7e1-ff55-45c8-98e4-2c82ae95876f","resolution":{"observed_at":"2026-08-07T05:31:19.177588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T05:31:19.248712Z","title":"Hudson, Ehsan Adeli, Russ Altman, Simran Arora, Sydney von Arx, Michael S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.248712Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:c0ad8df262e9ca36e81f26cf4c72d46c3fa812e0528b60e7377fa8137ba12558","observation_id":"2741925e-a400-42f9-9af0-29148327eb32","resolution":{"observed_at":"2026-08-07T05:31:19.248712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-07T05:31:19.312242Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.312242Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:bad92383c1a6fd3674390056fea36a07012390f40bdfa6ec737688ebf974831a","observation_id":"7abf9a29-f4fc-4523-9c1f-058dacbe44b9","resolution":{"observed_at":"2026-08-07T05:31:19.312242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05265","last_updated":"2025-01-27T13:39:25Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:59:35Z","title":"PrefixQuant: Eliminating Outliers by Prefixed Tokens for Large Language Models Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05265","snapshot_observed_at":"2026-08-07T05:31:19.504337Z","title":"Prefixquant: Static quantization beats dynamic through prefixed outliers in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.504337Z"},"links":{"cited_paper":"/paper/2410.05265","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:9df7a7c0927e0d1bf1c2fbcb6767594d9b96f2c467d0d5e545a266464f46c74e","observation_id":"28ffb747-e7b7-44dd-b8da-adfc54dde3dd","resolution":{"observed_at":"2026-08-07T05:31:19.504337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T05:31:19.583221Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.583221Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:682d86e3b17f9cb0e38d9b778d38dd0a9276517f51266e1d73769702b2db3461","observation_id":"c7199424-90ad-4a24-adcb-4138d50c8db6","resolution":{"observed_at":"2026-08-07T05:31:19.583221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T05:31:19.740928Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.740928Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:a235788166ee3a0a5494cf1bb3bab502413dadb022c40543b89c9fdbe9204c25","observation_id":"5894efcb-26ba-4c7c-9726-709c936a6d30","resolution":{"observed_at":"2026-08-07T05:31:19.740928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-07T05:31:19.832284Z","title":"Longrope: Extending LLM context window beyond 2 million tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.832284Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:7e3cd7a1b965c6f0fecb1ad80c5a0a91392d28186dd3c1d49fcb472cadcea006","observation_id":"4023f1a7-3a0a-43a9-adc1-72371e797054","resolution":{"observed_at":"2026-08-07T05:31:19.832284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-07T05:31:19.897369Z","title":"Abhimanyu Dubey, Abhinav Jauhri, Abhinav Pandey, Abhishek Kadian, Ahmad Al-Dahle, Aiesha Letman, Akhil Mathur, Alan Schelten, Amy Yang, Angela Fan, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.897369Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:b432379c0e8227d8c887867e3ce0a29736c5470413238fe4ac492a4e4d4355f9","observation_id":"af373711-54ae-471f-8020-88eb87640fd6","resolution":{"observed_at":"2026-08-07T05:31:19.897369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20094","last_updated":"2025-05-08T00:24:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-28T17:59:01Z","title":"Scaling Synthetic Data Creation with 1,000,000,000 Personas","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20094","snapshot_observed_at":"2026-08-07T05:31:19.962339Z","title":"Scaling synthetic data creation with 1,000,000,000 personas","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.962339Z"},"links":{"cited_paper":"/paper/2406.20094","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:b939afb4c5e6ddcf31e5d5998f361183267fd613dd277aa467358c861981e135","observation_id":"54a4433f-df02-4a02-a324-a4625949e638","resolution":{"observed_at":"2026-08-07T05:31:19.962339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-07T05:31:20.054521Z","title":"Chatglm: A family of large language models from glm-130b to glm-4 all tools","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.054521Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:808e2539e1170ca2940c178c035376b65794928de92cc1022fa53f1fdc9757b9","observation_id":"3cafe3a1-3eeb-486b-b71b-d91909d676b8","resolution":{"observed_at":"2026-08-07T05:31:20.054521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:31:20.120366Z","title":"Apple intelligence foundation language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.120366Z"},"links":{"citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:99ce31a3e341172b2463b025e1bd876cf32d6670ac4594f70b8d0a275d611517","observation_id":"300ac078-28c9-4b39-9828-f062674a38d1","resolution":{"observed_at":"2026-08-07T05:31:20.120366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:31:20.247421Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.247421Z"},"links":{"citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:08a0bf3ade49da3af492e4e0f4130956a62f4b45987ceb8345ef964210fa498d","observation_id":"f46c26c9-89be-4b62-845c-aeb52577a1fe","resolution":{"observed_at":"2026-08-07T05:31:20.247421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T05:31:20.342343Z","title":"Rae, Oriol Vinyals, and Laurent Sifre","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.342343Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:23df12f32d62fa6250f7b87213c65c42d027f9f1a633af672a1dd0d46a2bfafd","observation_id":"a4846314-5108-45f7-876b-0ff002f42000","resolution":{"observed_at":"2026-08-07T05:31:20.342343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T05:31:20.437199Z","title":"– 40 – MiniCPM4 Xinyi Hou, Yanjie Zhao, Shenao Wang, and Haoyu Wang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.437199Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:8ee094a759b754e8302ecd37fad0e12767e011824d0381b06891f0df83baab90","observation_id":"ae5aad4f-303b-4140-8d82-09fbefbe7a82","resolution":{"observed_at":"2026-08-07T05:31:20.437199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-07T05:31:20.509228Z","title":"Minicpm: Unveiling the potential of small language models with scalable training strategies","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.509228Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:0293f5b05c907594529a2b3479dd44d4783c6aa69e2c4f8614e422054bfbd570","observation_id":"8a8ab57b-3cfd-4e86-b5b9-64c74d1318b8","resolution":{"observed_at":"2026-08-07T05:31:20.509228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-07T05:31:20.607735Z","title":"Yuzhen Huang, Yuzhuo Bai, Zhihao Zhu, Junlei Zhang, Jinghan Zhang, Tangjun Su, Junteng Liu, Chuancheng Lv, Yikai Zhang, Yao Fu, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.607735Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:abb3c939bae079af9ffc36973a1b937df37ae36ee1ee398c642dca4a1c47ab14","observation_id":"d3baa7e2-407d-4ade-bd7e-31ab609914e9","resolution":{"observed_at":"2026-08-07T05:31:20.607735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T05:31:20.683952Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.683952Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:df8c46028825bbe31f9b5a9ef992a6198088a1ac62c6c5a8650b391b632581de","observation_id":"a29c74cb-59e9-4b63-8444-ff4fa44a6b03","resolution":{"observed_at":"2026-08-07T05:31:20.683952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11794","last_updated":"2025-04-21T17:48:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T17:42:57Z","title":"DataComp-LM: In search of the next generation of training sets for language models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11794","snapshot_observed_at":"2026-08-07T05:31:20.740587Z","title":"Cmmlu: Measuring massive multitask language understanding in chinese","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.740587Z"},"links":{"cited_paper":"/paper/2406.11794","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:f964d69f6b627acd4907aecd05366f72d03cf24a95452bf839909da411d12d39","observation_id":"1165ea7f-1d20-4208-a608-7a64ed3ef045","resolution":{"observed_at":"2026-08-07T05:31:20.740587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-07T05:31:20.819152Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.819152Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:d200865ea0b2aa2c0347ca4055f9285307e668e5567b97de5ef79d573a0d47d1","observation_id":"06112a24-3f9e-4f7d-abf7-5a6945c2f4dc","resolution":{"observed_at":"2026-08-07T05:31:20.819152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14251","last_updated":"2023-10-11T05:27:50Z","snapshot_observed_at":"2026-08-01T16:29:58.693560Z","submitted_at":"2023-05-23T17:06:00Z","title":"FActScore: Fine-grained Atomic Evaluation of Factual Precision in Long Form Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14251","snapshot_observed_at":"2026-08-07T05:31:20.935628Z","title":"American invitational mathematics examination-aime","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.935628Z"},"links":{"cited_paper":"/paper/2305.14251","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:4a501800370f973195c73957baf50425ff71f33aa757e20d5d87ddef936d0074","observation_id":"fd626aa0-ded1-4ca9-98d3-9511ef8d26b7","resolution":{"observed_at":"2026-08-07T05:31:20.935628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T05:31:20.998847Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.998847Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:861715435aae482212b9a6f628654424d9e1fb015af9e6ff0eb8ed8c56a617f3","observation_id":"572b4ac6-899e-45a9-ad87-6a54e8cb530f","resolution":{"observed_at":"2026-08-07T05:31:20.998847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T05:31:21.055300Z","title":"Gpt-4o mini: advancing cost-efficient intelligence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:21.055300Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:8b96960c29d3e0fcac81be0e0c4b746a90c3c9e10701d29bf3660a30c25b011c","observation_id":"d43fbc7e-88cc-4c75-86c3-c03bcc1bcc5b","resolution":{"observed_at":"2026-08-07T05:31:21.055300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00071","last_updated":"2026-02-06T19:40:50Z","snapshot_observed_at":"2026-08-01T02:15:47.181936Z","submitted_at":"2023-08-31T18:18:07Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00071","snapshot_observed_at":"2026-08-07T05:31:21.131165Z","title":"Yarn: Efficient context window extension of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:21.131165Z"},"links":{"cited_paper":"/paper/2309.00071","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:48d1983b6961fdb0156a25e3049e66b6678d485ae2324764c58032099efd775e","observation_id":"3f794b23-b4c3-45b6-85d4-85bdb74c32eb","resolution":{"observed_at":"2026-08-07T05:31:21.131165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.08271","last_updated":"2021-06-23T17:40:26Z","snapshot_observed_at":"2026-08-05T22:55:38.026415Z","submitted_at":"2020-03-18T15:22:51Z","title":"Pre-trained Models for Natural Language Processing: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.08271","snapshot_observed_at":"2026-08-07T05:31:21.251814Z","title":"Pre-trained models for natural language processing: A survey","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:21.251814Z"},"links":{"cited_paper":"/paper/2003.08271","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:d93d54808251fdaa6615698081f56b86dff451280b97f42b546074ab1c088bd3","observation_id":"b3d2b179-1be3-4f03-bca5-fed19fe14733","resolution":{"observed_at":"2026-08-07T05:31:21.251814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-07T05:31:21.459435Z","title":"Gemma 3 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:21.459435Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:58dc503caf3783c21c3799931b270b2749a6cfee271c53d0ed8766f206cc2c9c","observation_id":"226e7c60-3884-4c98-b3d7-f4d9861882ad","resolution":{"observed_at":"2026-08-07T05:31:21.459435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18505","last_updated":"2024-10-25T08:52:59Z","snapshot_observed_at":"2026-07-06T19:38:57.409491Z","submitted_at":"2024-10-24T07:50:07Z","title":"CCI3.0-HQ: a large-scale Chinese dataset of high quality designed for pre-training large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18505","snapshot_observed_at":"2026-08-07T05:31:21.709208Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:21.709208Z"},"links":{"cited_paper":"/paper/2410.18505","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:37727d59c761c5d96237ca2bb4c69af2519343cdb21a6defec0befa9f3b7bd77","observation_id":"edd32e32-ab94-458e-8851-249b94bef12e","resolution":{"observed_at":"2026-08-07T05:31:21.709208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07608","last_updated":"2025-06-05T11:49:09Z","snapshot_observed_at":"2026-07-06T21:22:35.652600Z","submitted_at":"2025-05-12T14:30:11Z","title":"MiMo: Unlocking the Reasoning Potential of Language Model -- From Pretraining to Posttraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07608","snapshot_observed_at":"2026-08-07T05:31:21.843081Z","title":"Mimo: Unlocking the reasoning potential of language model–from pretraining to posttraining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:21.843081Z"},"links":{"cited_paper":"/paper/2505.07608","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:38d90a5f290e0d63c42da7608edcdbdb1cff6b03563c9e9f279c0bcbe26c473c","observation_id":"4b6d2b2d-3ebe-498e-aff6-a592566f440d","resolution":{"observed_at":"2026-08-07T05:31:21.843081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04315","last_updated":"2024-12-06T11:39:27Z","snapshot_observed_at":"2026-08-04T05:54:36.205023Z","submitted_at":"2024-12-05T16:31:13Z","title":"Densing Law of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04315","snapshot_observed_at":"2026-08-07T05:31:21.920986Z","title":"Densing law of llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:21.920986Z"},"links":{"cited_paper":"/paper/2412.04315","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:117dd23d3b98b001ff685fcb75e720443ed58ebe0cb552d1ea5b57c817e714de","observation_id":"9db46184-a4d4-4d3b-b225-9c60b5f86560","resolution":{"observed_at":"2026-08-07T05:31:21.920986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16428","last_updated":"2025-03-20T17:59:58Z","snapshot_observed_at":"2026-07-06T20:56:14.017923Z","submitted_at":"2025-03-20T17:59:58Z","title":"XAttention: Block Sparse Attention with Antidiagonal Scoring","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16428","snapshot_observed_at":"2026-08-07T05:31:22.029658Z","title":"Xattention: Block sparse attention with antidiagonal scoring","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:22.029658Z"},"links":{"cited_paper":"/paper/2503.16428","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:32aaf85fb7a1620d456a6614cb28310aaf57b8211304a36e2da4002345b2ca1c","observation_id":"48f39df3-a01a-476c-b7ea-8e6b7087f981","resolution":{"observed_at":"2026-08-07T05:31:22.029658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T05:31:22.117240Z","title":"Onebit: Towards extremely low-bit large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:22.117240Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:381d7a686337271b8d5dfaf4f5c9da16ae436731cb6b23e5c91f1cb50ec52d21","observation_id":"be46e805-0613-44d6-a6cc-3e26a1c5d35f","resolution":{"observed_at":"2026-08-07T05:31:22.117240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03466","last_updated":"2022-03-28T08:12:14Z","snapshot_observed_at":"2026-08-03T21:15:21.591567Z","submitted_at":"2022-03-07T15:37:35Z","title":"Tensor Programs V: Tuning Large Neural Networks via Zero-Shot Hyperparameter Transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03466","snapshot_observed_at":"2026-08-07T05:31:22.209465Z","title":"Tensor programs v: Tuning large neural networks via zero-shot hyperparameter transfer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:22.209465Z"},"links":{"cited_paper":"/paper/2203.03466","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:41866761cbce5f5ebf4c80df3a55339304f0c2d2283f13c6ecf71f8eaca1ed4c","observation_id":"40a7be92-1fac-4728-bf5c-e254c7922771","resolution":{"observed_at":"2026-08-07T05:31:22.209465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-07T05:31:22.338736Z","title":"Minicpm-v: A gpt-4v level mllm on your phone","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:22.338736Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:77652ed03d8ed2461cce93ef0dc7a8bbc40ed83de68af5ddfa5d0e4801cd94c2","observation_id":"658ddb29-6ca7-4afd-a9b1-2ca7f585d146","resolution":{"observed_at":"2026-08-07T05:31:22.338736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T05:31:22.420798Z","title":"Dapo: An open-source llm reinforcement learning system at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:22.420798Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:a56a5e8269d8757e5aba9cc538684ca7bc48ffd924b23ba97199b151731e7c04","observation_id":"0505c5db-18fa-4fd8-bd05-48cf231bc2a9","resolution":{"observed_at":"2026-08-07T05:31:22.420798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:31:22.540224Z","title":"Spargeattn: Accurate sparse attention accelerating any model inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:22.540224Z"},"links":{"citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:898638bf7a7da9ffd35de5ade5e0dbfbe89e2f6ac7d25de6d21db92af1ea9d35","observation_id":"bbdcb812-5d03-49c4-9731-a04b55e55884","resolution":{"observed_at":"2026-08-07T05:31:22.540224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14856","last_updated":"2025-03-11T08:54:55Z","snapshot_observed_at":"2026-07-06T20:40:01.776087Z","submitted_at":"2025-02-20T18:58:10Z","title":"FR-Spec: Accelerating Large-Vocabulary Language Models via Frequency-Ranked Speculative Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14856","snapshot_observed_at":"2026-08-07T05:31:22.607755Z","title":"Fr-spec: Accelerating large-vocabulary language models via frequency-ranked speculative sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:22.607755Z"},"links":{"cited_paper":"/paper/2502.14856","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:57443aefddfcec82b5c3a6a39a8d8f3d397249d8ba44c82e1ce42614ce8770b5","observation_id":"78d59c46-a7da-4a31-b944-61ec05423ec6","resolution":{"observed_at":"2026-08-07T05:31:22.607755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14658","last_updated":"2025-01-07T05:37:04Z","snapshot_observed_at":"2026-08-06T03:14:31.781649Z","submitted_at":"2024-02-22T16:06:23Z","title":"OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14658","snapshot_observed_at":"2026-08-07T05:31:22.729139Z","title":"Opencodeinterpreter: Integrating code generation with execution and refinement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:22.729139Z"},"links":{"cited_paper":"/paper/2402.14658","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:7044bd05800e1839fbd3703f8779226246c679d0a12e3b9fb72511ab1b995170","observation_id":"353c05fe-6a01-47f1-939b-d544b070a447","resolution":{"observed_at":"2026-08-07T05:31:22.729139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-08-07T05:31:21.594653Z","title":"Llm ×mapreduce-v2: Entropy-driven convolutional test-time scaling for generating long-form articles from extremely long resources, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:21.594653Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:664af29f0d683b65033bdef73288ef8b511d90f6a67ce6495eb9293a0a1b3f82","observation_id":"b3b0c243-0bbb-408e-9f43-da719fad6c0c","resolution":{"observed_at":"2026-08-07T05:31:21.594653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14207","last_updated":"2024-04-08T05:38:50Z","snapshot_observed_at":"2026-07-06T17:33:41.634820Z","submitted_at":"2024-02-22T01:20:17Z","title":"Assisting in Writing Wikipedia-like Articles From Scratch with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14207","snapshot_observed_at":"2026-08-07T05:31:21.341625Z","title":"Assisting in writing wikipedia-like articles from scratch with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:21.341625Z"},"links":{"cited_paper":"/paper/2402.14207","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:d63f4cd6663f05a97ba157fbed557b996720c2653da1b743999dbdea1655bac5","observation_id":"1e33e265-a74b-4137-ac30-ae59d1d5a11b","resolution":{"observed_at":"2026-08-07T05:31:21.341625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:31:23.444568Z","title":"LongAlign: A recipe for long context alignment of large language models","venue":null,"work_id":"d08c2fd1-6e8b-45a0-85d5-abf4930d7889","year":2024},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.073091Z"},"links":{"citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:09d84d3191976923505be7a3374f5c5ccb6b177c1aeaff1f49ae5f2789540c72","observation_id":"819c634a-5d4f-4012-adc8-e9b00a951542","resolution":{"observed_at":"2026-08-07T05:31:23.553958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T05:31:19.647000Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.647000Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:ad520e63c15af902bce5ef765cdd8b329bb810521e47d667bee48c2388c08740","observation_id":"d2b7c941-d788-42d1-84f8-3af3700fd17f","resolution":{"observed_at":"2026-08-07T05:31:19.647000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T05:31:19.401639Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.401639Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:fe275856203add8145229f46b71968144935cffc17accec8224f346ca29856b9","observation_id":"9e76ad3f-fb4b-4c98-8b2f-5dfebf2fce12","resolution":{"observed_at":"2026-08-07T05:31:19.401639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T05:31:18.957206Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:18.957206Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:029b365d0a7d833c758c3ab53df21cfeb0289340222b8dbe7cf4129a0d1acefc","observation_id":"3b69b5e1-438c-4caf-a265-18caef954291","resolution":{"observed_at":"2026-08-07T05:31:18.957206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-07T05:31:20.875138Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.875138Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:3aae66504c69e80eb7e56518c856d3ef82604d66d0e24ccd50f4d4561259fdc1","observation_id":"7d34dc5c-336d-4bd7-a94e-4299a4482785","resolution":{"observed_at":"2026-08-07T05:31:20.875138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T05:20:20.993402Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 24 inbound Pith citation observations for arXiv:2506.07900."}