{"as_of":"2026-08-08T16:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:12b4e4ba181850bf43bbfe065c51510cad74fa6c38b74bdb51e00e865fbc0cb9","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:33:41.924970Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T08:54:41.845820Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T08:55:34.743495Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"cited_work":{"arxiv_id":"2506.10443","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10443","snapshot_observed_at":"2026-07-01T08:55:34.743495Z","title":"Wang et al","venue":null,"work_id":"90c3924a-72ae-4122-ad14-1520c2eb560e","year":null},"citing_paper":{"arxiv_id":"2604.27476","last_updated":"2026-06-08T07:15:10Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T06:18:50Z","title":"EdgeFM: Efficient Edge Inference for Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T08:30:35.264804Z"},"links":{"cited_paper":"/paper/2506.10443","citing_paper":"/paper/2604.27476"},"observation_digest":"sha256:e647aa7e42a5a8c4cd8634cb16e1cd4ab32c8fc13a692a9513f5582cdde6e5b4","observation_id":"1c7a9c01-90fd-41d1-9062-b72a73196db2","resolution":{"observed_at":"2026-05-12T10:01:27.727595Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"cited_work":{"arxiv_id":"2506.10443","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10443","snapshot_observed_at":"2026-07-01T08:55:34.743495Z","title":"Wang et al","venue":null,"work_id":"90c3924a-72ae-4122-ad14-1520c2eb560e","year":null},"citing_paper":{"arxiv_id":"2604.27476","last_updated":"2026-06-08T07:15:10Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T06:18:50Z","title":"EdgeFM: Efficient Edge Inference for Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-01T08:54:41.845820Z"},"links":{"cited_paper":"/paper/2506.10443","citing_paper":"/paper/2604.27476"},"observation_digest":"sha256:80529eb4410a9f63dffb9d9ca0d17254d13fea6b26b09c94ac4666814f4213f8","observation_id":"f721f4d8-a09b-4842-8c29-8508680dcedf","resolution":{"observed_at":"2026-07-01T08:55:34.744946Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10443/citation-record","integrity":"/paper/2506.10443/integrity","json":"/paper/2506.10443/citation-record.json","paper":"/paper/2506.10443"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.11514","last_updated":"2024-07-30T23:37:20Z","snapshot_observed_at":"2026-07-06T17:04:50.608413Z","submitted_at":"2023-12-12T18:57:08Z","title":"LLM in a flash: Efficient Large Language Model Inference with Limited Memory","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11514","snapshot_observed_at":"2026-08-07T04:33:37.615578Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:37.615578Z"},"links":{"cited_paper":"/paper/2312.11514","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:d4ccff3b05474c2dc8f8436ccd4e06c33e25cf5fe6d87133faafc0052ca2341b","observation_id":"999649e1-e61e-4631-9e97-150b5e4bd1ea","resolution":{"observed_at":"2026-08-07T04:33:37.615578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:46.330358Z","title":null,"venue":null,"work_id":"d4f2f5fd-d143-41f0-b9d5-f85ab2e0df99","year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:37.744904Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:bca762c47bf810f98f43841f446b7531dc7a2c001c96a05766b5769f7a08e3d2","observation_id":"6b709f10-c803-447a-8845-fb09bfa8de78","resolution":{"observed_at":"2026-08-07T04:33:46.456905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:46.079555Z","title":null,"venue":null,"work_id":"641003d9-7932-4f8b-8b32-7ba179cba709","year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:37.885682Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:244704fbbbbfc6fc789a099a0e327a00a5c5408437e14d3548f6f2f6a1829774","observation_id":"03865cf6-96d5-4c30-aa83-214e877b5762","resolution":{"observed_at":"2026-08-07T04:33:46.197333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:45.764303Z","title":null,"venue":null,"work_id":"11a0d1b0-9333-4cfc-8176-f3629c2d1a28","year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:38.068150Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:bcb17bb274f7a86d5308db5d1cdf64968b096276aae95a25d5c646f2f0db0e22","observation_id":"0fe4a643-d7ef-4e0d-b28d-7097fc628113","resolution":{"observed_at":"2026-08-07T04:33:45.906573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:45.553215Z","title":null,"venue":null,"work_id":"93a7e3ab-2b63-49bd-9672-c29ff5f0d5a3","year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:38.220581Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:3e348fcd1253c49491d8c4cd72d023dffde6037932f295ec4098babe6c4075a4","observation_id":"5d39d001-2ecc-48ac-a776-19248d5dc7e8","resolution":{"observed_at":"2026-08-07T04:33:45.654420Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:45.290228Z","title":null,"venue":null,"work_id":"1d48b613-4c24-4d28-a54d-84a154867a04","year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:38.378821Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:dd965ae6adb5ba15feef3bab0c58da75799d658c1a066fc94a2fb8ee7d08eee7","observation_id":"efb0db2a-fe09-4914-b831-e19d5ee87a1a","resolution":{"observed_at":"2026-08-07T04:33:45.420724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T04:33:38.535271Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:38.535271Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:515c27a2c1a3ead81796c28e10c3dabafbdd47fb249823347b3c645188bfb314","observation_id":"cbc9de67-1f49-428b-a675-5529a7d77b8a","resolution":{"observed_at":"2026-08-07T04:33:38.535271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:44.967440Z","title":null,"venue":null,"work_id":"91bcd1f0-2c77-420f-a421-9b7324ac79d6","year":2019},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:38.684219Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:b2476cb1c6aedf2e7c4dcfecb1c5719079778c32f220d3ab730c47a49c5825df","observation_id":"2e582e7a-9103-4193-9d33-b41d95df9c45","resolution":{"observed_at":"2026-08-07T04:33:45.144980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-07T04:33:38.831526Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:38.831526Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:11c5b1f4605b6d1520269d85ad4e78ad748f8a421a15aba63de3783fdc3df189","observation_id":"4119092e-5336-441a-af7e-cca3f1ade219","resolution":{"observed_at":"2026-08-07T04:33:38.831526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:44.673531Z","title":null,"venue":null,"work_id":"25bf0349-ad3d-4201-a628-5366985e59e2","year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:38.984467Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:24b52d3abad24aa006b3192b89d5e29da07eae0d1455b74fe04ebc2a2009ab5c","observation_id":"e27a151a-d7f6-4df1-959c-8294ad1b0aba","resolution":{"observed_at":"2026-08-07T04:33:44.797347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-07T04:33:39.095803Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:39.095803Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:831cbc2a28f9be18163dc95551ee23433f4456d528bc7959e1e311f069b307b6","observation_id":"26340a6b-0eb3-48cf-9420-c8b49db7bdc1","resolution":{"observed_at":"2026-08-07T04:33:39.095803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/aiccsa","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:42.069234Z","title":null,"venue":null,"work_id":"f736af1f-e2b2-4afd-b19c-8b98f010053e","year":2017},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:39.229878Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:aaea88d27703a9f41bf4edb4e9098e4ce10d1b4ff69051f18ff0dbcbe7ce496b","observation_id":"e22c9314-d8bf-4116-9b6b-04a19e969ebd","resolution":{"observed_at":"2026-08-07T04:33:42.193093Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-07T04:33:39.357392Z","title":"Howard, Menglong Zhu, Bo Chen, Dmitry Kalenichenko, Wei- jun Wang, Tobias Weyand, Marco Andreetto, and Hartwig Adam","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:39.357392Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:9b09144f0f0fc834d42b3194f5169f9aae8b2a8974c98ce894197c79fb797801","observation_id":"761010cb-87e6-4933-a502-94edad45598a","resolution":{"observed_at":"2026-08-07T04:33:39.357392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T04:33:39.505282Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:39.505282Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:c6b151c704d1fea03edbba4e67baa5e949c77126abbfe579f27178d710156e4e","observation_id":"d5697dfc-b843-4932-8f5a-d4a0b0e14676","resolution":{"observed_at":"2026-08-07T04:33:39.505282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.12418","last_updated":"2020-02-27T20:03:16Z","snapshot_observed_at":"2026-07-06T09:00:46.442419Z","submitted_at":"2020-02-27T20:03:16Z","title":"MNN: A Universal and Efficient Inference Engine","version":1},"cited_work":{"arxiv_id":"2002.12418","doi":null,"metadata_source":"pith","pith_arxiv_id":"2002.12418","snapshot_observed_at":"2026-08-07T04:33:42.457517Z","title":"MNN: A Universal and Efficient Inference Engine","venue":"cs.CV","work_id":"d0953f4f-90ab-4680-8896-dc93907b99ba","year":2020},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:39.629945Z"},"links":{"cited_paper":"/paper/2002.12418","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:21a66e7038412c977c02b91fbaf8b78d3a4f13dba5891fc68c7b509dad969e8d","observation_id":"21e04c31-6eff-4bb8-9227-d039bf16fb7d","resolution":{"observed_at":"2026-08-07T04:33:42.562810Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:39.741439Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:39.741439Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:a647466c3ecff1f409ab47c9a1df4d93078a0227f7d9d16e2d388a59fb382c49","observation_id":"fb0e52b3-d4e1-4c7b-8041-0fe589f77517","resolution":{"observed_at":"2026-08-07T04:33:39.741439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:44.418506Z","title":null,"venue":null,"work_id":"1c9753dd-d836-4986-850c-cff2ca52284b","year":2022},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:40.018787Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:8fb5a488d7774afd60dda210af32eb2b7cc308b1e0cdd5a56b6ff8d974781311","observation_id":"659448a1-def5-4c5a-b2e7-89c4c7a2b5d4","resolution":{"observed_at":"2026-08-07T04:33:44.542434Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:44.169745Z","title":null,"venue":null,"work_id":"ad24e4f1-d4c0-4d2e-8283-9d4b7df151be","year":2023},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:40.170446Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:ce1f9201232f83ee3b6d7984317642447722b6e47e7f5e39a347e41f70c90464","observation_id":"aacd58ab-0edf-4449-b713-74a2b6054d11","resolution":{"observed_at":"2026-08-07T04:33:44.307227Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:43.877621Z","title":"on device","venue":null,"work_id":"52fc3d95-666f-4ffe-b924-c2bd39da5857","year":2023},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:40.293559Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:fef0ca012c1c6149220059eb74a5cb5271247f50f71c7e57c7d2e0b128221dd4","observation_id":"b367ccbe-8a64-4b1d-bee7-572935f6c666","resolution":{"observed_at":"2026-08-07T04:33:44.029955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:43.602885Z","title":null,"venue":null,"work_id":"2c3daa45-068a-46ae-b6e5-6388b3d515ee","year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:40.445975Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:0975c6577c773aef8d022f9539e4f958211ace57c2997004298ad8d81bb85796","observation_id":"8f2ea278-8918-4e53-81fe-691020e88fc8","resolution":{"observed_at":"2026-08-07T04:33:43.750762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:43.383839Z","title":null,"venue":null,"work_id":"78a4648a-e367-4a80-8dce-7859f1392cc4","year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:40.566715Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:621dbe1195276b66f5a8ab85f6f5202b6192dd757164922625ea5eba1a4f434d","observation_id":"db262817-6bf5-4595-a6c7-96563e7bbe94","resolution":{"observed_at":"2026-08-07T04:33:43.473088Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02640","last_updated":"2016-05-09T22:22:11Z","snapshot_observed_at":"2026-07-06T04:20:15.965140Z","submitted_at":"2015-06-08T19:52:52Z","title":"You Only Look Once: Unified, Real-Time Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02640","snapshot_observed_at":"2026-08-07T04:33:40.720961Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:40.720961Z"},"links":{"cited_paper":"/paper/1506.02640","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:1a49d3a31408bef0ea30e67180dece85e2feb1ec2bff4a2568fd998b745a47c2","observation_id":"734a1b4e-8aee-4ddb-8632-b305a95426f5","resolution":{"observed_at":"2026-08-07T04:33:40.720961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:43.134311Z","title":null,"venue":null,"work_id":"09ea616a-9baf-4cd0-b1e6-bd8aff86cee1","year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:40.836010Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:0e01c659929d5c5079c49f6271e5f3b1b666d037a4695b7cd262207cdbce3423","observation_id":"8c20ce34-f826-4178-8233-31fe5b05d9d2","resolution":{"observed_at":"2026-08-07T04:33:43.261538Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:40.964786Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:40.964786Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:bd74e326c54d03150e04d9ceb7867206dffee2754977d9a2c703417f1ca484d4","observation_id":"5598ddb0-e2b5-4537-ba5b-72423d7ec9b0","resolution":{"observed_at":"2026-08-07T04:33:40.964786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-07T04:33:41.132025Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:41.132025Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:b953c52ece2bb281b1e4cb7815819151f8f5ef6b79e954af0e259c86fcb53d2a","observation_id":"043c2382-a7b9-4da8-af48-7341458c9fe8","resolution":{"observed_at":"2026-08-07T04:33:41.132025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:41.296814Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:41.296814Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:4d5d8852f54c22540615c575a1e023ddca51c652a525207fb0daf7c2d0ecea42","observation_id":"858f1e20-5ea8-40b7-9160-5177f915214c","resolution":{"observed_at":"2026-08-07T04:33:41.296814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T04:33:41.639468Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:41.639468Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:1935cc8f3949014eddca58c8dabf509c317d37d5a95bcfa0c05bedc0f12d92c6","observation_id":"e6e444f5-3cb8-4b93-b41d-119054e6e8ee","resolution":{"observed_at":"2026-08-07T04:33:41.639468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07467","last_updated":"2019-10-16T16:44:22Z","snapshot_observed_at":"2026-08-08T08:22:25.110228Z","submitted_at":"2019-10-16T16:44:22Z","title":"Root Mean Square Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07467","snapshot_observed_at":"2026-08-07T04:33:41.808494Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:41.808494Z"},"links":{"cited_paper":"/paper/1910.07467","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:d3af12136c6f6e614babf069f69e995e2881d3c1c8526c21d38fdd24f4cb4b28","observation_id":"07cfa9f5-a237-412f-9484-e4c31b491b95","resolution":{"observed_at":"2026-08-07T04:33:41.808494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:42.936560Z","title":null,"venue":null,"work_id":"70a92b2f-95cd-45b7-80e9-29d38abbcdc0","year":2023},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:41.924970Z"},"links":{"citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:3f525d745bd97d2124057e08d4c9425c39f8d08a1f9861885c8005d4c8861019","observation_id":"8011b221-9303-4af3-8633-62ce47f76064","resolution":{"observed_at":"2026-08-07T04:33:43.018621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T04:33:39.863520Z","title":"CoRR abs/2001.08361 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:39.863520Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:4a8fc263af33ac34945404ec5fcc9390fea51e06b0c3e7322089f71492fed1c0","observation_id":"eb4c56db-5743-4d7b-b20e-382e1860804e","resolution":{"observed_at":"2026-08-07T04:33:39.863520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06282","last_updated":"2024-12-12T12:24:18Z","snapshot_observed_at":"2026-08-06T16:06:48.213787Z","submitted_at":"2024-06-10T14:01:21Z","title":"PowerInfer-2: Fast Large Language Model Inference on a Smartphone","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06282","snapshot_observed_at":"2026-08-07T04:33:41.493324Z","title":"arXiv:2406.06282 [cs.LG] https://arxiv.org/abs/2406.06282","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:41.493324Z"},"links":{"cited_paper":"/paper/2406.06282","citing_paper":"/paper/2506.10443"},"observation_digest":"sha256:d9902fa5e60366ab2c7e88b9a4a833047b4ed8de49c87fbe52321f1214cb07c8","observation_id":"dfe72331-8322-4198-ad01-cb3db0095e9a","resolution":{"observed_at":"2026-08-07T04:33:41.493324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10443","last_updated":"2025-06-12T07:45:29Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T01:29:54.355824Z","submitted_at":"2025-06-12T07:45:29Z","title":"MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 2 inbound Pith citation observations for arXiv:2506.10443."}