{"as_of":"2026-08-20T03:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c812a69f264ecefb9de3a1c7f18eb1303d71330c4ae4d41e142e42998357c12","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:03:10.285815Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:01:16.281918Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T13:26:58.366503Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16508","snapshot_observed_at":"2026-08-06T05:01:16.281918Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02381","last_updated":"2025-08-06T03:44:36Z","snapshot_observed_at":"2026-08-19T09:11:20.528476Z","submitted_at":"2025-08-04T13:08:35Z","title":"Beyond Manually Designed Pruning Policies with Second-Level Performance Prediction: A Pruning Framework for LLMs","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T05:01:16.281918Z"},"links":{"cited_paper":"/paper/2505.16508","citing_paper":"/paper/2508.02381"},"observation_digest":"sha256:67a281963c1a27fb7caca013babfbe051b13492f8f220c047a0a340987f6c26f","observation_id":"c66cbdd8-ecab-456e-a4b7-378d932f4f42","resolution":{"observed_at":"2026-08-06T05:01:16.281918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"cited_work":{"arxiv_id":"2505.16508","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16508","snapshot_observed_at":"2026-07-02T13:26:58.366503Z","title":"Edge-first language model inference: Models, metrics, and tradeoffs","venue":null,"work_id":"5534bac6-5fdb-404e-a28c-03fb2bf1a510","year":2025},"citing_paper":{"arxiv_id":"2604.14987","last_updated":"2026-04-16T13:17:49Z","snapshot_observed_at":"2026-08-06T23:03:47.061291Z","submitted_at":"2026-04-16T13:17:49Z","title":"AI-Enabled Covert Channel Detection in RF Receiver Architectures","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T10:52:45.960658Z"},"links":{"cited_paper":"/paper/2505.16508","citing_paper":"/paper/2604.14987"},"observation_digest":"sha256:08a26d3c1722531cf1836b3ffdec4f874a73bb4b5e896773729786eedd6975c7","observation_id":"823794ad-8224-41d0-959a-ca74ffe32ebd","resolution":{"observed_at":"2026-05-10T10:55:04.047552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"cited_work":{"arxiv_id":"2505.16508","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16508","snapshot_observed_at":"2026-07-02T13:26:58.366503Z","title":"Edge-first language model inference: Models, metrics, and tradeoffs","venue":null,"work_id":"5534bac6-5fdb-404e-a28c-03fb2bf1a510","year":2025},"citing_paper":{"arxiv_id":"2607.00501","last_updated":"2026-07-01T06:37:11Z","snapshot_observed_at":"2026-08-13T10:55:39.712297Z","submitted_at":"2026-07-01T06:37:11Z","title":"BaseRT: Best-in-Class LLM Inference on Apple Silicon via Native Metal","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-02T13:26:29.517984Z"},"links":{"cited_paper":"/paper/2505.16508","citing_paper":"/paper/2607.00501"},"observation_digest":"sha256:1b22887f300cb42712e6b1afc7d56b57b648a8527fcb053d5a11f0616adfec94","observation_id":"4dac0a71-f3a0-4857-953e-fd98b6c9c87e","resolution":{"observed_at":"2026-07-02T13:26:58.368171Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16508","snapshot_observed_at":"2026-08-01T18:53:33.574946Z","title":"arXiv preprint arXiv:2505.16508 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17175","last_updated":"2026-07-19T10:21:30Z","snapshot_observed_at":"2026-08-18T18:20:59.791839Z","submitted_at":"2026-07-19T10:21:30Z","title":"LMEdge: QoS-Aware LLM Inference Orchestration on Edge Clusters","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T18:53:33.574946Z"},"links":{"cited_paper":"/paper/2505.16508","citing_paper":"/paper/2607.17175"},"observation_digest":"sha256:e743cfc1d897772280e92de49dae30c0b19daca2804f95037b6862afb53b9fdb","observation_id":"9e71d968-f40e-48f0-a08e-a510de7abd32","resolution":{"observed_at":"2026-08-01T18:53:33.574946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16508","snapshot_observed_at":"2026-08-01T14:28:21.783810Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19438","last_updated":"2026-07-21T06:42:18Z","snapshot_observed_at":"2026-08-16T05:11:31.055992Z","submitted_at":"2026-07-21T06:42:18Z","title":"BaseRT: Advancing Best-in-Class LLM Inference with Apple M5 Neural Accelerators","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:28:21.783810Z"},"links":{"cited_paper":"/paper/2505.16508","citing_paper":"/paper/2607.19438"},"observation_digest":"sha256:deecb624b5878b603697c7b4a1aac51c40e1cb54393ea96d87993e010d095dfa","observation_id":"afb5a434-8b04-48b2-bb97-fe96bb5fd551","resolution":{"observed_at":"2026-08-01T14:28:21.783810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16508/citation-record","integrity":"/paper/2505.16508/integrity","json":"/paper/2505.16508/citation-record.json","paper":"/paper/2505.16508"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"articles/7039943","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:10.545107Z","title":"Data usage for consumer services faq,","venue":null,"work_id":"2765e9a3-6188-4ebd-a131-d941a0915496","year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:08.524182Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:a13a5f525dbad73583aed8bf028674387ae1c181e07f3aedebd1cf6b5be75d8e","observation_id":"34ba95dc-8f3e-4aec-bec1-bddc1c205bc4","resolution":{"observed_at":"2026-08-07T15:03:10.608413Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12844","last_updated":"2024-07-25T22:27:38Z","snapshot_observed_at":"2026-08-16T14:08:20.778003Z","submitted_at":"2024-03-19T15:51:21Z","title":"MELTing point: Mobile Evaluation of Language Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12844","snapshot_observed_at":"2026-08-07T15:03:08.584216Z","title":"Melting point: Mobile evaluation of language transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:08.584216Z"},"links":{"cited_paper":"/paper/2403.12844","citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:4aa12c7ffe4743f06f630163afb36f1a79d23717d1b609f3fcaf4718ff52e31c","observation_id":"065c10a3-5aab-48d4-a43f-97272c48523c","resolution":{"observed_at":"2026-08-07T15:03:08.584216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04255","last_updated":"2023-09-08T10:44:19Z","snapshot_observed_at":"2026-08-16T15:02:17.601613Z","submitted_at":"2023-09-08T10:44:19Z","title":"LLMCad: Fast and Scalable On-device Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04255","snapshot_observed_at":"2026-08-07T15:03:08.669376Z","title":"Llmcad: Fast and scalable on-device large language model inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:08.669376Z"},"links":{"cited_paper":"/paper/2309.04255","citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:c09587b3fff4f2d8d16792bb1157af8ab3285f6848c3862331075597d7bf6deb","observation_id":"991996f3-5e6e-4046-889d-6806864ff512","resolution":{"observed_at":"2026-08-07T15:03:08.669376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:08.729902Z","title":"Awq: Activation-aware weight quanti- zation for on-device llm compression and acceleration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:08.729902Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:4073a17e29380c88bc86d100c657a3e858822c5541126f249ae0fa197b4aa7ea","observation_id":"819d60dc-6128-43e6-b98b-a0badecc6103","resolution":{"observed_at":"2026-08-07T15:03:08.729902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:08.813541Z","title":"Llm-pruner: On the structural pruning of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:08.813541Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:458c1686946b081a12f823ea85f5a6e57c508bf79f79af7b74b1f3ce574c0f87","observation_id":"4ed7b540-95ec-45d4-886e-3e7d95b46fa0","resolution":{"observed_at":"2026-08-07T15:03:08.813541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:12.347653Z","title":"Minillm: Knowledge distillation of large language models,","venue":null,"work_id":"2b1abfbf-aae3-49b8-95cb-8c9d6d0d6fc5","year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:08.882933Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:5b86509b58e57df3ee521ef9d482c537f4c5b08f97c2bf199b520876b476b2b9","observation_id":"9e00be27-8702-415f-9a51-176c459efc07","resolution":{"observed_at":"2026-08-07T15:03:12.433220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:12.161535Z","title":"Chatgpt: A conversational ai service,","venue":null,"work_id":"1bd0ab3e-9dc5-4239-8524-0eea760a96fc","year":2023},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:08.970157Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:b37f4c7f1fa9d11c38271d7407e96daf9837bffc549bc6d758134076505d0219","observation_id":"cf1407cc-92d6-4807-9b26-73fbf1a6d025","resolution":{"observed_at":"2026-08-07T15:03:12.245715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:12.021703Z","title":"Gpt-4o: Enhanced performance across diverse tasks,","venue":null,"work_id":"1864fce0-140b-4b53-9993-07902f75c2b1","year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.056601Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:bfe6a65aad31f2cc127ebf79961e89537de7c73178e35f772fc608f7c2b69d64","observation_id":"7da167e2-7954-4c65-a51d-f0c86ea8f921","resolution":{"observed_at":"2026-08-07T15:03:12.092747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:11.870440Z","title":"How much energy do llms consume? unveiling the power behind ai,","venue":null,"work_id":"cb900123-e334-450a-9094-d0c6a2dce23b","year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.148144Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:e7e46c381882e3f110bdb5d0fd6a0bdd02d9f5c876982cb3f06e7d8c0c4db7cd","observation_id":"af19a66e-cbae-4148-9fd5-e08a766671e6","resolution":{"observed_at":"2026-08-07T15:03:11.940609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:11.564028Z","title":"Ai’s growing car- bon footprint,","venue":null,"work_id":"60319543-6d02-4580-9176-d9c195ac29a8","year":2023},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.329756Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:40a0da1312f35827fe857b2f200fead58686a29634aaf97702d9c293233e0126","observation_id":"811cac35-5259-4ab3-9d69-b30f256ab298","resolution":{"observed_at":"2026-08-07T15:03:11.644807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:09.419253Z","title":"Estimating the carbon footprint of bloom, a 176b parameter language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.419253Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:1d38a96bd8b9fc247a284e5f11857b279fd9e931fd7994f7ae2fe9e9853419f3","observation_id":"fbc22b8a-feb0-461e-9ce6-460bdb0c8a42","resolution":{"observed_at":"2026-08-07T15:03:09.419253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:11.407789Z","title":"(2024, Dec.) Incident report: Service down on december 12, 2024","venue":null,"work_id":"2684afab-b5c4-4ccd-82a8-1cdb74dfc147","year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.477464Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:71ed49b78733aa30503c4046cde6dfa797861cacdcad00cc80822f8c7b689b2b","observation_id":"cace8008-afc1-4b05-8e9c-8e7c2d599805","resolution":{"observed_at":"2026-08-07T15:03:11.480181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:11.710216Z","title":"Available: https://adasci.org/how-much-energy-do-llms- consume-unveiling-the-power-behind-ai/","venue":null,"work_id":"760f8041-e1d3-44d9-9d2e-0c6b919b497f","year":null},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.243174Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:7ede9f42c90b59f2ce8c3021996335b1e363eef69b0f1290a8a5377ed7a80261","observation_id":"f1cbc94c-df01-4eff-b49e-4b53270ea68a","resolution":{"observed_at":"2026-08-07T15:03:11.801102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T15:03:09.539985Z","title":"Gemma 2: Improving open language models at a practical size,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.539985Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:d773c2867833e7e0e573afd880b3f0116d9a79d5b08355036b5ba44ba94d0c49","observation_id":"7e5cda20-09f7-423f-8af0-c749b270af9e","resolution":{"observed_at":"2026-08-07T15:03:09.539985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15790","last_updated":"2025-02-26T06:34:55Z","snapshot_observed_at":"2026-08-19T23:45:09.602398Z","submitted_at":"2024-09-24T06:36:56Z","title":"Small Language Models: Survey, Measurements, and Insights","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15790","snapshot_observed_at":"2026-08-07T15:03:09.638551Z","title":"Small language models: Survey, measurements, and insights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.638551Z"},"links":{"cited_paper":"/paper/2409.15790","citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:e06c1a14e836f6d40be64651ffab2ea965d7750b8ed05fc952b220d609cae407","observation_id":"dec85007-785b-45b8-804b-2b61ce4ec308","resolution":{"observed_at":"2026-08-07T15:03:09.638551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:11.263493Z","title":"Llama models,","venue":null,"work_id":"2895add3-268c-491e-b015-599c47012677","year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.710654Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:a54099caf09dfe9c8883686664c9110aea53af2dc38bd54178f14ddea3e0f458","observation_id":"4117fe65-28da-4e27-9e69-399987137da4","resolution":{"observed_at":"2026-08-07T15:03:11.349700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06866","last_updated":"2024-04-27T06:20:26Z","snapshot_observed_at":"2026-08-19T09:37:42.607101Z","submitted_at":"2024-01-12T19:40:11Z","title":"Health-LLM: Large Language Models for Health Prediction via Wearable Sensor Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06866","snapshot_observed_at":"2026-08-07T15:03:09.803169Z","title":"Health-llm: Large language models for health prediction via wearable sensor data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.803169Z"},"links":{"cited_paper":"/paper/2401.06866","citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:37a69c26de4933427a38ca0bfa060b5a34025d773982321160adfffb743c7176","observation_id":"5de477f8-7f82-42e8-b6da-04ed9f54ced7","resolution":{"observed_at":"2026-08-07T15:03:09.803169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:11.077214Z","title":"Finbert: A large language model for extracting information from financial text,","venue":null,"work_id":"c7bfc058-b195-4761-9358-32267be46fbd","year":2023},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.887212Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:6f1ea22e84c0e156bd8abca05fac055628fbeaf246479924ec2ea4961efd15e7","observation_id":"f9936cff-8946-4305-8807-5388ad4298b1","resolution":{"observed_at":"2026-08-07T15:03:11.162136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-07T15:03:09.956250Z","title":"Code llama: Open foundation models for code,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:09.956250Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:54050c4df240630787c6a6ba99a5e81110ecc7dfd3e33989ec76bc0f21fc90b6","observation_id":"75519e97-be7f-4d58-9048-0720a9d3235f","resolution":{"observed_at":"2026-08-07T15:03:09.956250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T15:03:10.039916Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:10.039916Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:6dbc85af5cb0b80338be87b46810d0b11f6a689544a344682b260e242647df0e","observation_id":"fcb9fd31-524a-49a6-bae0-19d1a7488c91","resolution":{"observed_at":"2026-08-07T15:03:10.039916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10373","last_updated":"2024-07-17T09:34:00Z","snapshot_observed_at":"2026-08-19T21:31:52.538765Z","submitted_at":"2024-02-15T23:39:04Z","title":"BioMistral: A Collection of Open-Source Pretrained Large Language Models for Medical Domains","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10373","snapshot_observed_at":"2026-08-07T15:03:10.120350Z","title":"Biomistral: A collection of open-source pretrained large language models for medical domains,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:10.120350Z"},"links":{"cited_paper":"/paper/2402.10373","citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:ebce666f569568212c55eb0891e973aeffd4917ebd45e7eef22edf8aa4eb5a6e","observation_id":"09c0c1aa-8abb-4d14-9885-aaffde73d969","resolution":{"observed_at":"2026-08-07T15:03:10.120350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:10.908121Z","title":"Rate limits – openai,","venue":null,"work_id":"fe70a2c6-0d3f-4a3c-9071-bcbec58cfffc","year":2024},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:10.198302Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:33ffd47242c81bff1121e4f84ab3e9f09b406df3f5071d3047e917fd7e1c98ea","observation_id":"ec11e2e2-5d23-4316-bdbf-33cc8eb3a766","resolution":{"observed_at":"2026-08-07T15:03:10.979458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:10.736239Z","title":"Adaptive sliding windows for improved estimation of data center resource utilization,","venue":null,"work_id":"4a1fb103-6674-4c18-9fdb-e103f90a7625","year":2020},"citing_paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:10.285815Z"},"links":{"citing_paper":"/paper/2505.16508"},"observation_digest":"sha256:a62e28ddb4dbe8f4bd3084b6ab68492598421a9afb875878dc04142f43e875eb","observation_id":"92a942ef-53ac-4bbb-9107-069815d5abce","resolution":{"observed_at":"2026-08-07T15:03:10.827099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16508","last_updated":"2025-05-29T08:56:27Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-19T14:30:32.965900Z","submitted_at":"2025-05-22T10:43:00Z","title":"Edge-First Language Model Inference: Models, Metrics, and Tradeoffs"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":11},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 5 inbound Pith citation observations for arXiv:2505.16508."}