{"as_of":"2026-08-11T05:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b7555d9eab81a5aa8a20c842cdbd836d59e3b288440f5da978500f5516a80e2c","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:49:05.158865Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:07:58.959186Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T07:59:39.580222Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09554","snapshot_observed_at":"2026-08-06T11:07:58.959186Z","title":"Understanding the performance and power of llm inferencing on edge accelerators,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23093","last_updated":"2025-07-30T20:47:22Z","snapshot_observed_at":"2026-08-09T06:35:33.639488Z","submitted_at":"2025-07-30T20:47:22Z","title":"On the Sustainability of AI Inferences in the Edge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:58.959186Z"},"links":{"cited_paper":"/paper/2506.09554","citing_paper":"/paper/2507.23093"},"observation_digest":"sha256:bf36471c7856143bc202c081748819741e2bd35b26d3a4abfdd81bee8bd7c6ef","observation_id":"09e339dd-26dd-4613-8d3b-302929859ad7","resolution":{"observed_at":"2026-08-06T11:07:58.959186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"cited_work":{"arxiv_id":"2506.09554","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09554","snapshot_observed_at":"2026-07-04T07:59:39.580222Z","title":null,"venue":null,"work_id":"134f23cf-c5ad-4315-8789-2e2dcd7ac60c","year":2025},"citing_paper":{"arxiv_id":"2606.21428","last_updated":"2026-07-09T17:35:35Z","snapshot_observed_at":"2026-08-08T09:53:30.201517Z","submitted_at":"2026-06-19T13:45:45Z","title":"Does Mixture-of-Experts Actually Help Inference on Consumer and Edge Hardware? An Empirical Study","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T12:30:55.628115Z"},"links":{"cited_paper":"/paper/2506.09554","citing_paper":"/paper/2606.21428"},"observation_digest":"sha256:a94507a5cb58d67b5e4895995942fcff71719db092cf636e4f4f0f3045408121","observation_id":"056f7926-2373-437c-93e6-ce0d485aa266","resolution":{"observed_at":"2026-07-04T07:59:39.582044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09554","snapshot_observed_at":"2026-07-12T13:05:17.273287Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21428","last_updated":"2026-07-09T17:35:35Z","snapshot_observed_at":"2026-08-08T09:53:30.201517Z","submitted_at":"2026-06-19T13:45:45Z","title":"Does Mixture-of-Experts Actually Help Inference on Consumer and Edge Hardware? An Empirical Study","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T13:05:17.273287Z"},"links":{"cited_paper":"/paper/2506.09554","citing_paper":"/paper/2606.21428"},"observation_digest":"sha256:eff220e2a62e2a30334d33aadc424610f6d0ce4eb7737671eaf354a747368e45","observation_id":"bfb30276-44c1-4ed4-866f-de8350740453","resolution":{"observed_at":"2026-07-12T13:05:17.273287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09554/citation-record","integrity":"/paper/2506.09554/integrity","json":"/paper/2506.09554/citation-record.json","paper":"/paper/2506.09554"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T04:49:03.534373Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:03.534373Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:ef8386bbbceda18edd865193ff81c5b535a7de9cb2880c0556f24ac9bc1e3b9e","observation_id":"8af69b5d-aa14-4aa8-a383-048688a79ac6","resolution":{"observed_at":"2026-08-07T04:49:03.534373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.928392Z","title":"Plug in the safety chip: Enforcing constraints for llm-driven robot agents,","venue":null,"work_id":"bf0e034f-da5a-4834-a98b-82d729e70f2b","year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:03.625036Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:4ba53e27d669cc64323557650d28a0d755c6bb4f38a32b7047fa949db7ae7a41","observation_id":"9f5b5f4c-0136-46ec-8aab-02981a2b5328","resolution":{"observed_at":"2026-08-07T04:49:06.996503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-07T04:49:03.789514Z","title":"A survey on efficient inference for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:03.789514Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:7acc3977a26e1a5ccd3a87f24c4d4b236bcc7eebc34674cbd26092f720f5bc05","observation_id":"620bec5f-18e1-4327-a0c7-fcc3e9d3281c","resolution":{"observed_at":"2026-08-07T04:49:03.789514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00136","last_updated":"2024-10-31T18:34:59Z","snapshot_observed_at":"2026-08-02T16:04:59.255519Z","submitted_at":"2024-10-31T18:34:59Z","title":"LLM-Inference-Bench: Inference Benchmarking of Large Language Models on AI Accelerators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00136","snapshot_observed_at":"2026-08-07T04:49:03.916941Z","title":"Llm-inference-bench,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:03.916941Z"},"links":{"cited_paper":"/paper/2411.00136","citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:0ecfba767b37f1f18482259e018ce9e7a5508ca2a5ab3ade8d7a515006b33697","observation_id":"89ecc77c-05b5-476d-8f20-896aca0967b4","resolution":{"observed_at":"2026-08-07T04:49:03.916941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.777089Z","title":"Characterizing the performance of accelerated jetson edge devices for training dnns,","venue":null,"work_id":"87c591d3-2cd4-4341-8687-3b18a12e446c","year":2023},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.079899Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:28f2a45a5e34f44fb4280569d90d721ce5e45e70d5722ef945c2b1d26132dca8","observation_id":"b6633e4d-7b70-499f-83b9-4d4bc9029cc4","resolution":{"observed_at":"2026-08-07T04:49:06.859489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15352","last_updated":"2024-12-19T19:38:33Z","snapshot_observed_at":"2026-08-09T10:05:50.504404Z","submitted_at":"2024-12-19T19:38:33Z","title":"Large Language Models on Small Resource-Constrained Systems: Performance Characterization, Analysis and Trade-offs","version":1},"cited_work":{"arxiv_id":"2412.15352","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15352","snapshot_observed_at":"2026-08-07T04:49:05.289918Z","title":"Large Language Models on Small Resource-Constrained Systems: Performance Characterization, Analysis and Trade-offs","venue":"cs.LG","work_id":"0116c9f6-159a-4a96-b998-def850f5e3d9","year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.191036Z"},"links":{"cited_paper":"/paper/2412.15352","citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:1d6825dc9689b3ddda29dee55085aa0698a3cc2caa905f0eb2908246071623ac","observation_id":"550cf011-0485-43ba-8ed4-d1302fef8095","resolution":{"observed_at":"2026-08-07T04:49:05.357455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.609398Z","title":"A preliminary performance analysis of llm inference on edge accelerators,","venue":null,"work_id":"2b881777-6574-4dbe-a9bb-e957482d3a46","year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.296823Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:df75debdaf38b65bc7e9cbed3f5ba41c3037f133e797b6164d393dbb98065e07","observation_id":"5952f333-940e-4bb0-8077-efa06d8ea389","resolution":{"observed_at":"2026-08-07T04:49:06.675928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.431631Z","title":"Wikitext-2,","venue":null,"work_id":"102cf50c-9ef3-4cde-89e4-8a7fecbcc37c","year":2016},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.415311Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:dd6870aa6ab26634f085e968f226d6f5585c3f9ad52f2a9f563a8e838959b735","observation_id":"90bfe4cf-22eb-4e00-989f-2a49948496f8","resolution":{"observed_at":"2026-08-07T04:49:06.518047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.242689Z","title":"Longbench,","venue":null,"work_id":"b1d3ef7d-e4d8-423d-8a21-6f6b5432004f","year":2023},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.556604Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:49fc933dae26b379ccf4e91ebd1b1b6faf1304909b29f62e9d96e06641fa3aaf","observation_id":"32235912-1aff-4d2f-b2b7-0818a9672b08","resolution":{"observed_at":"2026-08-07T04:49:06.334059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.092064Z","title":"Gpt3.int8(): 8-bit matrix multiplication for transformers at scale,","venue":null,"work_id":"b5f98bf8-bbb7-4e2c-b2d3-b9e111128c4e","year":2022},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.676505Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:368084c4c4c4128d5697560679558fd3a2829c29101efb180d5809afbf339e8c","observation_id":"37ed37ed-a5e6-4ed3-a6ea-ef8ce45a6286","resolution":{"observed_at":"2026-08-07T04:49:06.160849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18677","last_updated":"2024-05-20T15:37:36Z","snapshot_observed_at":"2026-08-10T21:29:53.476151Z","submitted_at":"2023-11-30T16:24:42Z","title":"Splitwise: Efficient generative LLM inference using phase splitting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18677","snapshot_observed_at":"2026-08-07T04:49:04.761986Z","title":"Splitwise: Efficient generative llm inference using phase splitting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.761986Z"},"links":{"cited_paper":"/paper/2311.18677","citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:73862d0fe25bdcc7b994c3894728b1520d71b997de03d816d77df97222bc265c","observation_id":"8315a6d7-71c0-4c55-ab46-ddabf1f332ec","resolution":{"observed_at":"2026-08-07T04:49:04.761986Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:05.958297Z","title":"When compared with INT4, INT8’s power savings range between 20% and 43% (median 32%)","venue":null,"work_id":"d1fafac2-6ab2-492c-a450-0783dc9b6a20","year":null},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.852213Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:e7a02873afd6903e33e78f82dbbe67a795958a9cbdc4ebf65c720067861607d0","observation_id":"0f1a1851-5edd-4ea6-b0f6-8c6664812145","resolution":{"observed_at":"2026-08-07T04:49:06.022150Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:05.802188Z","title":"Against INT4, INT8 consistently yields over 27% power savings","venue":null,"work_id":"3bb0ca65-9c51-4f26-9454-36b1fefe9f67","year":null},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.987410Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:dfd813dde8c7124ca21756e2f830ec098b525fd18e64cc85f14503faea5bdaef","observation_id":"cc80d7e8-585a-4c02-b903-569a8cb2d6b3","resolution":{"observed_at":"2026-08-07T04:49:05.886948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:05.674870Z","title":"•Energy Consumption: Similarly, INT8 achieves lower energy usage, with a median reduction of 24% compared to FP16 and 55% com- pared to INT4","venue":null,"work_id":"78753113-d5e7-44fe-b75b-7f0402ec09ef","year":null},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:05.068187Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:828947ad59d48827dc02d8649fd3e4a029cd48d3fc9f138a8882a3b59e7e03d3","observation_id":"cb242ee6-3e20-4f56-bead-44e9b01bc9a0","resolution":{"observed_at":"2026-08-07T04:49:05.737086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:05.488923Z","title":null,"venue":null,"work_id":"8f467591-8821-443a-a19c-55c170f541dc","year":null},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:05.158865Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:3c574e32ef696b9fcb88de8b5eb70a722e355e94d7d111cc6cec1ed3d4b20869","observation_id":"dfb5deec-c2a4-4ee6-b37a-dce61653e0fb","resolution":{"observed_at":"2026-08-07T04:49:05.557627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-09T01:18:42.818783Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 3 inbound Pith citation observations for arXiv:2506.09554."}