{"as_of":"2026-08-11T11:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e38ea86e9d770678c291c0c93207f484b75f43dfc5f13a2f9de40df33039e5c4","coverage":[{"denominator":90,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":90,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T05:17:24.147248Z","state":"measured"},{"denominator":90,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":90,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.11733/citation-record","integrity":"/paper/2605.11733/integrity","json":"/paper/2605.11733/citation-record.json","paper":"/paper/2605.11733"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Energy and ai","venue":null,"work_id":"b6519158-21db-48aa-b8d7-8044973a5340","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:1e8166ece761281956c62bd68d82001c037982da32520ebcafce4730e4caf020","observation_id":"7a73db7a-d303-4502-91dd-d36a7156eae8","resolution":{"observed_at":"2026-05-13T10:42:38.256594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"products/3002028","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:59:38.306018Z","title":"Analyzing artificial intelligence and data center energy consumption","venue":null,"work_id":"93bc6ea9-6fd0-42fd-8550-8af721a17a83","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:cca832452feaa969341f7904e4acb9fdca08964df9699a621c4d1b29d1b1de73","observation_id":"e7c8a8cd-0057-49ea-8fdf-4633bd4d463c","resolution":{"observed_at":"2026-05-13T05:27:19.474450Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ai factories","venue":null,"work_id":"121753c8-ee14-451a-8f6e-06301c5b0d67","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:b3c08595afb1bba27d200bddb834fa4a7126afd99fd70cdef87d46b36073d8a8","observation_id":"59e6994f-93d6-49ac-8b94-c227d1ab5fa5","resolution":{"observed_at":"2026-05-13T10:42:38.266037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ai inference","venue":null,"work_id":"e90f5798-234f-4987-b470-d2e622d7a955","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:07586e9dcc99fcc446415a31a3cb08da49afc4b814f77fa844e18befdbd0e56d","observation_id":"65031900-53f4-404e-91be-95d04483228e","resolution":{"observed_at":"2026-05-13T10:42:38.262793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Api pricing","venue":null,"work_id":"55f7e3a0-0054-4522-a4eb-0b7f8260930a","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:3d74f38cf2afefe9fbf33b6392b23502be16e8ce0ed136029d71d78b2eccacba","observation_id":"c8413658-dab2-4096-abbe-31da21207ead","resolution":{"observed_at":"2026-05-13T10:42:38.261107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Models overview and api pricing","venue":null,"work_id":"18ee44d5-90ae-4aa6-8876-25fe16e6618d","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:854749245146bce99aaa73ab182ff1f319f196599a752d615e9a8c6f66f465f0","observation_id":"3eb02857-4a97-4d6f-b3d9-222ed5b70694","resolution":{"observed_at":"2026-05-13T10:42:38.267668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Models and pricing","venue":null,"work_id":"291a4976-2b41-463c-a065-840782ddc497","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:b9eeb65fbaa6b2bd5b7f6b584f42edfdccd37f9c4ad793d582b283c104ed42c1","observation_id":"abc144d8-6bae-48b8-af45-0cba65a6be1a","resolution":{"observed_at":"2026-05-13T10:42:38.264442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3381831","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Smith, and Oren Etzioni","venue":"Communications of the ACM","work_id":"5bf4285d-1ccc-487a-91bd-29459c0a1973","year":2020},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:40b8529e945f265e04d37e1c00bc87657ae1ad7c8763c61499814ae5be578690","observation_id":"1ed037e6-6394-4445-8bbc-bd86833ecf85","resolution":{"observed_at":"2026-05-13T05:22:18.958105Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:11.219738+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:11.219738+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Patterson, J","venue":null,"work_id":"adc9c971-8ff6-40d1-ad33-cead1457cc15","year":2021},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:c08cb9c45f1839a6659c46f3875b5377a6963cc08630042c744ff4c57464e6a1","observation_id":"3100e300-11dd-44fc-808b-370644d00ca9","resolution":{"observed_at":"2026-05-13T10:42:38.258422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10350","last_updated":"2021-04-23T14:26:29Z","snapshot_observed_at":"2026-07-06T11:02:18.405330Z","submitted_at":"2021-04-21T04:44:25Z","title":"Carbon Emissions and Large Neural Network Training","version":3},"cited_work":{"arxiv_id":"2104.10350","doi":"10.48550/arxiv.2104.10350","metadata_source":"pith","pith_arxiv_id":"2104.10350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Carbon Emissions and Large Neural Network Training","venue":"cs.LG","work_id":"5cd5f484-8e24-440f-8bed-e8a801f4ac40","year":2021},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2104.10350","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:ae5177f65c5fc48f4fb4b28a72c45daf2e423f138d14111954cba34615ff04dd","observation_id":"f3c2c794-1f25-4ec4-be2c-2d9664c4ee4b","resolution":{"observed_at":"2026-05-13T05:27:19.471326Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:19.119642+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:19.119642+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.314871","doi":"10.1109/mc.2022.3148714","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Patterson, Joseph Gonzalez, Urs Hölzle, Quoc V","venue":"Computer","work_id":"8cd2a7c6-b240-4b85-9845-ddc0d9597d6a","year":2022},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:5230ceac1a6198b3cf46679e09a62f48c32af7fa533e61d8c3f3b118004032e8","observation_id":"aed7967d-58e9-4689-a0f3-615913343e5e","resolution":{"observed_at":"2026-05-13T05:22:18.956217Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00364","last_updated":"2022-01-09T19:03:39Z","snapshot_observed_at":"2026-07-06T12:03:48.844241Z","submitted_at":"2021-10-30T23:36:10Z","title":"Sustainable AI: Environmental Implications, Challenges and Opportunities","version":2},"cited_work":{"arxiv_id":"2111.00364","doi":"10.48550/arxiv.2111.00364.arxiv:2111.00364","metadata_source":"arxiv_reference","pith_arxiv_id":"2111.00364","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Sustainable ai: Environmental implications, challenges and opportunities","venue":null,"work_id":"073f0fa8-d891-4e81-b990-9a626253678b","year":2022},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2111.00364","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:d75f85bd63878eae6876a862087d38e7e618864f3b85fc3859a9613a87e14cd5","observation_id":"afbd22f0-89ec-4217-bd6a-a3e670da904b","resolution":{"observed_at":"2026-05-13T05:27:19.377263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.09700","last_updated":"2019-11-04T20:37:33Z","snapshot_observed_at":"2026-08-10T20:15:22.942936Z","submitted_at":"2019-10-21T23:57:32Z","title":"Quantifying the Carbon Emissions of Machine Learning","version":2},"cited_work":{"arxiv_id":"1910.09700","doi":"10.48550/arxiv.1910.09700","metadata_source":"pith","pith_arxiv_id":"1910.09700","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantifying the Carbon Emissions of Machine Learning","venue":"cs.CY","work_id":"7bc98d11-b344-40f2-b27f-2e08a08d1b95","year":2019},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/1910.09700","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:8bece46fc0113551455ff898b28153399807f9eb13f4ae324dc5e83d389301b6","observation_id":"a9951de1-d5e9-4da9-b36f-b287dd22bab3","resolution":{"observed_at":"2026-05-15T05:52:44.534862Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02243","last_updated":"2019-06-05T18:40:53Z","snapshot_observed_at":"2026-08-08T05:13:40.118908Z","submitted_at":"2019-06-05T18:40:53Z","title":"Energy and Policy Considerations for Deep Learning in NLP","version":1},"cited_work":{"arxiv_id":"1906.02243","doi":"10.18653/v1/p19-1355","metadata_source":"doi_reference","pith_arxiv_id":"1906.02243","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Energy and Policy Considerations for Deep Learning in NLP","venue":"cs.CL","work_id":"33ac678f-b75d-4caf-b8a6-9a4d65b1748c","year":2019},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/1906.02243","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:088ec9f440100b11b94e274cb9ec1174b521318a819eaee63340157f813bab18","observation_id":"a4439e91-1fb0-447f-8976-a97262c5ca2e","resolution":{"observed_at":"2026-05-13T05:27:19.423169Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:12.114132+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:12.114132+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0106.365854","doi":"10.1145/3630106.3658541","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Beyond Individual Accountability: (Re-)Asserting Democratic Control of AI","venue":null,"work_id":"d0b5b89e-a5fa-4fe4-ab55-8eb27c7a2418","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:a1a16c9d4f7dcabff6e5f0e0ccf527ba33633e2c92d20311f3f63f84a459a9c0","observation_id":"a23c13ff-2777-4a44-844e-764538deafcb","resolution":{"observed_at":"2026-05-13T05:22:18.951522Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mlperf inference v4.1 power results","venue":null,"work_id":"94384227-7b39-47ec-831b-8b51eb411769","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:d591025a4e3e60f34f403a01b02fca170e2e5a54e0d8a259fbe753f14f502d64","observation_id":"737134fc-2ddb-4aca-acdc-32f860e038c4","resolution":{"observed_at":"2026-05-13T10:42:38.316895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c591c641-b233-429c-95da-d4c267cb277c","year":1919},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:fc9dd3abee0ed6d8f53eca7a8e05d00b1e823ab2d569e2b7e50606a3ad112f12","observation_id":"6ec9305f-b802-4c9d-97eb-1c6e88df3d98","resolution":{"observed_at":"2026-05-13T10:42:38.318728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/1927286","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"The Review of Economics and Statistics","work_id":"2d61a078-85f3-4e2a-a64a-82d8beb9db7a","year":1961},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:22dee23744ee5c80a8ed36237b68d20bb39f604affd02b04d1ebdc67a0e84791","observation_id":"5c62286c-2475-48ab-ac45-87dcacd0e872","resolution":{"observed_at":"2026-05-13T05:22:18.953304Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 global data center survey results","venue":null,"work_id":"0d9940a9-930b-4cb2-822a-2a1e430027a0","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:63fa483ec7461b6c6f3d51fb799e0907a0dfa3e39913a7b402f365a1b2631a74","observation_id":"151263ce-1cc2-450f-9d2f-47bfc6479c14","resolution":{"observed_at":"2026-05-13T10:42:38.335016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a50a3ce3-cf46-4daf-8c99-fe6cc322abb5","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:06be800d8ad288f4309112356c00b1543a1b97f2086d4f08cc8470a89caea0de","observation_id":"6a91dd2b-00a9-4b45-ae3a-5b2db1210cb9","resolution":{"observed_at":"2026-05-13T10:42:38.315192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03003","last_updated":"2023-10-04T17:41:59Z","snapshot_observed_at":"2026-08-06T09:19:39.979327Z","submitted_at":"2023-10-04T17:41:59Z","title":"From Words to Watts: Benchmarking the Energy Costs of Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2310.03003","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.03003","snapshot_observed_at":"2026-07-04T13:29:51.008752Z","title":"From Words to Watts: Benchmarking the Energy Costs of Large Language Model Inference","venue":null,"work_id":"705958cd-22d5-4d6b-8f2b-00bf3eb75e79","year":2023},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2310.03003","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:6bb692e2b059cdb903374da22bd99f70acb4af27ccf3a7193294a3e160794dc9","observation_id":"4aa516c3-7f5c-4946-a1e1-611e2fae73ad","resolution":{"observed_at":"2026-05-13T05:27:19.429463Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.03024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T07:37:45.449592Z","title":"Tokenpowerbench: Benchmarking the power consumption of llm inference","venue":null,"work_id":"28e95255-d50b-4aab-9c76-3a8597f2c4de","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:001fb0adb464accc4e95095046af603d5bb53b66aec8ddfdaa8f77866e7f43f9","observation_id":"43f42230-32e5-4121-bbfc-fa008067d4b9","resolution":{"observed_at":"2026-05-13T05:27:19.370752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/1926047","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"year =","venue":"The Review of Economics and Statistics","work_id":"17d3cb4e-e836-48a4-86d0-27c8c17658b9","year":1957},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:5f08f7af82b7f9e11cd7d8ad5666cd2fc0a3f6a99e30c510eca5f43c338500da","observation_id":"e63ca9ad-0a31-4608-a110-f97301767b85","resolution":{"observed_at":"2026-05-13T05:22:18.939138Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-24T19:53:28.808627+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T19:53:28.808627+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8765.149878","doi":"10.1145/1498765.149878","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Roofline: An insightful visual performance model for multicore architectures","venue":null,"work_id":"d53b4029-f7d9-4dfb-83f0-f5d116d39ce1","year":2009},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:c97b7fed77921baa79c969e15248f046101385698e733acb9b41a0677caf6089","observation_id":"2abd72ed-86f1-4039-884d-cfbbd5ce43fa","resolution":{"observed_at":"2026-05-13T05:22:18.941810Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sevilla and E","venue":null,"work_id":"f64cfefb-9aba-4272-860e-5a15f3850b95","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:c03868063674f75206d55ebe7db09d1c87eaadef9cb90523610911a870bfd449","observation_id":"1d04ef3d-1e8d-4efb-b0f7-d6360198bc46","resolution":{"observed_at":"2026-05-13T10:42:38.308423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.22076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:24:18.815701Z","title":"Where do the joules go? diagnosing inference energy consumption","venue":null,"work_id":"623ba0b3-c5ee-462c-86f7-8d5811ee6aa6","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:4ef75e65bdc6e86683661fd97ee9670b0747c9301baa2c0ed91cdc8cf9afd4d1","observation_id":"09a7ce7e-3961-42b1-a95a-0deb6611faa9","resolution":{"observed_at":"2026-05-13T05:27:19.405195Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.22362","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Delavande, R","venue":null,"work_id":"666c61f9-b98f-443f-b0b2-0274c3662f20","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:48815ddd2041b3d253e4fc82272b177bd671631c8ec69799d32a3984cecf39e3","observation_id":"3fc8d1af-dbc3-4c9a-aa0f-1ed3f87e9f68","resolution":{"observed_at":"2026-05-13T05:27:19.385538Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ad817ac8-1125-49e0-b174-eb1bf0140ff6","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:753e5d2bd9d89a7ff31a167df4c05bbc78ebeac197f5d94da43660cdd3153492","observation_id":"c2341ae7-b72c-4f56-8704-ec472cc048a8","resolution":{"observed_at":"2026-05-13T10:42:38.306607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.05695","last_updated":"2026-02-23T09:49:19Z","snapshot_observed_at":"2026-08-11T00:04:31.847500Z","submitted_at":"2026-02-05T14:21:00Z","title":"SweetSpot: An Analytical Model for Predicting Energy Efficiency of LLM Inference","version":2},"cited_work":{"arxiv_id":"2602.05695","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.05695","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SweetSpot: An Analytical Model for Predicting Energy Efficiency of LLM Inference","venue":"cs.AI","work_id":"24ce845b-e574-4543-8360-306e969bcc4b","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2602.05695","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:0213ac5fdc1b2f6bf365f121715b4e7850f069f4c19a69bc43a94954ef397a60","observation_id":"764826af-88f7-4541-9c57-1109151e9968","resolution":{"observed_at":"2026-05-13T05:27:19.426549Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nvidia h100 tensor core gpu: Product specifications","venue":null,"work_id":"c6fd5493-1b5f-4314-9427-fa34ee134285","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:a391a7e2b41eb56f1d06d7f14b573ed21fd4d278c1a2f575f90d4928d73e0037","observation_id":"b9f2525e-f157-4293-952e-b01d9941666b","resolution":{"observed_at":"2026-05-13T10:42:38.326162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nvidia hgx platform specifications (hgx h100 4/8-gpu)","venue":null,"work_id":"eb5a68f7-4fe2-439d-8d89-558ca68eaf4c","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:2453071db30efe13392de1c6c8e0bbde588a82a03aa54fdb9bdd52323c578774","observation_id":"80194f8c-23f1-4b99-a49d-ff4472ae8a6c","resolution":{"observed_at":"2026-05-13T10:42:38.310045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ai is set to drive surging electricity demand from data centres while offering the potential to transform how the energy sector works","venue":null,"work_id":"0978373b-9156-4a76-9a40-6e7c4e40db5f","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:4ddf158d9b4471326e2a7caf35c4daedc3736ccfefceba0d5126d5f977578116","observation_id":"e9814d3a-fe80-422c-9e88-92fbb81094ad","resolution":{"observed_at":"2026-05-13T10:42:38.311882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":"2405.04434","doi":"10.1145/3593013.3594097","metadata_source":"pith","pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","venue":"cs.CL","work_id":"1e1df141-cac8-47fd-b068-c4c96e51e331","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:cdfb1a4555909ecf0cbdb1802feeacea9d66dc8d3dba232f72297035e5b3ce0a","observation_id":"e393c692-bbe8-4c5c-8255-b43f386acac6","resolution":{"observed_at":"2026-05-13T05:27:19.459368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:7eb4c1e3e807dea68f95b503178f72f78c17efcf50f57175a050af4a65a4d2de","observation_id":"887a3b89-ba09-42f8-ba38-80b15edebb73","resolution":{"observed_at":"2026-05-13T05:27:19.374193Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":"2203.15556","doi":"10.1098/rsta.2024.0522","metadata_source":"pith","pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Compute-Optimal Large Language Models","venue":"cs.CL","work_id":"b2faf28d-86b7-429c-bc42-469458efc246","year":2022},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:8351fa7d2924e7bbd7d3d772a486ad91fbd26006e44d33d6a6979b53596ecb0e","observation_id":"fac672f3-b55f-459f-978d-a4836d507c14","resolution":{"observed_at":"2026-05-13T05:27:19.379963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-08-09T14:52:01.161814Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:70b84456bdcc6449f94d9148c607bfb879ca158ebd843873a2722ca20b9e5fa0","observation_id":"5f58ee32-16b0-476e-982b-abfdc488ba72","resolution":{"observed_at":"2026-05-13T05:27:19.462039Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.05924","last_updated":"2022-03-09T19:30:21Z","snapshot_observed_at":"2026-08-09T08:38:16.446867Z","submitted_at":"2022-02-11T22:42:47Z","title":"Compute Trends Across Three Eras of Machine Learning","version":2},"cited_work":{"arxiv_id":"2202.05924","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2202.05924","snapshot_observed_at":"2026-06-30T14:24:44.951321Z","title":"Compute trends across three eras of machine learning.arXiv preprint arXiv:2202.05924","venue":null,"work_id":"cf925085-5785-4755-88d9-12277212b001","year":2022},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2202.05924","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:e55830b2c1ae324ba16f3e985ae19d12e14a3edbe76b3f441a02c4627d7f3894","observation_id":"8f64c5a3-b694-43df-bffc-e9a8aa97715a","resolution":{"observed_at":"2026-05-13T05:27:19.440978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14135","last_updated":"2022-06-23T17:53:32Z","snapshot_observed_at":"2026-07-06T13:14:48.753329Z","submitted_at":"2022-05-27T17:53:09Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness","version":2},"cited_work":{"arxiv_id":"2205.14135","doi":"10.48550/arxiv.2205.14135","metadata_source":"pith","pith_arxiv_id":"2205.14135","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness","venue":"cs.LG","work_id":"efa96825-0830-4cfc-a250-fdaf6af302ab","year":2022},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2205.14135","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:379cfa1d1ab29713a4fd220ae509c81b90ed53deccae3a523dcbced65db32605","observation_id":"0b81757e-f4b6-4e93-aaac-d9715733017e","resolution":{"observed_at":"2026-05-13T05:27:19.443530Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:18.534404+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:18.534404+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":"2309.06180","doi":"10.18653/v1/2024.emnlp-main.20","metadata_source":"pith","pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","venue":"cs.LG","work_id":"0eb5eca2-2c11-4a77-a25a-18c331a50ed2","year":2023},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:37df06a803bb9487b94716b7c80846acafbad521a67c06a1ced7e328c4464b93","observation_id":"2f701fc2-3453-4ce1-866f-64a16063b7a8","resolution":{"observed_at":"2026-05-13T05:27:19.432534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":"2210.17323","doi":"10.48550/arxiv.2210.17323","metadata_source":"pith","pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","venue":"cs.LG","work_id":"19ed8c44-202a-48f6-8169-637d5a5f2408","year":2022},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:759ce23557a41e8ce4516738c7bccd6f0b88eb259d35024c1ffb23ce98afb075","observation_id":"a3e9881c-8adc-485a-bdd0-b99f88ce3ad2","resolution":{"observed_at":"2026-05-13T05:27:19.435378Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:22:03.028003+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:22:03.028003+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":"2306.00978","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-07-10T11:17:03.640788Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","venue":"cs.CL","work_id":"ea9d1d72-db24-4cae-8c89-4ecd83dd87c1","year":2023},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:72f91cfacf0adefeace215cf38a2c51fe11aceecda75bc759b174c13bf9cf3ed","observation_id":"a23779db-e224-46f5-85ce-f55102be1db0","resolution":{"observed_at":"2026-05-13T05:27:19.438188Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03687","last_updated":"2023-12-01T15:37:07Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T03:25:56Z","title":"Dissecting the Runtime Performance of the Training, Fine-tuning, and Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2311.03687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.03687","snapshot_observed_at":"2026-06-30T16:35:12.203073Z","title":"Available: https://arxiv.org/abs/2311.03687","venue":null,"work_id":"cfa800d6-e4b7-46e1-9298-943941363714","year":2023},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2311.03687","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:15854c73bf17f6a58aae09b1d38390d3b9a937f8efdbde670327fdff06e7bb70","observation_id":"3e686972-1574-4ea8-b1f7-8c2c52cb941c","resolution":{"observed_at":"2026-05-13T05:27:19.391042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:46.776388Z","title":"Knowledge-Centric Hallucination Detection","venue":null,"work_id":"557a574b-31bd-4f07-9bd0-47bc7c74bcd8","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:f40a903f4f483bb045965deac205a36363a62c8917331af45c7270441c27572e","observation_id":"e9a4404b-f545-4a68-931a-16742e93f134","resolution":{"observed_at":"2026-05-13T05:22:18.947071Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:47.367793+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:47.367793+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Department of Energy","venue":null,"work_id":"98d73367-7b92-447b-bdfc-b160d1d8a602","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:682bfc1c22a18f0c6e9d5917830fce03e271e14b2e83d0416ca7891402078765","observation_id":"2571e0da-c795-4886-88f8-afc45f61a3fd","resolution":{"observed_at":"2026-05-13T10:42:38.320296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Juniewicz","venue":null,"work_id":"718fa817-1812-4378-a6be-338b44f98b2e","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:64176c7f5bfd30a783b17afe62ba135829c1ca36175dc9bea538e344e4eb040c","observation_id":"30530823-64d3-434e-8c6f-bc0a82584b13","resolution":{"observed_at":"2026-05-13T10:42:38.301279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Combined Alphabet, Amazon, Meta, Microsoft, and Oracle capex extracted from SEC EDGAR 10-Q/10-K filings","venue":null,"work_id":"1364d4c9-ebfa-48f7-a88e-472b566e8742","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:75b2b086b0fb8c6161f801c535e51f7c038ac855d7d7c1d4c765246bd5d83beb","observation_id":"33fcbdba-9968-4a3b-9ca4-83579d06d6b6","resolution":{"observed_at":"2026-05-13T10:42:38.304987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c137a2e4-b85d-4859-aa62-699c4bcef586","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:6343c1fa673ded6dcdc84f100c14d1911ea0091e24ca0552008c8481d499ae3a","observation_id":"84ffc216-3f1d-4350-880c-c91fa5fab685","resolution":{"observed_at":"2026-05-13T10:42:38.291342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Doubao surpasses 120 trillion daily tokens as usage doubles in three months","venue":null,"work_id":"4d2d0db9-8f97-4ca4-90fd-65492037be32","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:415d841b1dff782be0775c0e3109765607b860880a61bf57ae829378075624bf","observation_id":"549c7c84-6409-4fcc-94b8-e72a251695aa","resolution":{"observed_at":"2026-05-13T10:42:38.293780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6585.216588","doi":"10.1145/216585.216588","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wulf and Sally A","venue":"ACM SIGARCH Computer Architecture News","work_id":"59800c89-ee5f-41ed-b9bc-1041383cba0c","year":1995},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:0c378332660f38418ac5baf284de38fdb05aaa38fa4ec0f89e4456df7354d6c2","observation_id":"bcc33e17-4d56-4a2e-b0a2-a3b3c07011bd","resolution":{"observed_at":"2026-05-13T05:22:18.944786Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-23T17:24:31.588709+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T17:24:31.588709+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-07T14:17:15.942844Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"cited_work":{"arxiv_id":"2502.11089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.11089","snapshot_observed_at":"2026-07-10T01:36:44.142264Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","venue":"cs.CL","work_id":"c74d35ec-94d3-48f5-a291-20cfad7c04a3","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2502.11089","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:a0c74796fc5a01d69cc6a22a3f760859e125961024cd62d8fb1b000a15fc9352","observation_id":"c3c6545e-a9d3-46d8-8c8f-78df0d022980","resolution":{"observed_at":"2026-05-16T23:46:30.294205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence","venue":null,"work_id":"b08a48b3-791d-4f4a-94b5-23a4086c1964","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:4e11a1590f0555d5e381c559873c73f127557517126f1d2607e796c2e069ee59","observation_id":"71187678-6832-414d-baf3-55c3763a22ad","resolution":{"observed_at":"2026-05-13T10:42:38.289661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.00299","doi":"10.48550/arxiv.2502.00299","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chunkkv: Semantic-preserving KV cache compression for efficient long-context LLM inference","venue":"ArXiv.org","work_id":"fa935769-1d44-441f-9bac-780428c056d9","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:6efe0465136a844074406893fe221a52cbbf44ca0500a65b85b8dd117cc483fb","observation_id":"eae5b671-f73b-47f5-a380-eab60f7249a2","resolution":{"observed_at":"2026-05-13T05:27:19.417404Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:17.31981+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:17.31981+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14048","last_updated":"2023-12-18T19:10:00Z","snapshot_observed_at":"2026-08-06T19:19:02.165567Z","submitted_at":"2023-06-24T20:11:14Z","title":"H$_2$O: Heavy-Hitter Oracle for Efficient Generative Inference of Large Language Models","version":3},"cited_work":{"arxiv_id":"2306.14048","doi":"10.48550/arxiv.2306.14048","metadata_source":"pith","pith_arxiv_id":"2306.14048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"H$_2$O: Heavy-Hitter Oracle for Efficient Generative Inference of Large Language Models","venue":"cs.LG","work_id":"1ee58eaa-8aa0-4dec-8e67-6e079ad5fc13","year":2023},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2306.14048","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:5ddb064951afd6ac1f2beabf42c08011fa1410b9a5d21fcd2c58646c7c189de8","observation_id":"8da5e788-22d0-48ef-a47e-460901d27162","resolution":{"observed_at":"2026-05-17T18:00:50.699870Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.15347","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:13:48.417577Z","title":"FlowKV: Enhancing multi-turn conversational coherence in LLMs via isolated key-value cache management","venue":null,"work_id":"52fb9034-d14f-4aba-aefd-62381449489c","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:c95953382010378ce7e6916dcd561a24fee9b6f359c0f02e2c783ab5af5178df","observation_id":"82cc6781-1167-4e40-b11c-4477ac3a65d7","resolution":{"observed_at":"2026-05-13T05:27:19.402283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semantic integrity matters: Benchmarking and preserving high-density reasoning in KV cache compression","venue":null,"work_id":"353ed190-abd2-44fa-bcee-5487e8aac1d0","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:42598f666d6c94679e7c22450bddc4fb8dfdf6ca6490c1e5ffd8b2eb3da69f13","observation_id":"144f0371-1b6e-452a-9c2e-22af451bcb4b","resolution":{"observed_at":"2026-05-13T10:42:38.327931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01941","last_updated":"2026-05-12T08:04:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T02:23:06Z","title":"Semantic Integrity Matters: Benchmarking and Preserving High-Density Reasoning in KV Cache Compression","version":4},"cited_work":{"arxiv_id":"2502.01941","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.01941","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semantic Integrity Matters: Benchmarking and Preserving High-Density Reasoning in KV Cache Compression","venue":"cs.CL","work_id":"fa43241a-925b-4dbc-b53a-8dd90b62c174","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2502.01941","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:a072725ef26fcd35be73500e412a6a361dbbcc7082fe7d61c918a1108123df95","observation_id":"e96c7aaf-e00f-42ae-aac4-f8733be98775","resolution":{"observed_at":"2026-05-13T05:27:19.414579Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.21927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:13:48.420250Z","title":"SONIC: Segmented optimized nexus for information compression in key-value caching","venue":null,"work_id":"ae9f2892-f765-4bd9-8acd-d1cc1696bfb1","year":2021},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:cd48e44a95af7d0a35226b42ec50946e1aac9bafdcbf461c9bd31617242e1af3","observation_id":"b4a0c4d9-93e4-47e7-bd0b-efabd9260bc0","resolution":{"observed_at":"2026-05-13T05:27:19.411568Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T15:57:06.365547Z","title":"AnTKV: Anchor token-aware sub-bit vector quantization for KV cache in large language models","venue":null,"work_id":"7ea35a96-a66d-4efe-8d82-a8b54be0735a","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:e8ccbd9c8a482a1af0ad2c5e52ea4f57dbfd15900a7888b1ac65e433be915fa6","observation_id":"d4b9d3f2-7d38-4e1d-a234-191f236f2afb","resolution":{"observed_at":"2026-05-13T05:27:19.382778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ora- cleKV: Oracle guidance for question-independent KV cache eviction","venue":null,"work_id":"550426e6-afc9-495e-9b5d-2fc095193c62","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:f822a6aaf9d4be415b3acb5ddc342b85fd88eb5d69281ca19a99e787242716ce","observation_id":"b4966c3c-fa63-459c-920f-018492c9da66","resolution":{"observed_at":"2026-05-13T10:42:38.286144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06865","last_updated":"2023-06-12T07:48:53Z","snapshot_observed_at":"2026-08-06T08:43:40.051791Z","submitted_at":"2023-03-13T05:19:28Z","title":"FlexGen: High-Throughput Generative Inference of Large Language Models with a Single GPU","version":2},"cited_work":{"arxiv_id":"2303.06865","doi":"10.48550/arxiv.2303.06865","metadata_source":"pith","pith_arxiv_id":"2303.06865","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Y ., Xie, Z., Chen, B., Barrett, C., Gonzalez, J","venue":"cs.LG","work_id":"c99785d7-2d72-4d2f-8363-f4db53cf669f","year":2023},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2303.06865","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:75897d58d6ea7f129026aace5caa5eaf7545846fe176635d6a3aba54c184626a","observation_id":"7da1e05c-8151-459e-b767-4162b988f6b2","resolution":{"observed_at":"2026-05-13T05:27:19.393998Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08313","last_updated":"2025-01-14T18:50:05Z","snapshot_observed_at":"2026-07-06T20:21:04.675084Z","submitted_at":"2025-01-14T18:50:05Z","title":"MiniMax-01: Scaling Foundation Models with Lightning Attention","version":1},"cited_work":{"arxiv_id":"2501.08313","doi":"10.48550/arxiv.2501.08313","metadata_source":"pith","pith_arxiv_id":"2501.08313","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MiniMax-01: Scaling Foundation Models with Lightning Attention","venue":"cs.CL","work_id":"137e6ed4-1c1d-40bd-801e-9d2baea0bd0c","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2501.08313","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:8e6db47ff4ab0b3298f19c082023f285837666fa29e895da5cbd041e424ad90a","observation_id":"f588b8c9-2806-4213-be57-769b4169f552","resolution":{"observed_at":"2026-05-16T06:26:38.921226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.19669","last_updated":"2026-05-08T14:25:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-22T15:16:06Z","title":"DiffAdapt: Difficulty-Adaptive Reasoning for Token-Efficient LLM Inference","version":5},"cited_work":{"arxiv_id":"2510.19669","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.19669","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DiffAdapt: Difficulty-Adaptive Reasoning for Token-Efficient LLM Inference","venue":"cs.CL","work_id":"ed3ec811-09ae-415c-83b0-09f34d048725","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2510.19669","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:b09273f0aef8ed910df1c756a54d39996064d7d088b321e82bb67838feec9ed6","observation_id":"dda5657e-3b70-4bed-80c1-a5d67aae9bfb","resolution":{"observed_at":"2026-05-13T05:27:19.396706Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.18672","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasoning language model inference serving unveiled: An empirical study","venue":null,"work_id":"d24ee86b-106a-4314-9126-1bfbb0d7495e","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:9b4e86530c2067a9236d60e078b661948e34295dd9308d91caf33c4c616353ae","observation_id":"1a22711f-598c-4884-8ed0-da478d025ca1","resolution":{"observed_at":"2026-05-13T05:27:19.452420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19433","last_updated":"2025-06-01T13:59:15Z","snapshot_observed_at":"2026-08-10T22:13:53.139013Z","submitted_at":"2025-05-26T02:49:07Z","title":"Can Compressed LLMs Truly Act? An Empirical Evaluation of Agentic Capabilities in LLM Compression","version":2},"cited_work":{"arxiv_id":"2505.19433","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19433","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yiming Du, Wenyu Huang, Danna Zheng, Zhaowei Wang, Sebastien Montella, Mirella Lapata, Kam-Fai Wong, and Jeff Z","venue":null,"work_id":"7c719954-9816-4985-9ab2-9887d040198d","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2505.19433","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:307f21987a8e7692839ef999272bd25d4e57d163bab4f842ce22458dfc2fc27f","observation_id":"b1569d95-b7d3-46cd-a1f4-4c604567c0b5","resolution":{"observed_at":"2026-05-13T05:27:19.388471Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17535","last_updated":"2025-02-24T15:39:35Z","snapshot_observed_at":"2026-08-07T17:52:56.317632Z","submitted_at":"2025-02-24T15:39:35Z","title":"The Lottery LLM Hypothesis, Rethinking What Abilities Should LLM Compression Preserve?","version":1},"cited_work":{"arxiv_id":"2502.17535","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.17535","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The lottery LLM hypothesis, rethinking what abilities should LLM compression preserve? In ICLR Blogposts Track","venue":null,"work_id":"0c0bc6c7-277b-49dd-9d0b-e71c15b0ee81","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2502.17535","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:c70ec9cd0b7cde4d68936ae74f331dbb78a980fb57bb0627da4fe096ee8214d9","observation_id":"f675fd1b-1e3a-492e-b43d-f020615ca2fd","resolution":{"observed_at":"2026-05-13T05:27:19.449599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"gov.cn/2025012","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"National energy administration releases 2024 national electric power industry statistics","venue":null,"work_id":"ecea65be-6096-41ab-b7f8-a36005ff1e77","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:72331fb2217cd40d70df1cd29b44127d6e5878af3486d2ff25658fa41c0bdb78","observation_id":"9ea6e8d6-eb6d-4ad0-aed5-d423ab23e1a9","resolution":{"observed_at":"2026-05-13T05:27:19.446585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpretation of the work plan for stabilizing growth in the power equipment industry (2025–2026)","venue":null,"work_id":"c44723af-bf63-44e0-8a2d-b9b575204772","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:e2016a78c6ce2836bd1b876ce1a697e477bad23c5bb78b7766f74a734bfdbed9","observation_id":"825fa77b-7f25-41f0-9330-dcdc7a6a920e","resolution":{"observed_at":"2026-05-13T10:42:38.287945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Launch of second data centre – call for application","venue":null,"work_id":"928e3609-99b3-4368-a6fc-9c5a92c96703","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:7be1f97f03c7a06d365abeb419657f10a08baceee3983be01f4bf0a1c83672b0","observation_id":"81faf1a9-83b0-47b2-8e8b-48b59fb2958b","resolution":{"observed_at":"2026-05-13T10:42:38.295654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"State of ai: token-usage rankings, q1 2026","venue":null,"work_id":"73cdac3c-9454-4776-b99c-43d5fe38725a","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:de28d53b4467392b95ff5f1f31f4b223195641df6769638ff45486ea1619d1fb","observation_id":"7e899b80-7d62-45b7-8e4c-b2c713540033","resolution":{"observed_at":"2026-05-13T10:42:38.297414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 ai index report: Ai model performance gaps narrowing, compute costs plummeting","venue":null,"work_id":"f552397b-07f2-4189-9aef-d3a541e753bf","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:1c4ec4a425245ccfa02e6d4b11a8ca31cffac319260866a0a88118daf96beefd","observation_id":"036b269c-7875-4501-8d4a-595be0548bff","resolution":{"observed_at":"2026-05-13T10:42:38.303034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05558","last_updated":"2022-07-27T17:26:18Z","snapshot_observed_at":"2026-08-09T15:45:49.951754Z","submitted_at":"2020-07-10T18:26:17Z","title":"The Computational Limits of Deep Learning","version":2},"cited_work":{"arxiv_id":"2007.05558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05558","snapshot_observed_at":"2026-07-03T15:28:33.717389Z","title":"and Manso, G.F","venue":null,"work_id":"51dd45a4-6247-4e57-baac-e78856de99cf","year":2007},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2007.05558","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:857757699865cb5398e17ad7bfda9de61684647ec8eb52ed4bfeb256dfb0a781","observation_id":"2441701d-2c7f-4d98-aa6a-46c32420ff9f","resolution":{"observed_at":"2026-05-13T05:27:19.408590Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"58791d58-919a-4826-b92f-d89bf45f39d1","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:04ba44c541bdd8904039b8d95bd8b76d875daf6115c21c02957f237c16e881c0","observation_id":"c92b5f69-69d9-45d5-a68b-90612a8f6dc0","resolution":{"observed_at":"2026-05-13T10:42:38.281654Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.enpol.2008.12.003","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Energy Policy","work_id":"ddbd492d-1063-4342-ada4-d5a6ff7f4bc6","year":2009},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:7e172b106c137b57a02d496884c5f6174f473a4843844eb6c0aadfe8006772a9","observation_id":"f1574f00-b03b-4bea-83b9-52e8b12f229f","resolution":{"observed_at":"2026-05-13T05:22:18.948887Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Appenzeller","venue":null,"work_id":"7c5f8905-071a-490c-b944-e801798ae380","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:8b88bbe0be5b1a753d048c7a279043b5451b5c0b12df3e1aca0aa28a7dd8071c","observation_id":"45d5564e-0640-4913-88ed-e0f3fe9f68d1","resolution":{"observed_at":"2026-05-13T10:42:38.279994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Demirer, A","venue":null,"work_id":"add17baf-8a74-4c50-9437-a7f6568e7ed6","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:e0b1ce8bc6a4f19c6ae034f9e4bc19dd0d9b5c63e833095bf5054d64e5c359c0","observation_id":"9b62728c-52c2-4fb1-bab5-b8800a554e29","resolution":{"observed_at":"2026-05-13T10:42:38.274692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"NBER Working Paper No","venue":null,"work_id":"73d1450b-beb9-480b-9935-ce948b5f1feb","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:f2dc49e5f725a8d8de8880f8261f7e924d94ad50fae7ec75d038900846f58ac2","observation_id":"a91901e4-55e7-4dd5-b0ea-fc2878c00f4d","resolution":{"observed_at":"2026-05-13T10:42:38.278276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High cost of energy: industrial electricity prices in the eu vs the us and china","venue":null,"work_id":"34503bea-c762-4186-aee1-333d6627e620","year":2024},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:106c38310b4b14d8969f0141010affbe1a87b5a089b4fcaa160532056911b37b","observation_id":"b9b728c0-b2d7-4a30-a405-19788b75a303","resolution":{"observed_at":"2026-05-13T10:42:38.271272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shapiro and H","venue":null,"work_id":"c32b5ad0-df4c-4524-9718-eefe7cc67d35","year":1999},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:41d2012deca2c1d1d9535ebfcb965587e0f1978419955c1791d34b303335ca17","observation_id":"0b25e718-7e18-489b-8736-f06b0272f5ca","resolution":{"observed_at":"2026-05-13T10:42:38.269493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Energy Information Administration","venue":null,"work_id":"5e63cf11-7192-41ec-9ceb-caba30c8d6c0","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:e229d9b26675be44ad68f2a941a7978c11f23f40c85a863e0c92a50bfbfbea34","observation_id":"2e92250a-11c9-4675-af0c-0d2b6e083be8","resolution":{"observed_at":"2026-05-13T10:42:38.329812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d6f154c6-ec5d-4205-8326-17456c953d2d","year":2021},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:05098e244f5807c6b9677148a71e3d90aa069358f9395b16ebb8dde911b4e551","observation_id":"7af78cb9-78c5-4bc4-9f5e-3e1fc3bce3b1","resolution":{"observed_at":"2026-05-13T10:42:38.272931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.04325","last_updated":"2024-06-04T22:09:46Z","snapshot_observed_at":"2026-08-10T19:38:52.738573Z","submitted_at":"2022-10-26T00:28:40Z","title":"Will we run out of data? Limits of LLM scaling based on human-generated data","version":2},"cited_work":{"arxiv_id":"2211.04325","doi":"10.48550/arxiv.2211.04325","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.04325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Will we run out of data? limits of llm scaling based on human-generated data","venue":"arXiv (Cornell University)","work_id":"e9ffc77d-3e81-4a7f-9861-704f9accb1db","year":2025},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"cited_paper":"/paper/2211.04325","citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:522d9dbeddcb3933bee1b75f9e75bc99fea5bdd5b8ec95a14eb4df97851ad5ce","observation_id":"d814c45a-47fa-4772-96d6-058b6c4d1100","resolution":{"observed_at":"2026-05-13T05:27:19.456297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xiaomi mimo api open platform","venue":null,"work_id":"35d1e95c-d678-4899-afac-b8409a581bb9","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:acaa8b2e0063dcde41b0a191f93aac894feb1db2c426daf4a589aa7659f9eb93","observation_id":"05cba738-48f0-475c-a26a-2ce8ea5c1a3f","resolution":{"observed_at":"2026-05-13T10:42:38.276397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Z.ai developer documentation: pricing overview","venue":null,"work_id":"4c8f563a-e8c5-4932-836d-5851f21e4159","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:2670f9e11b48710ee9fc33582615dd9cb92d98b2cdf1f0f99e995d8008cc7f07","observation_id":"3c766683-cab9-4fb3-8f3e-daa4f1a2e932","resolution":{"observed_at":"2026-05-13T10:42:38.284278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kimi api platform: model inference pricing","venue":null,"work_id":"bb0366bc-5c8f-432c-8dbb-0d3a53482a8c","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:f6896dc6715e2156e1b74c50e27d1a6d70228ef617b56877bd421810da3adb3f","observation_id":"06226aa9-3c97-43a9-ad4b-257d88340173","resolution":{"observed_at":"2026-05-13T10:42:38.324370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"how cheaply can we generate tokens?","venue":null,"work_id":"de5a4d54-737b-45d9-b432-0d08e320eb94","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:0574bcf9af1e15cb6726c4760a4376c8d873638a1650fc4079ac2d31db3f5f89","observation_id":"3ef06c40-6fd2-4cc1-a3f1-cb4dcbbf4e2d","resolution":{"observed_at":"2026-05-13T10:42:38.313488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3c41cb82-ebab-4695-b9aa-2eed7e4e404b","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:c235644814eeafd4ab6b15c62f8fe2191c7a34b40e046ae6abef5dc0c03c5b61","observation_id":"3b2a94ca-a9fa-48fb-a1b4-4ae46ae886c2","resolution":{"observed_at":"2026-05-13T10:42:38.299124Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"16649151-8219-44dd-848f-5e88156082d2","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:72e1674c77cf3926f41daa494ad1044a1a6cb6a579caa23da81f4619d893c7ad","observation_id":"5a04bb42-8e1e-4c0b-a289-17aa1b982c89","resolution":{"observed_at":"2026-05-13T10:42:38.322063Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b47e3e09-179b-4b27-b556-61b0a1fd4c9b","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:c47365431a575b492762748aa4f1ecb554c1fdd7511f7f137c2c6676b1a88bab","observation_id":"9d290c00-853b-4560-98a3-75d85a14933f","resolution":{"observed_at":"2026-05-13T10:42:38.336780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e4aa402e-1610-4207-9dd9-23ec64a336e4","year":null},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:c2c0869494271d15464b459a4c2de052a8f16914a5eb89ca4d855a25ddc13b7c","observation_id":"7c383df8-8411-4b3a-bb17-48d9154860b4","resolution":{"observed_at":"2026-05-13T10:42:38.333218Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7fbc29ba-6168-486c-a568-7d60ab6b1003","year":2026},"citing_paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-13T05:17:24.147248Z"},"links":{"citing_paper":"/paper/2605.11733"},"observation_digest":"sha256:a348e3da01878beea85f345ce92c204108bb05bfe14d013e8fac5eb5dcdcb6fb","observation_id":"f1958883-a74c-4df5-960d-938f8af83ef7","resolution":{"observed_at":"2026-05-13T10:42:38.331595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.11733","last_updated":"2026-05-12T08:15:04Z","latest_version":1,"primary_category":"cs.CE","snapshot_observed_at":"2026-08-11T00:49:18.863078Z","submitted_at":"2026-05-12T08:15:04Z","title":"Position: LLM Inference Should Be Evaluated as Energy-to-Token Production"},"reference_resolution":{"displayed":90,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":11,"verified_exact":41,"verified_fuzzy":34},"total_outbound_references":90},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 90 of 90 outbound references and 0 inbound Pith citation observations for arXiv:2605.11733."}