{"as_of":"2026-08-10T02:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d7c13d59a6bbed1e0baa9cd9826169c37ef6f86016a709b5c77b5eeefd199a0f","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T13:11:43.364222Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.26571/citation-record","integrity":"/paper/2607.26571/integrity","json":"/paper/2607.26571/citation-record.json","paper":"/paper/2607.26571"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:38.828356Z","title":"Strubell, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:38.828356Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:a2f814d868faa342b0bea3ecc5d74315d9e62c4c17f9ae3fd018a19e53e93ccd","observation_id":"1907ed8a-b135-4683-8189-671584ad812f","resolution":{"observed_at":"2026-08-01T13:11:38.828356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:38.924744Z","title":"Schwartz, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:38.924744Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:7bd11b231733814cb8a10ca4bf9409f6cc1829778661687e6f86e916b7d98fed","observation_id":"197ccdfc-a6ac-4508-9ddc-17a7131e98a0","resolution":{"observed_at":"2026-08-01T13:11:38.924744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10350","last_updated":"2021-04-23T14:26:29Z","snapshot_observed_at":"2026-07-06T11:02:18.405330Z","submitted_at":"2021-04-21T04:44:25Z","title":"Carbon Emissions and Large Neural Network Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10350","snapshot_observed_at":"2026-08-01T13:11:39.074788Z","title":"Patterson, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:39.074788Z"},"links":{"cited_paper":"/paper/2104.10350","citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:c1620ed92f0b48b03030ffcc29d00987c20f700add6975df50497805803c68b1","observation_id":"e2df4670-7574-4c22-ba9e-c7fa4f3017d7","resolution":{"observed_at":"2026-08-01T13:11:39.074788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:39.164934Z","title":"Henderson, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:39.164934Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:7f70f6629ea5d37c302ea8ce70e1dabcf7762b3ad15a74c044c236fb732433e7","observation_id":"aba33990-4011-437d-a734-d5a4a069ec81","resolution":{"observed_at":"2026-08-01T13:11:39.164934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.09700","last_updated":"2019-11-04T20:37:33Z","snapshot_observed_at":"2026-07-06T08:31:12.309726Z","submitted_at":"2019-10-21T23:57:32Z","title":"Quantifying the Carbon Emissions of Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.09700","snapshot_observed_at":"2026-08-01T13:11:39.210966Z","title":"Lacoste, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:39.210966Z"},"links":{"cited_paper":"/paper/1910.09700","citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:2f51ba25887008a9d485222d0b45ded51df7c40328d35a544b9a93277252a396","observation_id":"9875c7d6-8bd2-4588-88a0-c627ef02a8d9","resolution":{"observed_at":"2026-08-01T13:11:39.210966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:39.354754Z","title":"Lannelongue, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:39.354754Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:bc8dc18891136e9d86612f84833b291118bd13760df8cc59d7b382b3ba0572c6","observation_id":"f4400b4d-d141-49e6-b735-ad0d2d063303","resolution":{"observed_at":"2026-08-01T13:11:39.354754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.01468","last_updated":"2025-05-02T05:59:21Z","snapshot_observed_at":"2026-08-08T17:16:27.379951Z","submitted_at":"2025-05-02T05:59:21Z","title":"One Search Fits All: Pareto-Optimal Eco-Friendly Model Selection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.01468","snapshot_observed_at":"2026-08-01T13:11:39.424832Z","title":"Betello, V","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:39.424832Z"},"links":{"cited_paper":"/paper/2505.01468","citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:8b6332df951fff6d1dbdae82aa385527a376280a9eec81501d934d07cce5f95b","observation_id":"334630c7-b30d-4517-83de-2caea634cdaa","resolution":{"observed_at":"2026-08-01T13:11:39.424832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:39.564911Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:39.564911Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:843736c67613f7eb7c68d06b0534f3e8745fa18d721e5dce3177206215c11648","observation_id":"85b24631-cdc6-483d-a483-d074ba1945f3","resolution":{"observed_at":"2026-08-01T13:11:39.564911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:39.705148Z","title":"Fernandez, C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:39.705148Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:916c4b189db28651cd3fc83129639743c5d4e8bf65fd52eef25b05a5ff3d80d2","observation_id":"9c1c2b3e-e535-4397-9ef7-f56678564854","resolution":{"observed_at":"2026-08-01T13:11:39.705148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02950","last_updated":"2024-10-03T19:48:45Z","snapshot_observed_at":"2026-07-06T19:27:20.458797Z","submitted_at":"2024-10-03T19:48:45Z","title":"LLMCO2: Advancing Accurate Carbon Footprint Prediction for LLM Inferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02950","snapshot_observed_at":"2026-08-01T13:11:39.805738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:39.805738Z"},"links":{"cited_paper":"/paper/2410.02950","citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:58b153ad6d2fb40342cf35803fc298eda6810dd3d7c142a81e0c5211b2357cbe","observation_id":"cd893533-dcdf-4a32-8ac7-93c4939e9ffb","resolution":{"observed_at":"2026-08-01T13:11:39.805738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:39.895262Z","title":"Vartziotis, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:39.895262Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:7cc332d9903d85199bc6a1cd327f76a069b06ec471344c2763f25d3ac560bae2","observation_id":"52743d14-4fb2-4e13-92d6-320c175b7c9d","resolution":{"observed_at":"2026-08-01T13:11:39.895262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:40.024977Z","title":"Reports average data-center PUE of approximately 1.56","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:40.024977Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:26d8368870ea7292dd7650b1242174a26157ceed0537b8324dc1d2484fb1540e","observation_id":"add9dd61-b892-4869-90fb-00d6de51be54","resolution":{"observed_at":"2026-08-01T13:11:40.024977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12032","last_updated":"2025-02-06T04:16:22Z","snapshot_observed_at":"2026-07-06T19:34:10.252984Z","submitted_at":"2024-10-15T20:06:33Z","title":"MLPerf Power: Benchmarking the Energy Efficiency of Machine Learning Systems from Microwatts to Megawatts for Sustainable AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12032","snapshot_observed_at":"2026-08-01T13:11:40.152056Z","title":"arXiv:2410.12032","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:40.152056Z"},"links":{"cited_paper":"/paper/2410.12032","citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:02ad0116a06af542e52d7b176da35d262f990ab1c85e56903a3a1c6235b7f4e0","observation_id":"a513ad35-6fa5-449e-ae28-4253884eed9a","resolution":{"observed_at":"2026-08-01T13:11:40.152056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:40.260786Z","title":"nvidia.com/en-us-hopper-architecture/ nvidia-tensor-core-gpu-datasheet, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:40.260786Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:57c2894da5ae635953b071688c135d70ce4d78ca6eb8e107ad321c13a81a553e","observation_id":"4a8e7ab0-9713-42e9-88f2-c3e2ca0d5c2a","resolution":{"observed_at":"2026-08-01T13:11:40.260786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:40.363935Z","title":"Vartziotis, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:40.363935Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:be86dad1ceb85f695f5e7f5c16f32795b17baf1cc926af97f6fd10c1d24bfd8a","observation_id":"6506491d-b20f-4eae-856a-fceab5c4a22c","resolution":{"observed_at":"2026-08-01T13:11:40.363935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:40.514887Z","title":"Samsi, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:40.514887Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:2588f1c8bcb65bb17e488b77a076f1a77c5fc145e49cde56232abaffd8f2bf30","observation_id":"b7ad372a-b761-4989-a65a-896a26760bbc","resolution":{"observed_at":"2026-08-01T13:11:40.514887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:40.600504Z","title":"Luccioni, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:40.600504Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:a9c1abc44136170bcb7021c47d9c0236a93a9d7875bba37c9ec6ce0c24e072a5","observation_id":"e20f51e9-3065-4ee1-8bcb-09797508b694","resolution":{"observed_at":"2026-08-01T13:11:40.600504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:40.689889Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:40.689889Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:860bc91c62b73f2b95851acbc2b38077086b66fe66885dae857f412ad252aa5d","observation_id":"b8c7ab08-2b6d-4e65-8274-cb906dcecf31","resolution":{"observed_at":"2026-08-01T13:11:40.689889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-01T13:11:40.794829Z","title":"Kaplan, S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:40.794829Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:68ed45edf647707e28cf334d2a128bd45e0d3b2418db30eca933b60c87e1e982","observation_id":"d3c185d0-ccf7-48ff-9afe-f0ee325521b6","resolution":{"observed_at":"2026-08-01T13:11:40.794829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:40.954963Z","title":"Hoffmann, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:40.954963Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:e434f13df30f1a13087a713c85898528b85f12cffc5c6921b025491ad1c1e29a","observation_id":"42f4413d-69cb-4d37-ab73-fbdc6a30c809","resolution":{"observed_at":"2026-08-01T13:11:40.954963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.035697Z","title":"Antepara, Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.035697Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:0ef284d7f04e3d02598fd300887ad1f2ead2b43d8d69997f412cf9a54dee206b","observation_id":"90810153-35ca-4afe-a854-8f3f428278f6","resolution":{"observed_at":"2026-08-01T13:11:41.035697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.154612Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.154612Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:614753e970ebbf4a087c678fe7cbb555f3ab9f017e6179ef6f1159ccd3ec21cd","observation_id":"d5857ea2-0a83-4617-9cf8-5db570072c7d","resolution":{"observed_at":"2026-08-01T13:11:41.154612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.203151Z","title":"Caravaca, Á","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.203151Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:c3b5a28091affb09e5e2d638f73d060ab59c8d92f4901ea34d713a998d07e5ec","observation_id":"b4d16dbe-8ace-4c4a-a30d-29b94ef68e70","resolution":{"observed_at":"2026-08-01T13:11:41.203151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.320230Z","title":"Accessed 2026-05-24","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.320230Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:0eb5e2d8e8e636ed2fd1dbffa99d343b1c23a574f62784aa3b6c5991867eab74","observation_id":"75834720-ff73-482c-b10a-5e5d5fb04a85","resolution":{"observed_at":"2026-08-01T13:11:41.320230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.413470Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.413470Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:d3f9a6ef1cfa10959bb57a162f69ee8085d87e5d4a9e1d326b1449d8e2be3f4e","observation_id":"64708f24-b91e-499f-8a7c-b7ff15868b08","resolution":{"observed_at":"2026-08-01T13:11:41.413470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.535140Z","title":"URL: https://docs.nvidia.com/nemo/megatron-bridge/ 0.2.0/models/vlm/ministral3.html","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.535140Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:5f9623bfac5404035a2f8228aa92eee5a6247f38e83d8e39cde1ced35b07a953","observation_id":"b4c8f519-e631-421a-a23c-ce3fec318552","resolution":{"observed_at":"2026-08-01T13:11:41.535140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.627975Z","title":"URL: https: //huggingface.co/google/embeddinggemma-300m","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.627975Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:374daef9bc5b2819dcddd033a16a87fd98ab3ca130035ec82a6bc1a2531981aa","observation_id":"29cbfd31-4ff3-489b-8d88-fa3ff096fdea","resolution":{"observed_at":"2026-08-01T13:11:41.627975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.749579Z","title":"URL: https://www.aimodels.fyi/models/huggingFace/ mxbai-embed-large-v1-mixedbread-ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.749579Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:061cb62a8a811d1b9885f2b63c8f9e975437dcf48ce4766eda76ce2bbfed5005","observation_id":"dd83660b-c961-4e23-9247-470acd859866","resolution":{"observed_at":"2026-08-01T13:11:41.749579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.899055Z","title":"URL: https: //huggingface.co/Qwen/Qwen3-Embedding-0.6B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.899055Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:eb3b88bec05c8cc97e68883911f0998589b6a131a119831049d9764b43c5d082","observation_id":"0abd6718-4f77-45bb-8913-ae63f87a1f81","resolution":{"observed_at":"2026-08-01T13:11:41.899055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.998395Z","title":"URL: https://huggingface.co/Qwen/Qwen3-32B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.998395Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:b047f71e70f759424cff74bb8f3cbfd91ba31905dc35a25378378d31ca155c8c","observation_id":"c611f433-a0f3-49f7-b08e-de074612addd","resolution":{"observed_at":"2026-08-01T13:11:41.998395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:42.147807Z","title":"URL: https:// huggingface.co/ibm-granite/granite-3.3-8b-instruct","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:42.147807Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:90f120f7e2467f177c9b6625846aaf09da77a76f4618a694e21e883fd21a909c","observation_id":"a1f3690a-6290-484f-9e45-f52d28749295","resolution":{"observed_at":"2026-08-01T13:11:42.147807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:42.294830Z","title":"URL: https:// huggingface.co/ibm-granite/granite-3.2-2b-instruct","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:42.294830Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:04233ed8215af3c2cd067297a2bb42c9535bc0d2fb53692a7744c482857ade4f","observation_id":"13eefec9-a006-43a0-9fe3-4fe3ba361997","resolution":{"observed_at":"2026-08-01T13:11:42.294830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:42.385085Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:42.385085Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:f29b62492d4636d410c2c965d5f012bba1e74206c5867bef74ae6bbbf75950eb","observation_id":"d21beee9-bde2-4d05-9438-2c09b65e231b","resolution":{"observed_at":"2026-08-01T13:11:42.385085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:42.555818Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:42.555818Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:2ce8eefa13be9d62c2a5d87265bcbb1168e5808406d525158e372f9ab8e45fc5","observation_id":"851a956d-451b-49cb-a4dd-f9194ae61333","resolution":{"observed_at":"2026-08-01T13:11:42.555818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:42.785940Z","title":"URL: https://huggingface.co/Qwen/Qwen3-8B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:42.785940Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:7081c59e399b1c331884be2be7d4cffa5f3938a51b5d18b3463e5a8abd0989bb","observation_id":"58697c33-284c-492a-9402-a404ba9429ba","resolution":{"observed_at":"2026-08-01T13:11:42.785940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:42.867234Z","title":"URL: https://huggingface.co/Qwen/Qwen3-32B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:42.867234Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:4a13ea2d647698879903c9aa394adfba8493eeee1fa92c8579b530d62516be5f","observation_id":"4f8cf3cf-2cfe-4af6-9f8d-bffbba19dc22","resolution":{"observed_at":"2026-08-01T13:11:42.867234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:42.643335Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:42.643335Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:aa2937b7b38d7827775810f3f52608322482eaa9743e32bf211e62b9959b61f5","observation_id":"e3d98102-9a6c-4a4e-8e6d-d8d2a6e68bd5","resolution":{"observed_at":"2026-08-01T13:11:42.643335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-01T13:11:43.062241Z","title":"URL: https: //arxiv.org/html/2409.12186v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:43.062241Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:adfba9905d40fd2e560088d9799f86606121ee2696a6b42acd0c2728257ef768","observation_id":"5e3b8514-5978-43c3-80ba-af06a6eddc06","resolution":{"observed_at":"2026-08-01T13:11:43.062241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:43.205902Z","title":"URL: https:// unsloth.ai/blog/llama3-3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:43.205902Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:67f8dcb174e418963b4ff00762c4035c3b97fd9116fb460fc9876e8a1583a05b","observation_id":"401bbd6a-2d35-49e3-9b49-13ccf0c252c6","resolution":{"observed_at":"2026-08-01T13:11:43.205902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:42.943502Z","title":"URL: https://huggingface.co/Qwen/Qwen3-1.7B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:42.943502Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:cc6f3f5c44790ea2fc158289b3fd895db3a11a59b9d6a6b5a93f78053a8bf68d","observation_id":"7eacbb8e-01c5-4add-8171-2eb338413db8","resolution":{"observed_at":"2026-08-01T13:11:42.943502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:43.364222Z","title":"URL: https://huggingface.co/openai/gpt-oss-20b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:43.364222Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:6062159ec05c05ba217b7c9ab95fab8fe7d7b08668f6239ddbbfee62db664f3c","observation_id":"c671d299-9ea4-44b7-bd9e-06cc18dc67a8","resolution":{"observed_at":"2026-08-01T13:11:43.364222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:43.276008Z","title":"URL: https://huggingface.co/openai/gpt-oss-120b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:43.276008Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:7693578fffa0723886f25341cf7074cde677b00dcad56077ab3456339c118bf7","observation_id":"25c0c2f9-0717-4af6-b3f3-d25d3366c949","resolution":{"observed_at":"2026-08-01T13:11:43.276008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:42.484301Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:42.484301Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:92f276d8664ef4ff6b382442b462454d810f45cddee6e1695c2ad8775fa6cf52","observation_id":"13663f69-7b98-4b3d-9601-4f3090f85439","resolution":{"observed_at":"2026-08-01T13:11:42.484301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:11:41.096827Z","title":"doi:10.1145/3712285.3759815","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T13:11:41.096827Z"},"links":{"citing_paper":"/paper/2607.26571"},"observation_digest":"sha256:cfaaaf5be2367518d104ef77e8696e04fc0dd1db4b8487e14360f6a3ce5508f6","observation_id":"02d347e0-d2da-4cfa-83fb-a3a3920c4418","resolution":{"observed_at":"2026-08-01T13:11:41.096827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.26571","last_updated":"2026-07-29T07:50:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T18:52:34.390205Z","submitted_at":"2026-07-29T07:50:55Z","title":"From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUs"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2607.26571."}