{"as_of":"2026-08-15T01:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:871eb48f0f327a7d834ebe867ca4d1107b6be33f865d064ad3e6116a5c63d07a","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:51:16.342069Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07427/citation-record","integrity":"/paper/2608.07427/integrity","json":"/paper/2608.07427/citation-record.json","paper":"/paper/2608.07427"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.678514Z","title":"Can US infrastructure keep up with AI economy?","venue":null,"work_id":"1f4974e1-db8b-48be-9380-a89521f9330f","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.250855Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:31202f9676f1c8f7e5df489a120da0b22c7c709c82e0ced5aef29e794f979e02","observation_id":"e86c4175-46a7-4286-b62e-f555d045ec46","resolution":{"observed_at":"2026-08-10T04:51:17.682845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.665109Z","title":"The future of datacenters,","venue":null,"work_id":"93c25c6f-3d29-4597-8fe8-366f2f8f0dd8","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.255689Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:aacfab08086dc1864f9b02c8382548e9ddee6b52bb5fbf1ffd6c77148de19cd4","observation_id":"7d0ca9c2-e7cd-4c01-917e-2319287b237d","resolution":{"observed_at":"2026-08-10T04:51:17.669592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:16.260016Z","title":"How hungry is AI? Benchmarking energy, water and carbon footprint of LLM inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.260016Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:1f150036b2d7e70211d63eaafe590ac0684d648eba7506683a3905e7171cccc9","observation_id":"fc289954-9359-4e9d-9304-67464b88dc4a","resolution":{"observed_at":"2026-08-10T04:51:16.260016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.650692Z","title":"Artificial intelligence and energy overcon- sumption: Data center electricity demand, cooling burdens, and regional sustainability constraints,","venue":null,"work_id":"81e9db84-cae2-4e1b-a211-f38576d1ac8d","year":2026},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.264462Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:6c60d5a9c9ee51995565d1b1b5d5a345bf7bc65f68f3a585d04699ac8ab5bab8","observation_id":"dd8b3348-8555-4d0f-bf7d-735982898ac6","resolution":{"observed_at":"2026-08-10T04:51:17.655713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.636304Z","title":"Comparative analysis on developed optimization techniques for reducing energy consumption in AI training and inference,","venue":null,"work_id":"b113dea5-a7ca-4de6-8c07-d2279b4886fe","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.268990Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:186c5b9c4acaf97b038a4253a7154401a50f238e7dce190f74f0977f8da617dc","observation_id":"bbc5bbef-a87a-45da-b37f-69c669e01afd","resolution":{"observed_at":"2026-08-10T04:51:17.640829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:16.273744Z","title":"From prompts to power: Measuring the energy footprints of LLM inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.273744Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:7e5e69e5cb44388a0c948e4e1caa1370adb064cb45bfe8be00b59aee6c62df8c","observation_id":"bbb05f71-675b-423b-a571-ba990905c72a","resolution":{"observed_at":"2026-08-10T04:51:16.273744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14903","last_updated":"2024-02-22T18:14:09Z","snapshot_observed_at":"2026-08-13T04:12:40.706623Z","submitted_at":"2024-02-22T18:14:09Z","title":"Tokenization counts: the impact of tokenization on arithmetic in frontier LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14903","snapshot_observed_at":"2026-08-10T04:51:16.278459Z","title":"Tokenization counts: The impact of tokenization on arithmetic in frontier LLMs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.278459Z"},"links":{"cited_paper":"/paper/2402.14903","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:0b1a754edb44d7d0d7ae64b0a7f6cb1da771e047a5e6d184347e367c9a3831b1","observation_id":"1aeb037a-8a26-4336-9779-2a5426fc744a","resolution":{"observed_at":"2026-08-10T04:51:16.278459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.03825","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.208134Z","title":"How different tokenization algo- rithm impact LLMs and transformer models for binary code analysis,","venue":null,"work_id":"2ff6e0c2-9f68-4cfd-8706-f5859cd3e54d","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.283034Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:05e80d4ec0e062bd1dbee8825a5f27e1be52223078fb954400177e0fc1c06252","observation_id":"e30abeef-7af0-4cce-90e5-89d990b2da18","resolution":{"observed_at":"2026-08-10T04:51:17.217901Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:16.286983Z","title":"Harnessing vision-language models for time series anomaly detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.286983Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:cb46d54d8be5c1146a507112f92dbd4d6d6f06c189db8c1e2725b6232d01e5e2","observation_id":"b4287e23-e609-4ad9-9b7d-6c048b1df8f8","resolution":{"observed_at":"2026-08-10T04:51:16.286983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:16.291049Z","title":"TokenPowerBench: Benchmarking the power consumption of LLM inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.291049Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:e6debaafd92e5ec71e520b17c17b4573fb75bf6e790eb8c35816837d7e530ed1","observation_id":"0d2f52fe-fbe6-4f04-a526-cada29527f67","resolution":{"observed_at":"2026-08-10T04:51:16.291049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:16.294955Z","title":"The ML.ENERGY benchmark: Toward automated inference energy measurement and optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.294955Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:5f8b5669b57ec5a7d862c78e1b439cb5645c624c41af4b19913df608d82a1489","observation_id":"cf8957cc-a73d-4287-94c5-1b4f3a91685f","resolution":{"observed_at":"2026-08-10T04:51:16.294955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.622104Z","title":"An energy-efficient vision language model inference with importance-aware token pruning,","venue":null,"work_id":"c70d60f0-c913-449f-a1c6-7894a123beac","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.298990Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:ef9316d5b3cd8707025115c0bd952bf95009b3a6976ff02b4ef948ec1f97884e","observation_id":"fc361cb8-1430-4d56-8148-8ea9cdff5c19","resolution":{"observed_at":"2026-08-10T04:51:17.626613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05950","last_updated":"2026-07-30T08:22:34Z","snapshot_observed_at":"2026-08-14T20:24:40.199057Z","submitted_at":"2026-03-06T06:32:57Z","title":"Energy-Driven Adaptive Visual Token Pruning for Efficient Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.05950","snapshot_observed_at":"2026-08-10T04:51:16.303359Z","title":"Energy-driven adaptive visual token pruning for efficient vision-language models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.303359Z"},"links":{"cited_paper":"/paper/2603.05950","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:b233a058e8bcbd53ce347424342f87fee24300091d02a1043202d482af76ce06","observation_id":"92c823a5-1470-42e2-8e75-c50bdc24a828","resolution":{"observed_at":"2026-08-10T04:51:16.303359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06018","last_updated":"2025-04-25T16:39:41Z","snapshot_observed_at":"2026-08-13T09:52:57.895478Z","submitted_at":"2024-11-09T00:35:29Z","title":"A Picture is Worth A Thousand Numbers: Enabling LLMs Reason about Time Series via Visualization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06018","snapshot_observed_at":"2026-08-10T04:51:16.308177Z","title":"A picture is worth a thousand words: Enabling LLMs reason about time series via visualization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.308177Z"},"links":{"cited_paper":"/paper/2411.06018","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:f5aa576d4e875a888382f9aca128af5705ac1ab001ed08ed09355832043787ad","observation_id":"f3381d6d-fe4e-4a4e-9902-ea80c3f64b56","resolution":{"observed_at":"2026-08-10T04:51:16.308177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.02523","last_updated":"2026-05-06T17:03:24Z","snapshot_observed_at":"2026-08-14T01:39:54.079191Z","submitted_at":"2026-05-06T17:03:24Z","title":"Edge-Deployable LLM Fine-Tuning on a Single GPU for Telecom Network Troubleshooting","version":1},"cited_work":{"arxiv_id":"2607.02523","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.02523","snapshot_observed_at":"2026-08-10T04:51:16.419521Z","title":"Edge-Deployable LLM Fine-Tuning on a Single GPU for Telecom Network Troubleshooting","venue":"cs.DC","work_id":"597b23a6-a6c3-4c71-a9b9-834953cea6e5","year":2026},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.312840Z"},"links":{"cited_paper":"/paper/2607.02523","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:07e640c77e84f346e2f53ed9817c0d9cced083b1d649fa642b22cf071c4bf994","observation_id":"23f19057-c6ed-4369-8bdb-6a68b50353a2","resolution":{"observed_at":"2026-08-10T04:51:16.426717Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.607431Z","title":"Zeus: Understanding and optimizing GPU energy consumption of DNN training,","venue":null,"work_id":"80e11e8c-cd4d-466c-90da-1a5a00153326","year":2023},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.317365Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:f7552be4e4bd6fba5a03bc62211526c134abcdfd6e7813920d12b36ed5b895a1","observation_id":"f42fc48d-43db-4062-b758-6986cc746f6d","resolution":{"observed_at":"2026-08-10T04:51:17.612703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T04:51:16.323125Z","title":"The Llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.323125Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:ae9a753ef274d6654683d95b4474e176ded05b20c93a44ed631c7237ca3f0132","observation_id":"d5f6ba40-85f2-42cf-acd7-1412f693b57d","resolution":{"observed_at":"2026-08-10T04:51:16.323125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-10T04:51:16.328390Z","title":"Qwen2.5-VL: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.328390Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:dc938bc147375f076ccbf427316fa1a4825c48d40dd618f7e54977b105737958","observation_id":"be40f393-fb5b-4a06-a150-58204cb18b2e","resolution":{"observed_at":"2026-08-10T04:51:16.328390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-08-10T04:51:16.333215Z","title":"Pixtral 12B,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.333215Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:021edda3763b6a315f84a2e39bc5f34c24131f6463f08a648d55625f8ccc1663","observation_id":"8c5fe114-94a8-444f-93aa-c622da1dfad6","resolution":{"observed_at":"2026-08-10T04:51:16.333215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.593710Z","title":"Causal inter- vention sequence analysis for fault tracking in radio access networks,","venue":null,"work_id":"d8464fef-d407-4387-b76f-9c460b7b31d7","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.337747Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:44a00d5a290410caecb0380fc240da13d4f368c48a506a9c0ab8775effe66686","observation_id":"a8f2d798-5472-4240-b21b-e5888612a969","resolution":{"observed_at":"2026-08-10T04:51:17.598284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.579050Z","title":"Cost efficient GPU cluster management for training and inference of deep learning,","venue":null,"work_id":"fbbd46ec-18ec-47e3-a9d4-a0b53043a401","year":2022},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.342069Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:ab33288be9afb80fe04c9cdb8187bbec171006549203e760ef684551d79c36bf","observation_id":"bda76dd2-3446-4364-821f-8e760aa0dadd","resolution":{"observed_at":"2026-08-10T04:51:17.583501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T15:53:37.513325Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":8},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2608.07427."}