{"as_of":"2026-08-04T20:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:33edb83d3fbdef2c171a8a69c298dd19331363ff0ce82e87d736cc34a67c815b","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:29:36.610491Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T05:14:41.315225Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12301","snapshot_observed_at":"2026-07-12T05:14:41.315225Z","title":"arXiv:2604.12301 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03048","last_updated":"2026-07-03T07:37:57Z","snapshot_observed_at":"2026-08-03T07:15:27.897135Z","submitted_at":"2026-07-03T07:37:57Z","title":"Compression, structure, and executor capability: a controlled real-cost decomposition of language-model agent skill optimisation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T05:14:41.315225Z"},"links":{"cited_paper":"/paper/2604.12301","citing_paper":"/paper/2607.03048"},"observation_digest":"sha256:7e1efd4b996fe932454372d2f913243ff7a64f8d8dc04739d8234858b44ec7ad","observation_id":"5a5b3af6-60d5-48f3-8d56-c485a1573f83","resolution":{"observed_at":"2026-07-12T05:14:41.315225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.12301/citation-record","integrity":"/paper/2604.12301/integrity","json":"/paper/2604.12301/citation-record.json","paper":"/paper/2604.12301"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":"2404.14219","doi":"10.48550/arxiv.2404.14219","metadata_source":"pith","pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-07-10T13:57:06.708632Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":"cs.CL","work_id":"feef9556-a016-493c-abd2-0c97a23a7ebf","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:9ecd987da55c6eabb3cc1499a133b3bb14f50fa4af8747f11bfe5828330ee97a","observation_id":"dcb36fcd-88bf-4f8c-9349-98a38ceae22a","resolution":{"observed_at":"2026-05-11T10:26:01.815954Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt caching with Claude","venue":null,"work_id":"6b82fd07-ad5d-4d70-989d-24034240472c","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:1e7f08a5cf9d88619ab5534a70d1bc208e6dc34b71aac5214e19a43f6ca6ff0c","observation_id":"356e53bb-114d-4a33-8461-593375aef084","resolution":{"observed_at":"2026-05-17T23:22:14.376381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model context protocol specification","venue":null,"work_id":"2d1db823-255d-4c81-a725-55cefc83aaa4","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:b1f60640779ce7ad9dc2137c938dfe9dc13c78948c8893fd31ca892df0149941","observation_id":"8862d6fc-3b64-491e-bc66-a5a933206425","resolution":{"observed_at":"2026-05-17T23:22:14.343062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LongBench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":"27d1e3e3-82d9-4f71-8110-1f31868e4c19","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:150e00a3dcb982016ba209c767fa3a273f8c41a45fe1158a40132a92e68f7614","observation_id":"4f03e472-b328-47d4-8d00-4120b95a7337","resolution":{"observed_at":"2026-05-17T23:22:14.350061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.nlposs-1.24","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T15:59:34.892029Z","title":"GPTCache: An open-source semantic cache for LLM applications enabling faster answers and cost savings","venue":null,"work_id":"9937a60a-5262-4391-8e6e-2a78b97f6fcd","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:6cabfd128a93c878d2de00f81feb42ed9dd9fc9f39eae7afafd178a6963bb3da","observation_id":"83f38bb9-3509-429d-a940-c7fb04edf6ed","resolution":{"observed_at":"2026-05-10T15:30:32.436098Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T14:19:47.509907+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T14:19:47.509907+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":"3fcce73e-10e2-4ebf-81cb-50bc57e3af00","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:45dcd3faefa8e8c48624517a810621f404affb9b4658f5257f2892fba7659d2e","observation_id":"30ee5364-978c-40da-95eb-15874edea48d","resolution":{"observed_at":"2026-05-17T23:22:14.373560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T12:44:53.961440Z","title":"FrugalGPT: How to use large language models while reducing cost and improving performance.Transactions on Machine Learning Research","venue":null,"work_id":"de624289-5bde-416c-8f47-66ab9db0eefa","year":null},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:b98de17adf9e2480cc89806f3a8629b9838e06e36d5229d98f974257ad9ad5a0","observation_id":"972bd370-8d43-49fa-97de-235fce4148cb","resolution":{"observed_at":"2026-05-17T23:22:14.363753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-07-31T18:33:34.529799Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":"2305.05176","doi":"10.48550/arxiv.2305.05176","metadata_source":"pith","pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-07-10T20:57:34.659174Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","venue":"cs.LG","work_id":"5c567414-35de-4373-ae7a-1790da594e8d","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:3c5a7b27d8256bd80be0788531f656470398f3f066f18c8d419020a8e7e20d93","observation_id":"c96bbce6-4324-4413-8cf3-1be9bbf4d288","resolution":{"observed_at":"2026-05-11T19:56:45.568475Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:20.871342+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:20.871342+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":"2403.08295","doi":"10.48550/arxiv.2403.08295","metadata_source":"pith","pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-07-10T23:07:48.332027Z","title":"Gemma: Open Models Based on Gemini Research and Technology","venue":"cs.CL","work_id":"a9ea2870-df28-40b8-a9e0-a7e9a116f793","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:78b8c3566df1ca363ece9fad7fe6d5be871f22d4b01e848a55ec31785c22d68b","observation_id":"1afc6054-208e-4d7d-ae9f-7584c496d4a0","resolution":{"observed_at":"2026-05-11T10:26:01.811647Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:e306cdb8b3b273599039f56246e173827355f76f8c7e7439a949be8eedbf061f","observation_id":"9f86ba6f-52f6-4b8a-943c-59307cf49861","resolution":{"observed_at":"2026-05-11T10:26:01.764284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.825","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T20:15:34.201705Z","title":"LLMLingua: Com- pressing prompts for accelerated inference of large language models","venue":null,"work_id":"629b9d0e-ed05-4694-ba5a-e81b8d5751dc","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:b7cae0abc5da0a5acdded20a2304804a78c459dfbf79b3d750bc1b946c9fec59","observation_id":"7587500b-1108-4ddf-af3a-e3e104fad664","resolution":{"observed_at":"2026-05-10T15:30:32.438379Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:49:42.680868+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:49:42.680868+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik R","venue":null,"work_id":"17230511-5582-4a6a-97a2-8ec666c2ee49","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:9909d2d046a648708af853c06f7b4095d84e1ea6ebb8ff0042d38fde5367a1d7","observation_id":"8cca1ce9-1868-4b7e-8533-448adab09c79","resolution":{"observed_at":"2026-05-17T23:22:14.370702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":"cbf873d1-9e68-4418-9528-8c2262119995","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:09ff24722df1f547c2b7df1c7507b0c2a79071512163129f0e15e81da80a8b34","observation_id":"a850a32a-c7be-4ad1-bdd2-aa197ea472fb","resolution":{"observed_at":"2026-05-17T23:22:14.335881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T13:23:47.523732Z","title":"Retrieval-augmented generation for knowledge-intensive NLP tasks","venue":null,"work_id":"7ffcee25-2c3f-4ae8-85c5-eeb5ad07b87b","year":2020},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:409c66145f19828d8cd40485b52b2b6efb025590b9b7915412ca396154cd314c","observation_id":"29f15dab-1af0-462c-b820-66479b6988c3","resolution":{"observed_at":"2026-05-17T23:22:14.353363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02977","last_updated":"2025-12-03T03:33:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-04T15:59:41Z","title":"Large Language Model-Based Agents for Software Engineering: A Survey","version":2},"cited_work":{"arxiv_id":"2409.02977","doi":"10.48550/arxiv.2409.02977","metadata_source":"pith","pith_arxiv_id":"2409.02977","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Model-Based Agents for Software Engineering: A Survey","venue":"cs.SE","work_id":"65bf4f26-a45c-4639-841f-9f865ef1030e","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2409.02977","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:8f7c9ad74d005df90b7fc1e1e238af03da22c026dc53531e8a4cca2cf7dc8d68","observation_id":"aa709e96-19b6-459a-b076-09cd16aed5e1","resolution":{"observed_at":"2026-05-17T12:35:49.024248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15790","last_updated":"2025-02-26T06:34:55Z","snapshot_observed_at":"2026-08-04T07:43:40.230682Z","submitted_at":"2024-09-24T06:36:56Z","title":"Small Language Models: Survey, Measurements, and Insights","version":3},"cited_work":{"arxiv_id":"2409.15790","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.15790","snapshot_observed_at":"2026-07-04T18:40:02.350725Z","title":"Small language models: Survey, measurements, and insights","venue":null,"work_id":"d47b62d8-fbc2-4285-8e86-9845f68619e3","year":2025},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2409.15790","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:834c90c9b60f29a8734d1b2747c809e1dd7b05b37195081da36494d5af67bfab","observation_id":"fda3e460-b468-4d0a-b8f4-abe6a7ab3b69","resolution":{"observed_at":"2026-05-11T10:26:01.780655Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ollama: Get up and running with large language models locally","venue":null,"work_id":"cef6da24-00a8-4938-8b1a-ea47c02cfc50","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:6e65b8ffaee7e141c0ab173e94fa190ee663e5c2458bfcbad6befd5bf7d98229","observation_id":"984fa1eb-ce55-47d3-aada-3a175e816e2b","resolution":{"observed_at":"2026-05-17T23:22:14.356704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18665","last_updated":"2025-02-23T08:50:33Z","snapshot_observed_at":"2026-07-30T15:06:18.011623Z","submitted_at":"2024-06-26T18:10:22Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","version":4},"cited_work":{"arxiv_id":"2406.18665","doi":"10.48550/arxiv.2406.18665","metadata_source":"pith","pith_arxiv_id":"2406.18665","snapshot_observed_at":"2026-07-10T20:57:34.931879Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","venue":"cs.LG","work_id":"f6b91d8a-ce78-4b5e-9dae-6dd8a22cc087","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2406.18665","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:77d803f2427769e26efb3db7d87546e2275982ce84467a141fb57796be60000a","observation_id":"019e1d40-c81d-471d-9520-e1c42cf61e2d","resolution":{"observed_at":"2026-05-11T23:27:40.993552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:21.122549+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:21.122549+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt caching in the API","venue":null,"work_id":"78185dea-faf5-461f-ba8c-3f1704df5f64","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:c32d6df528aba0c2e96a55dab62febaee12194beb45cbcc39ed9162a77903e7c","observation_id":"4b397e49-6698-4093-8187-41235307d4d4","resolution":{"observed_at":"2026-05-17T23:22:14.359698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vicky Zhao, Lili Qiu, and Dongmei Zhang","venue":null,"work_id":"79e365ca-1b35-4f3d-8b2d-4f5da5c7fbe2","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:18fef80fe6e6fc26724250e3b511a3558b2ca94bf6bb734dda398acb590ea355","observation_id":"6d3d14a4-c924-4bcf-88b3-4f48dae1e55c","resolution":{"observed_at":"2026-05-17T23:22:14.367377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:8f68057b419c4a2954f4cddbd69a5f5cc9ce0fe3bacad1ac19be0940f052fd1f","observation_id":"3003816e-9886-43ac-94ee-e4ddd2fce904","resolution":{"observed_at":"2026-05-11T10:26:01.760000Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sentence-BERT: Sentence embeddings using siamese BERT- networks","venue":null,"work_id":"72ca4ec1-ee33-4688-a725-99fc72157d1e","year":2019},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:186b6498ff08e1bb324cfbbfb9d0ee08932d8fb9dbb0ef4d6fce3f36554a4531","observation_id":"1763e294-50f1-4fcd-86ab-444a0b459e82","resolution":{"observed_at":"2026-05-17T23:22:14.339772Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09702","last_updated":"2023-08-19T21:27:51Z","snapshot_observed_at":"2026-07-06T15:55:41.294452Z","submitted_at":"2023-07-19T01:14:49Z","title":"Efficient Guided Generation for Large Language Models","version":4},"cited_work":{"arxiv_id":"2307.09702","doi":"10.48550/arxiv.2307.09702","metadata_source":"pith","pith_arxiv_id":"2307.09702","snapshot_observed_at":"2026-07-10T22:07:38.513339Z","title":"Efficient Guided Generation for Large Language Models","venue":"cs.CL","work_id":"eed83982-64d7-41e1-b7ec-21167ca473d5","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2307.09702","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:ad8055f5740a0d4eb8d97cc5fe7c15dbe8eaee32fae138b9f72e0a8af1d1142d","observation_id":"0da7e975-147b-42f8-8a0e-deaa309cb627","resolution":{"observed_at":"2026-05-13T15:07:13.961671Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:23:27.209789+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:23:27.209789+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":"674e2e98-a41d-4133-9576-b7970802c58e","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:47aeaabf2d086b6650070267a2a74a2e570b51f219dec21dc923e5ff994e176b","observation_id":"0120b1c7-6ea1-478a-bf51-182ebc17cbdb","resolution":{"observed_at":"2026-05-17T23:22:14.346565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":9,"verified_fuzzy":12},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2604.12301."}