{"as_of":"2026-08-08T02:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5a52d8d4d48bfd08dfa4856c0b8b1209227d231f84066a54e61d181689119b6","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T04:23:33.206084Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.12161/citation-record","integrity":"/paper/2607.12161/integrity","json":"/paper/2607.12161/citation-record.json","paper":"/paper/2607.12161"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:27.688416Z","title":"LoCoEval: Long-conversation evaluation pipeline.https://anonymous.4open.science/ r/LoCoEval, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:27.688416Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:06b6335f4b71d6afc75683e3b21844b8d280165fc458395e624fedace29c78bb","observation_id":"c1ccfc40-0b82-4f6b-bdfc-3786132cdf75","resolution":{"observed_at":"2026-08-04T04:23:27.688416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:27.818970Z","title":"Prompt caching — claude developer platform documentation.https://platform.claude","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:27.818970Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:5beafa57f1c4bddff8b00913ee230734f334384e524d67be00a1f4ad1f0a8127","observation_id":"c6361a8a-8f16-4998-8166-981b3e0b9e90","resolution":{"observed_at":"2026-08-04T04:23:27.818970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:27.976777Z","title":"Claude code documentation.https://code.claude.com/docs, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:27.976777Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:b9ad2945cf5fcb45e7630bc0d7f5f28ca64eb2138251dc3a6bf8892756f415c2","observation_id":"7e6dc2ab-a0b1-4fc7-82d4-7271ccf42acc","resolution":{"observed_at":"2026-08-04T04:23:27.976777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:28.075276Z","title":"Claude developer platform pricing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:28.075276Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:9eb2c552af0e79b30d7ac36ef11553971b353c1c1e058633fe4b082642a8138a","observation_id":"f070f918-a871-4cb9-9712-ffac75c1a7e2","resolution":{"observed_at":"2026-08-04T04:23:28.075276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:28.166670Z","title":"ast-grep: A CLI tool for code structural search, lint, and rewriting","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:28.166670Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:815ecaa43638f81c4e6b2d57a15d073fe9b912e76dfb22332215d49dde0ee0f0","observation_id":"47ab9a11-a3e5-4013-8d54-40a3db061a46","resolution":{"observed_at":"2026-08-04T04:23:28.166670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-04T04:23:28.327922Z","title":"Program synthesis with large language models.arXiv preprint arXiv:2108.07732, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:28.327922Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:38e6479830e625f956889a656ad36f108a42f908c07815660450c0835a3f899d","observation_id":"eeb7b665-6c7f-486d-beed-c177ac644278","resolution":{"observed_at":"2026-08-04T04:23:28.327922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-02T11:20:36.216220Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-04T04:23:28.489925Z","title":"LongBench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:28.489925Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:8407381f377f7b193df235b6ae2ead255d6e19256e10ac772829dcf59edb29a7","observation_id":"1c6fc783-8994-41fc-ac64-3cd1760781c8","resolution":{"observed_at":"2026-08-04T04:23:28.489925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-07-31T18:33:34.529799Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-08-04T04:23:28.694961Z","title":"FrugalGPT: How to use large language models while reducing cost and improving performance.arXiv preprint arXiv:2305.05176, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:28.694961Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:1699b5a547b8912445a522e1c48100bca15bb3e8ed5eb4b83b39d8ed1873ff25","observation_id":"82317c59-1da9-4cad-89f6-d67802a6148d","resolution":{"observed_at":"2026-08-04T04:23:28.694961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-04T04:23:28.821744Z","title":"Evaluating large language models trained on code.arXiv preprint arXiv:2107.03374, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:28.821744Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:d661ac1bf90b3f1c4f5a9d5f68f85642d9e91cd025f815ef456607402954060e","observation_id":"a9d612b8-c71f-4ca7-9bbc-1376accc4b51","resolution":{"observed_at":"2026-08-04T04:23:28.821744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:28.911045Z","title":"ContextBench dataset","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:28.911045Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:ab80b20989e534991cab22daa1f1cdecd1fa471edc7df3aedd0c50fe21470ff5","observation_id":"8ddba432-c6c6-4f60-a90c-05f8c106d49f","resolution":{"observed_at":"2026-08-04T04:23:28.911045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:29.041513Z","title":"SWE-bench_pro dataset (go split)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:29.041513Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:f9e591fffe9fc24f0a28b4f6d14976b09b7a6a94172aeab9c905174bb6fa8960","observation_id":"63cbdd7c-0531-4341-a192-5ee42b43aac1","resolution":{"observed_at":"2026-08-04T04:23:29.041513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:29.212995Z","title":"CodeBERT: A pre-trained model for programming and natural languages","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:29.212995Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:8232f1909b781308be20f472f61bc1f6f44fbf9ba74d3af36275ee72ab13a5d6","observation_id":"539d408d-af3f-491e-b94e-86dae7b86804","resolution":{"observed_at":"2026-08-04T04:23:29.212995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:29.351588Z","title":"ripgrep: Recursively search directories for a regex pattern.https://github.com/ BurntSushi/ripgrep, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:29.351588Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:5c7bf509446cb5a39226e0e9adeb1fd23270b33e448276c21eea99dd9bd72f0f","observation_id":"3eb95877-2ada-45c8-a176-11daab9a163a","resolution":{"observed_at":"2026-08-04T04:23:29.351588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:29.575977Z","title":"Prompt cache: Modular attention reuse for low-latency inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:29.575977Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:a1bffbaddbf14a50b7a9861670a8d1fded4594c7b87117108947923e12144573","observation_id":"b58ebb3d-311e-4aa0-97dd-f324a253ee47","resolution":{"observed_at":"2026-08-04T04:23:29.575977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:29.761509Z","title":"Headroom: An API-boundary context optimization proxy","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:29.761509Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:9548d1ba413825b6943caaa84fc2443fa34af1463336c542c8cd372f8903ac3c","observation_id":"26be85d0-1c81-4cb1-a77e-96114ee7d7ea","resolution":{"observed_at":"2026-08-04T04:23:29.761509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.09436","last_updated":"2020-06-08T09:09:28Z","snapshot_observed_at":"2026-08-06T10:54:14.530969Z","submitted_at":"2019-09-20T11:52:45Z","title":"CodeSearchNet Challenge: Evaluating the State of Semantic Code Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.09436","snapshot_observed_at":"2026-08-04T04:23:29.921420Z","title":"Code- SearchNet challenge: Evaluating the state of semantic code search.arXiv preprint arXiv:1909.09436, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:29.921420Z"},"links":{"cited_paper":"/paper/1909.09436","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:60737e0be704a31cb9a1c2bba2542be8b8e187341f99e80c676d8c7c1e1fe321","observation_id":"8c5beb79-700a-4d88-a80b-674329f3a84a","resolution":{"observed_at":"2026-08-04T04:23:29.921420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:30.036773Z","title":"LLMLingua: Compressing prompts for accelerated inference of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:30.036773Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:07794ac3beb0b528a5fb2cdc2f8f96b847f92b08ce259c790870056b90d2d91a","observation_id":"87dd1898-b3b1-40ee-ad7a-ecfd2073ef4e","resolution":{"observed_at":"2026-08-04T04:23:30.036773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:30.169896Z","title":"LongLLMLingua: Accelerating and enhancing LLMs in long context scenarios via prompt compression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:30.169896Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:332252bf1b633b7c64587f38e8528be51fe7a9b3797d1e1e302618123071052d","observation_id":"f7d1e871-98b2-481e-b489-10493dbea1c0","resolution":{"observed_at":"2026-08-04T04:23:30.169896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-04T04:23:30.306989Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:30.306989Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:1f5430d6d2a6fd001bb9e5d09dc1592ee9fe6d1dd6477380ccd6720965c8f6b3","observation_id":"6ce6243a-1113-4608-b452-fe924a24a134","resolution":{"observed_at":"2026-08-04T04:23:30.306989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:30.494995Z","title":"Efficient memory management for large language model serving with PagedAttention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:30.494995Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:dc35fd96014a3c0d7b639a580868a201cc3bcd4330ea3e6f7f4feb242c4dde67","observation_id":"78b83243-3a26-4bf3-9aaa-ea249d31d2fe","resolution":{"observed_at":"2026-08-04T04:23:30.494995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:30.707255Z","title":"Retrieval-augmented generation for knowledge-intensive NLP tasks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:30.707255Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:2f1db072c29f468856d82b8c2aee1a8f506e50aefafa2d4fd8f87ab4437490af","observation_id":"d8af9bb5-bf39-49ca-b2fc-5469849c110b","resolution":{"observed_at":"2026-08-04T04:23:30.707255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:30.892132Z","title":"Compressing context to enhance inference efficiency of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:30.892132Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:86cb533b12ee53be2da8be1c4dca84330f0889ba49843c6f3d171b933785e57b","observation_id":"1ce5d9c2-4536-4f17-a28a-0822405b7a3e","resolution":{"observed_at":"2026-08-04T04:23:30.892132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:31.127968Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:31.127968Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:4a83b5a8a80f2ea3312ed54e26b4a13058e335920dcd66fa8ad87d7c9f6999b8","observation_id":"a9aabe77-0b92-468d-a3bf-6d2be6d46da5","resolution":{"observed_at":"2026-08-04T04:23:31.127968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:31.274736Z","title":"Learning to compress prompts with gist tokens","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:31.274736Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:d289778602306f41aef714b7408ef349c25d68e501a4de1bbbf7a244ffcd6d15","observation_id":"b964bcef-3cd1-4b6a-afde-608bd05ab58f","resolution":{"observed_at":"2026-08-04T04:23:31.274736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:31.379521Z","title":"Introducing SWE-bench Verified","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:31.379521Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:4fa05b31bbf106426d44069240c5cf7b95e5170ac008db396bc3b18487ba25f9","observation_id":"867b2e50-157a-4d6f-a493-3866d59cb4d2","resolution":{"observed_at":"2026-08-04T04:23:31.379521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:31.511349Z","title":"Toolformer: Language models can teach themselves to use tools","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:31.511349Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:f5c48509189ae83db72a75bb200b87e57fc09dbe80e9f79e6aa7c7a28336aaac","observation_id":"f85be605-745e-45d7-ad62-c42312c0dc6d","resolution":{"observed_at":"2026-08-04T04:23:31.511349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-04T04:23:31.693317Z","title":"Efficient large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:31.693317Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:7b06426562a65c6e87f78c24431f882b59ede4c8f4f446f0c74122ff08757fb7","observation_id":"db817337-0139-4590-ad76-a8058ee2b9cf","resolution":{"observed_at":"2026-08-04T04:23:31.693317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01030","last_updated":"2024-06-07T01:53:07Z","snapshot_observed_at":"2026-07-06T17:23:59.319572Z","submitted_at":"2024-02-01T21:38:58Z","title":"Executable Code Actions Elicit Better LLM Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01030","snapshot_observed_at":"2026-08-04T04:23:31.886604Z","title":"Executable code actions elicit better LLM agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:31.886604Z"},"links":{"cited_paper":"/paper/2402.01030","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:7a18fd9b5e8df88526b73e9b74a0a95cd0fc5ffc505e3d8eac691e313a5fc952","observation_id":"5f51e9ad-3878-4c49-93bd-899b795de09e","resolution":{"observed_at":"2026-08-04T04:23:31.886604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16741","last_updated":"2025-04-18T18:14:31Z","snapshot_observed_at":"2026-08-02T14:58:44.167588Z","submitted_at":"2024-07-23T17:50:43Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16741","snapshot_observed_at":"2026-08-04T04:23:32.021172Z","title":"Xu, Xiangru Tang, Mingchen Zhuge, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:32.021172Z"},"links":{"cited_paper":"/paper/2407.16741","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:3ad42eaf00d865a253350c215bafdc14c1cd4ca06569c8df6242e92a28a6f2cd","observation_id":"84f18c76-1499-46d4-b325-f458547b4e71","resolution":{"observed_at":"2026-08-04T04:23:32.021172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07597","last_updated":"2024-09-24T03:01:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T10:57:50Z","title":"C-Pack: Packed Resources For General Chinese Embeddings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07597","snapshot_observed_at":"2026-08-04T04:23:32.157354Z","title":"C-Pack: Packaged resources to advance general Chinese embedding.arXiv preprint arXiv:2309.07597, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:32.157354Z"},"links":{"cited_paper":"/paper/2309.07597","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:6c343bc582f0affd92d2aeeae36f538da1a352de53241ffffeee45d4bc414d53","observation_id":"51691feb-10e3-414d-8bb4-9b519c53e43d","resolution":{"observed_at":"2026-08-04T04:23:32.157354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03025","last_updated":"2024-01-23T07:49:13Z","snapshot_observed_at":"2026-08-06T04:59:02.070453Z","submitted_at":"2023-10-04T17:59:41Z","title":"Retrieval meets Long Context Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03025","snapshot_observed_at":"2026-08-04T04:23:32.338755Z","title":"Retrieval meets long context large lan- guage models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:32.338755Z"},"links":{"cited_paper":"/paper/2310.03025","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:1aa1cee0fbba673b72d83119ba99b3925e5b7e1aaf2665e7a5f8692189894163","observation_id":"ff6eb032-550e-4def-ab68-fc95e71acbb4","resolution":{"observed_at":"2026-08-04T04:23:32.338755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14898","last_updated":"2023-10-30T17:52:18Z","snapshot_observed_at":"2026-07-06T15:46:55.111790Z","submitted_at":"2023-06-26T17:59:50Z","title":"InterCode: Standardizing and Benchmarking Interactive Coding with Execution Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14898","snapshot_observed_at":"2026-08-04T04:23:32.473137Z","title":"InterCode: Standardizing and benchmarking interactive coding with execution feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:32.473137Z"},"links":{"cited_paper":"/paper/2306.14898","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:07166af1824d96128cfe33127d9ac3c48216b436200275a7ef98fc34d40efeaf","observation_id":"b5f905ca-bc27-4185-9528-d5ddceb2e1d9","resolution":{"observed_at":"2026-08-04T04:23:32.473137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-04T04:23:32.635688Z","title":"Jimenez, Alexander Wettig, Kilian Lieret, Shunyu Yao, Karthik Narasimhan, and Ofir Press","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:32.635688Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:7d2b9e7df3452aca62d0f2e8f10a0afa504c7a06293f8e812977691df6713581","observation_id":"3a1f84a7-db5a-4b6c-8c93-980e3f70a11d","resolution":{"observed_at":"2026-08-04T04:23:32.635688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:32.806529Z","title":"ReAct: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:32.806529Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:675f0a21c02dfdf57a25c1a7f849383c3f6b3c2e1d1157355238c4503b01807c","observation_id":"c4470d6f-8fa4-4f23-bf99-295a8ac727fc","resolution":{"observed_at":"2026-08-04T04:23:32.806529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-02T22:19:29.043854Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-04T04:23:32.913615Z","title":"τ-bench: A benchmark for tool-agent-user interaction in real-world domains.arXiv preprint arXiv:2406.12045, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:32.913615Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:38647706c6fc718152158dafaf1bc4ff3807bd787dc87c58623fda03eccf43b2","observation_id":"59176399-67fb-4947-b1d2-250b2b262155","resolution":{"observed_at":"2026-08-04T04:23:32.913615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02605","last_updated":"2025-04-03T14:06:17Z","snapshot_observed_at":"2026-07-30T07:56:48.878578Z","submitted_at":"2025-04-03T14:06:17Z","title":"Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02605","snapshot_observed_at":"2026-08-04T04:23:33.097574Z","title":"Multi-SWE-bench: A multilingual benchmark for issue resolving.arXiv preprint arXiv:2504.02605, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:33.097574Z"},"links":{"cited_paper":"/paper/2504.02605","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:16499e9d95fd44bed5410deb03d16f0740d1d0bfe72fea9494b793fd73399cc6","observation_id":"70bd8314-d843-4708-b038-fdfbb2161598","resolution":{"observed_at":"2026-08-04T04:23:33.097574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:23:33.206084Z","title":"18/21” and “21/21","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:33.206084Z"},"links":{"citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:4ce11440ff51a9696caa0d800ca25630e13cf580cea059b0258977be3d20a33f","observation_id":"74773f2f-79b0-40d1-a207-080169aed310","resolution":{"observed_at":"2026-08-04T04:23:33.206084Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2607.12161."}