{"as_of":"2026-08-07T08:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:91413d98b496d7f4100edbeb46150ad81449114457c1b24cf526134ad50b2aa2","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:58:08.181911Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20507/citation-record","integrity":"/paper/2607.20507/integrity","json":"/paper/2607.20507/citation-record.json","paper":"/paper/2607.20507"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:04.635644Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:04.635644Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:d4ab622d13c3ec9742d348e11505c22ab2fcb1b6207d093b0f1bea03ed47bc82","observation_id":"90b49b74-0e22-45b6-8ac5-94023f6cc8ee","resolution":{"observed_at":"2026-08-02T08:58:04.635644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:04.714808Z","title":"Transactions on Machine Learning Research , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:04.714808Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:cc1b4a189ee00816798799705b2e1c6e08ad1242a7f03c2bc99adfe37de83b55","observation_id":"16baf39c-1956-4da2-9250-d913920b9975","resolution":{"observed_at":"2026-08-02T08:58:04.714808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:04.797819Z","title":"2023 , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:04.797819Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:8922a05366f5c10402001ddaf8913b1199b256ebeef393a52e5289f9dd72524a","observation_id":"268a6c57-1b20-4e03-acd2-6185d20afc28","resolution":{"observed_at":"2026-08-02T08:58:04.797819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:04.936357Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:04.936357Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:34ed54042adb8873eb37a685fbec3f124581fad48880237b23ca1913567d5c4f","observation_id":"24610a3e-bf75-4c98-9182-2942538ff241","resolution":{"observed_at":"2026-08-02T08:58:04.936357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:05.030510Z","title":"Proceedings of the 40th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:05.030510Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:f5d043895787807f1e7679f2dcd314c7c9b90d0fe6cc1dc9652e4f9414279f98","observation_id":"516aff8b-85a5-4c06-ac77-23b9d7442bd7","resolution":{"observed_at":"2026-08-02T08:58:05.030510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-02T08:58:05.103454Z","title":"arXiv preprint arXiv:2302.01318 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:05.103454Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:77b91d8adcfc01b39da598f3e72782587e9cd883730999efb976d7820ae77c48","observation_id":"675aff8d-7a30-4427-b801-c4a7f47ca0e1","resolution":{"observed_at":"2026-08-02T08:58:05.103454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:05.177707Z","title":"2024 , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:05.177707Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:bc4bedfa2e226e183c26c7383c1beeb29baa6a3183056b93d6e603f2f5d868a8","observation_id":"67e44686-6a96-4b7e-9eaa-42f3d3d44e65","resolution":{"observed_at":"2026-08-02T08:58:05.177707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:05.365116Z","title":"and Chen, Deming and Dao, Tri , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:05.365116Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:e5d83c49292fcc452773f7a3f54ab260f499ce630a52a0c23467dd4708a4d9a4","observation_id":"8659404b-334c-4bd0-9e3a-650210a9c112","resolution":{"observed_at":"2026-08-02T08:58:05.365116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:05.394024Z","title":"2024 , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:05.394024Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:48486d059c6c79d1dba7d5ae5cd27b66126df5610bd9edb5a9a2f8077ca1c201","observation_id":"c987e5ba-0a3b-4b70-8003-9fd8ce8a9ffb","resolution":{"observed_at":"2026-08-02T08:58:05.394024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:05.457930Z","title":"Break the Sequential Dependency of","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:05.457930Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:7f63a685475e5c944a823f7785da09e16aba8916b17868b0bf5a2d0828442580","observation_id":"26ce685d-ddb2-48cf-8eb1-4e963efc8dff","resolution":{"observed_at":"2026-08-02T08:58:05.457930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:05.510043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:05.510043Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:3d618d4e714f14284172099413c56468acda1f007544627c02d7d5c5622b1a80","observation_id":"942d0c99-998d-464c-87ca-35504046ffb9","resolution":{"observed_at":"2026-08-02T08:58:05.510043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:05.669849Z","title":"Findings of the Association for Computational Linguistics: ACL 2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:05.669849Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:a545cf3680904b01971852fbc0acd94011a0cbbe04a5b79a171e1745704c3ae0","observation_id":"452c4d0e-da0a-4830-84e3-f69b0a3a79bf","resolution":{"observed_at":"2026-08-02T08:58:05.669849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:05.824091Z","title":"2023 , address =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:05.824091Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:0d84a12ed4a9dc88d883ca4a6a9d938ff6d293a1a90fe1ca7c2f56d6e569d0fd","observation_id":"09be17be-f8f3-44b2-b617-ee20682ec72e","resolution":{"observed_at":"2026-08-02T08:58:05.824091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:05.986193Z","title":"Proceedings of the Seventh Annual Conference on Machine Learning and Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:05.986193Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:313ac1e864e659f1281e4e87bfdf0dc9eee668b764d1a25cc358a024a89373f4","observation_id":"068aa273-416e-483d-8142-29866a5d3d24","resolution":{"observed_at":"2026-08-02T08:58:05.986193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02694","last_updated":"2025-03-07T14:49:07Z","snapshot_observed_at":"2026-07-06T17:39:41.498480Z","submitted_at":"2024-03-05T06:23:50Z","title":"MeanCache: User-Centric Semantic Caching for LLM Web Services","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02694","snapshot_observed_at":"2026-08-02T08:58:06.169493Z","title":"2024 , archivePrefix =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:06.169493Z"},"links":{"cited_paper":"/paper/2403.02694","citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:a81b3b4ce5eac852ba8c402f2fa9f7976e857aa0809ce6b36c985a55d2ad0366","observation_id":"3d07fdbd-a640-4bb8-975e-5ed2c1cd8115","resolution":{"observed_at":"2026-08-02T08:58:06.169493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:06.367143Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:06.367143Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:839e362b84998e0249a1b97d2554af374d1ed1664cc1db6f99c166199b2f4432","observation_id":"36b6fbfb-565b-4601-9a2c-2b3cae74170e","resolution":{"observed_at":"2026-08-02T08:58:06.367143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16525","last_updated":"2025-05-16T12:42:48Z","snapshot_observed_at":"2026-07-06T20:56:18.361337Z","submitted_at":"2025-03-17T16:43:35Z","title":"KVShare: An LLM Service System with Efficient and Effective Multi-Tenant KV Cache Reuse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16525","snapshot_observed_at":"2026-08-02T08:58:06.513882Z","title":"2025 , archivePrefix =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:06.513882Z"},"links":{"cited_paper":"/paper/2503.16525","citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:628ffb21bd1b1de553a0ac155e2520018aac196e430c396d652706ec550da659","observation_id":"da5eb0de-d486-4885-be94-7280f4fa4f76","resolution":{"observed_at":"2026-08-02T08:58:06.513882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-02T08:58:06.716260Z","title":"arXiv preprint arXiv:2505.09388 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:06.716260Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:3fb982947f6b27137f8d5fe5a19092c18fa7db3d1caa3428091cb78131905158","observation_id":"b708ea27-3567-42ca-a72d-27a74d2b3016","resolution":{"observed_at":"2026-08-02T08:58:06.716260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:06.854370Z","title":"Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing , pages =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:06.854370Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:ae838b5b4e9ae5b9d1dd6c8c46ef245d54a3faf8f659dd1aeccdeafd50f825f6","observation_id":"b169a79f-5a0a-43b9-83c6-e2dbf5aa5980","resolution":{"observed_at":"2026-08-02T08:58:06.854370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:07.038196Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:07.038196Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:1755c630c0c5b33778ce679b931fc94a9dafa99856ae9e9ffba8a635257f4fb2","observation_id":"9f652980-3369-4f4b-8804-b24b5a33ed3a","resolution":{"observed_at":"2026-08-02T08:58:07.038196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:07.142971Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:07.142971Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:a9e1d728d954b1aa5e317e361d7b7132782ad4b771f3ff27d36eda4b62bfda6f","observation_id":"ac43dd8a-f21a-47ef-9732-0a01388b6ae8","resolution":{"observed_at":"2026-08-02T08:58:07.142971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:07.291602Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:07.291602Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:56a352b90b353c011947cd539b1e0b17b5ce19a37b94aa5ba3aa702b75684eba","observation_id":"e81a133e-06aa-4a36-ad3c-ad4b9f5c0ae2","resolution":{"observed_at":"2026-08-02T08:58:07.291602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:07.460354Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:07.460354Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:5da85117e3032a02ec057fce89dae01eb0021719416995b25c892e58d2abf21d","observation_id":"f664783c-749e-496c-8d20-92e82c2a7108","resolution":{"observed_at":"2026-08-02T08:58:07.460354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-02T08:58:07.611796Z","title":"arXiv preprint arXiv:2001.08361 , year =","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:07.611796Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:e01166901765689bc3bd87a8744741d2d39808fe494b55a6b6cec8d62d080f4c","observation_id":"fb5594d6-8ec9-416d-a30c-17b0611d0036","resolution":{"observed_at":"2026-08-02T08:58:07.611796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:58:07.794419Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:07.794419Z"},"links":{"citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:d48154a68ea267334d9ae483db45e651d6c33a3d44ee6f15b34f04183b645275","observation_id":"ff9d53e7-7b09-4ae1-bb68-44a35ba17889","resolution":{"observed_at":"2026-08-02T08:58:07.794419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T08:58:07.998164Z","title":"arXiv preprint arXiv:2407.21783 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:07.998164Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:7fa0ebb90eea8bd0d236aa5913b4c886ea41c809a3843fac924969efdb2ba8a1","observation_id":"bf4bba0c-d969-4a6a-97fb-4ea8a2a3d06d","resolution":{"observed_at":"2026-08-02T08:58:07.998164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-02T08:58:08.069399Z","title":"arXiv preprint arXiv:2412.19437 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:08.069399Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:c4230ef8bd3ac6859ebb20cd3ef38c5189858141387795da2670523c540dbe86","observation_id":"5498f6bd-3387-4ca8-a9a4-e225290f5fea","resolution":{"observed_at":"2026-08-02T08:58:08.069399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19819","last_updated":"2025-05-26T10:58:51Z","snapshot_observed_at":"2026-07-06T21:30:32.739008Z","submitted_at":"2025-05-26T10:58:51Z","title":"FinLoRA: Benchmarking LoRA Methods for Fine-Tuning LLMs on Financial Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19819","snapshot_observed_at":"2026-08-02T08:58:08.181911Z","title":"arXiv preprint arXiv:2505.19819 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T08:58:08.181911Z"},"links":{"cited_paper":"/paper/2505.19819","citing_paper":"/paper/2607.20507"},"observation_digest":"sha256:f1e16c5f31a31b7ed5a89e0e3191ee733e6e0ac433342b33c63b3cf2efd27345","observation_id":"2a653bc0-de73-4415-a241-44863d1ff648","resolution":{"observed_at":"2026-08-02T08:58:08.181911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20507","last_updated":"2026-07-03T06:53:48Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-02T08:58:03.485793Z","submitted_at":"2026-07-03T06:53:48Z","title":"MiniCache: Reusable Program Caching with Small Model Interfaces for Efficient LLM Inference"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2607.20507."}