{"as_of":"2026-08-17T09:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d348a8e8b112d35850188c92691df91239d64b421f2662dbd00feeafb8e9125","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:45:42.411640Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T04:58:39.204380Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-07-13T22:20:51.838309Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18897","last_updated":"2026-06-16T09:34:16Z","snapshot_observed_at":"2026-08-14T02:15:33.190124Z","submitted_at":"2026-03-19T13:36:50Z","title":"Parallelizing Tool Execution and LLM Generation for Low-Latency Agent Serving","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T22:20:51.838309Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2603.18897"},"observation_digest":"sha256:326713541e4720b5e922f44ede2073721aac8fdf863046179f3df329dc721243","observation_id":"26d3d1de-fff5-4a5c-9e1a-38e9331db713","resolution":{"observed_at":"2026-07-13T22:20:51.838309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2604.06370","last_updated":"2026-04-07T18:52:25Z","snapshot_observed_at":"2026-08-15T13:00:48.586034Z","submitted_at":"2026-04-07T18:52:25Z","title":"ForkKV: Scaling Multi-LoRA Agent Serving via Copy-on-Write Disaggregated KV Cache","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T18:16:49.292491Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2604.06370"},"observation_digest":"sha256:dd34b169638224c8b8616472e309370c79023e14a71351085d0f1a3a5f1ec08d","observation_id":"8504fea4-ac1a-4c6f-ad49-df4739e91feb","resolution":{"observed_at":"2026-05-10T20:25:46.907699Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2604.17353","last_updated":"2026-04-19T09:59:35Z","snapshot_observed_at":"2026-08-15T15:03:11.648426Z","submitted_at":"2026-04-19T09:59:35Z","title":"Hive: A Multi-Agent Infrastructure for Algorithm- and Task-Level Scaling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T06:31:36.776819Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2604.17353"},"observation_digest":"sha256:81ab41dd09bb7b6efc25c418e55c14fd5f7f81ff2d46c1ccb6a7499397d636e8","observation_id":"9bd72f02-e53d-4bdd-a705-6e85b90aa4a2","resolution":{"observed_at":"2026-05-10T06:36:36.686395Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2604.24971","last_updated":"2026-04-27T20:10:21Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:10:21Z","title":"PolyKV: A Shared Asymmetrically-Compressed KV Cache Pool for Multi-Agent LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T03:55:32.585495Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2604.24971"},"observation_digest":"sha256:fd2f92746fddf9aaa1478d598b83489faecfb598ddc799760ad3e38b2534b529","observation_id":"ed36350b-6157-449b-bb3f-bb64896b7591","resolution":{"observed_at":"2026-05-11T21:51:34.256580Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2604.26103","last_updated":"2026-04-30T09:10:31Z","snapshot_observed_at":"2026-08-15T09:19:00.888874Z","submitted_at":"2026-04-28T20:36:50Z","title":"AMMA: A Multi-Chiplet Memory-Centric Architecture for Low-Latency 1M Context Attention Serving","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-07T14:16:46.241126Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2604.26103"},"observation_digest":"sha256:cd8d171d9792198afddc2a631007c23af71960ad26bc1668f9ff261fb6d719e0","observation_id":"d380eb5e-e830-48b5-bdc7-32b31d024ce3","resolution":{"observed_at":"2026-05-12T00:46:13.127977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2605.08581","last_updated":"2026-05-09T00:48:25Z","snapshot_observed_at":"2026-08-16T07:24:41.835026Z","submitted_at":"2026-05-09T00:48:25Z","title":"PRISM: Fast Online LLM Serving via Scheduling-Memory Co-design","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T00:53:50.578344Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.08581"},"observation_digest":"sha256:c942c5a8c2e685c78fbeddeb294f9408b0e878644414dc64128a800862314889","observation_id":"903503ab-0c69-45a8-bbe7-430b6ddc9c2a","resolution":{"observed_at":"2026-05-12T08:36:26.474892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2605.17613","last_updated":"2026-05-17T19:18:39Z","snapshot_observed_at":"2026-08-15T04:55:37.718485Z","submitted_at":"2026-05-17T19:18:39Z","title":"VeriCache: Turning Lossy KV Cache into Lossless LLM Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-19T22:09:15.782104Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.17613"},"observation_digest":"sha256:5b4fd820552bcf2ed2c1855ad6e91388a9707b5c383276ee97ecb1aa0aadda8c","observation_id":"3d13b212-72be-4504-8766-0d483000950c","resolution":{"observed_at":"2026-05-19T22:12:51.215622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2605.18825","last_updated":"2026-05-12T18:38:24Z","snapshot_observed_at":"2026-08-16T07:25:24.358690Z","submitted_at":"2026-05-12T18:38:24Z","title":"Not All Tokens Are Worth Caching: Learning Semantic-Aware Eviction for LLM Prefix Caches","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-20T22:08:45.016196Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.18825"},"observation_digest":"sha256:542527474ab3c16ef573341890e2e454fe0d533316025b90875041192a11c1b6","observation_id":"d7ec5bef-2697-4fe9-be9a-fa4b5f8e50a3","resolution":{"observed_at":"2026-05-20T22:09:07.016867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-07-12T23:56:22.405561Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows.arXiv preprint arXiv:2507.07400, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.23914","last_updated":"2026-04-09T15:31:22Z","snapshot_observed_at":"2026-08-15T05:54:04.604125Z","submitted_at":"2026-04-09T15:31:22Z","title":"VineLM: Trie-Based Fine-Grained Control for Agentic Workflows","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-12T23:56:22.405561Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.23914"},"observation_digest":"sha256:e90635335c5166663b2a0b3b3be9a8be03d2dda727f3f7bbc3605579440330e5","observation_id":"061ca800-78f4-4b34-b6dd-832b565c2b15","resolution":{"observed_at":"2026-07-12T23:56:22.405561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2605.24259","last_updated":"2026-05-22T22:25:31Z","snapshot_observed_at":"2026-08-02T20:07:37.055832Z","submitted_at":"2026-05-22T22:25:31Z","title":"Resident KV Claims: A Conformance Contract for Future Reuse under Active KV Pressure","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T14:18:35.209571Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.24259"},"observation_digest":"sha256:5abed3b79c4f54441c61ffc684d024b44ab65b08796aff8a44e4b24354b9684b","observation_id":"22dab550-d3c8-4bb7-9865-251ed0bc1eaf","resolution":{"observed_at":"2026-06-30T14:24:45.202521Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2605.29640","last_updated":"2026-05-29T02:43:30Z","snapshot_observed_at":"2026-08-12T14:13:25.051382Z","submitted_at":"2026-05-28T09:07:42Z","title":"VikingMem: A Memory Base Management System for Stateful LLM-based Applications","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-29T07:30:42.104455Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.29640"},"observation_digest":"sha256:aa95873b64882d0fdf20bf6270a17f991ec4d16ddd89f72db06574ffcdca97b7","observation_id":"57a31b54-9b25-48a8-92a6-c6e5d950bfc7","resolution":{"observed_at":"2026-06-29T07:33:13.635254Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2606.05158","last_updated":"2026-08-01T06:36:12Z","snapshot_observed_at":"2026-08-16T08:39:20.419971Z","submitted_at":"2026-06-03T17:57:04Z","title":"Streaming Communication in Multi-Agent Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T06:24:07.052856Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2606.05158"},"observation_digest":"sha256:db83a8ae159fb4bf1139b4309cf233b24ce238755a69ccb02e51a75272fe31bb","observation_id":"aec54df1-77a5-4946-b6ae-20d28c31d373","resolution":{"observed_at":"2026-07-02T08:06:47.918375Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-04T04:58:39.204380Z","title":"InInternational Conference on Learning Representations, volume 2024, pages 39578–39601","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05158","last_updated":"2026-08-01T06:36:12Z","snapshot_observed_at":"2026-08-16T08:39:20.419971Z","submitted_at":"2026-06-03T17:57:04Z","title":"Streaming Communication in Multi-Agent Reasoning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T04:58:39.204380Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2606.05158"},"observation_digest":"sha256:2cab66190789359d8d02a9f0073eea166bba6db5302cefd598bb37a3582ae1ee","observation_id":"4ae630f1-8f27-4dba-8663-26525168fd5d","resolution":{"observed_at":"2026-08-04T04:58:39.204380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2607.00151","last_updated":"2026-06-30T20:27:49Z","snapshot_observed_at":"2026-08-03T01:59:44.957724Z","submitted_at":"2026-06-30T20:27:49Z","title":"SmoothAgent: Efficient Long-Horizon LLM-Based Agent Serving with Lookahead Context Engineering","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-02T17:19:53.560039Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2607.00151"},"observation_digest":"sha256:733748b3bbeabd4bd0564f5669bf6b561fac4e8ecebbb16ca0a1faca794dc5eb","observation_id":"4e8cb190-cd0a-4d88-8fe9-f9124eebd6a0","resolution":{"observed_at":"2026-07-02T17:27:14.694422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-02T11:22:57.020958Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-15T14:36:43.387965Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.020958Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:7f31837a5b4303333da1b2eb48a43e940eff24c4c73d4dce9d3365c4d77645e2","observation_id":"bd742d16-48fb-4143-9404-57f04d3397a2","resolution":{"observed_at":"2026-08-02T11:22:57.020958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-03T14:14:12.063684Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29069","last_updated":"2026-07-31T06:44:06Z","snapshot_observed_at":"2026-08-07T03:44:55.840492Z","submitted_at":"2026-07-31T06:44:06Z","title":"Rethinking AI Cloud Infrastructure for Agentic Serving Systems with the Aries Experimentation Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T14:14:12.063684Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2607.29069"},"observation_digest":"sha256:83782479de11bdda1504809376915c3781789475ea24410ec6aaa42a94f884ff","observation_id":"0a65ee2b-195e-4223-ba1d-95c47b4382bf","resolution":{"observed_at":"2026-08-03T14:14:12.063684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07400/citation-record","integrity":"/paper/2507.07400/integrity","json":"/paper/2507.07400/citation-record.json","paper":"/paper/2507.07400"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.222956Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.222956Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:3d7ba8a8c3acbd68f6964f5f21dfd81b0aec8b8f85b168f831e54af2b89eadb3","observation_id":"ddc67721-7ff7-45d2-a005-486c7bc7f317","resolution":{"observed_at":"2026-08-06T18:45:42.222956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.227937Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in Neural Information Processing Systems, 36:8634–8652, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.227937Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:5bb86f71396e99a87d210c1bd9c2e2eb2a8ad855b192dd0a5253920e5a62faca","observation_id":"a60f3c9d-5f10-40f5-95ac-be25f82fab4d","resolution":{"observed_at":"2026-08-06T18:45:42.227937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-08-12T16:02:21.969968Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-06T18:45:42.233314Z","title":"Metagpt: Meta programming for multi-agent collaborative framework","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.233314Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:60256dcf34f5aeab826cb05a2d3e103c3e95f310d851725fee76a07cbad61b27","observation_id":"55921259-8778-4990-a660-09036a7a2743","resolution":{"observed_at":"2026-08-06T18:45:42.233314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.238391Z","title":"Camel: Communicative agents for\" mind\" exploration of large language model society","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.238391Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:2e88820eb9c6d87f3c8fbb6819a58163bd74baa1155dc51443d94f4d27d38d4c","observation_id":"7914f024-1158-4497-b3e8-1fb12c7a18a9","resolution":{"observed_at":"2026-08-06T18:45:42.238391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06985","last_updated":"2024-08-30T06:27:58Z","snapshot_observed_at":"2026-08-16T13:35:43.549513Z","submitted_at":"2024-07-09T15:59:28Z","title":"PEER: Expertizing Domain-Specific Tasks with a Multi-Agent Framework and Tuning Methods","version":4},"cited_work":{"arxiv_id":"2407.06985","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.06985","snapshot_observed_at":"2026-08-06T18:45:42.765422Z","title":"PEER: Expertizing Domain-Specific Tasks with a Multi-Agent Framework and Tuning Methods","venue":"cs.AI","work_id":"55d8ebb1-45a5-42b8-a7dd-3360f7b11c23","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.243742Z"},"links":{"cited_paper":"/paper/2407.06985","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:db3323d366608be1e77ed63c0c37580e9f6de344f06f73c91bf0c6801bea5a7e","observation_id":"d96f7d36-be33-47db-9b86-ca3418007a30","resolution":{"observed_at":"2026-08-06T18:45:42.772387Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-08-08T22:28:26.004138Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-06T18:45:42.248910Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.248910Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:ced93144c8e71d9faa2cb2cc1261fc5e87df538bed3369b6274380fc2a2efbbb","observation_id":"90d6b685-6b40-4beb-9549-a1b1c9b8e75f","resolution":{"observed_at":"2026-08-06T18:45:42.248910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:43.018547Z","title":"Gptswarm: Language agents as optimizable graphs","venue":null,"work_id":"24569918-0ae1-4922-954a-d1ef37e87d2b","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.255938Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:58eb4501e69e09719c5939680f07f0a98cfd8dbfa7ee994f7a02a5bcf0ac422d","observation_id":"f7eb983f-f5fe-46e0-b19b-ab1d3674e4a6","resolution":{"observed_at":"2026-08-06T18:45:43.022975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10762","last_updated":"2025-04-15T02:44:55Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T17:40:40Z","title":"AFlow: Automating Agentic Workflow Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10762","snapshot_observed_at":"2026-08-06T18:45:42.261460Z","title":"Aflow: Automating agentic workflow generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.261460Z"},"links":{"cited_paper":"/paper/2410.10762","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:efb3ae94bc850db84c8a8f40a31921e7cce84980fb1071f2985dac14f081ab22","observation_id":"bc9def31-20cf-4e04-a077-65e5c6cd55e1","resolution":{"observed_at":"2026-08-06T18:45:42.261460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17789","last_updated":"2024-10-28T13:19:38Z","snapshot_observed_at":"2026-08-16T13:31:13.150986Z","submitted_at":"2024-07-25T05:50:46Z","title":"Very Large-Scale Multi-Agent Simulation in AgentScope","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17789","snapshot_observed_at":"2026-08-06T18:45:42.266656Z","title":"Very large-scale multi-agent simulation in agentscope","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.266656Z"},"links":{"cited_paper":"/paper/2407.17789","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:adb9e5b6a022b42fadd9b2dc87e3cd86f7353604d231cb3455aadfbcdfff37d9","observation_id":"7c2ce70a-94c3-4c42-affe-fe97b883e641","resolution":{"observed_at":"2026-08-06T18:45:42.266656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08056","last_updated":"2025-02-12T01:36:27Z","snapshot_observed_at":"2026-08-15T08:59:30.629164Z","submitted_at":"2025-02-12T01:36:27Z","title":"Cognify: Supercharging Gen-AI Workflows With Hierarchical Autotuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08056","snapshot_observed_at":"2026-08-06T18:45:42.272015Z","title":"Cognify: Supercharging gen-ai workflows with hierarchical autotuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.272015Z"},"links":{"cited_paper":"/paper/2502.08056","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:8b58b34d19ec5412343294f09bee064643fb4b527c385689f26b39e3cf547297","observation_id":"ce19083b-5ba9-4f51-b18a-a88d0bb19648","resolution":{"observed_at":"2026-08-06T18:45:42.272015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.276704Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.276704Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:d94dbd7636c8edf725e45b97911415f5e83a1c14d9fabdd363387d4dbe195e9c","observation_id":"96a5f89f-c5d8-4ad5-abee-3a93b3096963","resolution":{"observed_at":"2026-08-06T18:45:42.276704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.992539Z","title":"Gonzalez, Clark W","venue":null,"work_id":"a4ca0d07-dde8-4e59-88be-c1a869339a69","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.281347Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:c2e6af9713617b5f07a5b6562c117431422ded461e4b64806e0f9f7baf57c682","observation_id":"bda1cd92-185a-472c-9c29-957d9edb573a","resolution":{"observed_at":"2026-08-06T18:45:42.996931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.977458Z","title":"TensorRT-LLM","venue":null,"work_id":"e9cbe961-b719-459c-a732-5b4c7e5b81f1","year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.286228Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:a7aa6ea69cd1f1baaf19beaf33e8a53f9bf9f1903df6ae49e37f1f0fd5f0929a","observation_id":"c7c4aa97-e930-41cd-bf27-9bdc2e4bce7c","resolution":{"observed_at":"2026-08-06T18:45:42.982123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.962186Z","title":"Automatic Prefix Caching","venue":null,"work_id":"b549e96a-ea1b-427a-9019-fe7aa8a38e39","year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.290936Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:db581aded2ada67edbad9cb2c8b7a275dbbd329e604a0ba08a81cebcc0c263bd","observation_id":"687a0462-43bb-40c4-8c89-d89cf734eba8","resolution":{"observed_at":"2026-08-06T18:45:42.966950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12457","last_updated":"2024-04-25T06:47:57Z","snapshot_observed_at":"2026-08-16T13:59:39.031764Z","submitted_at":"2024-04-18T18:32:30Z","title":"RAGCache: Efficient Knowledge Caching for Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12457","snapshot_observed_at":"2026-08-06T18:45:42.296114Z","title":"Ragcache: Efficient knowledge caching for retrieval-augmented generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.296114Z"},"links":{"cited_paper":"/paper/2404.12457","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:e3795af1e51df0665d45ea52e581d65503241d1be8da7e328ac13643e5b55b50","observation_id":"74408f15-ecf0-4635-b034-f7e1da15f41e","resolution":{"observed_at":"2026-08-06T18:45:42.296114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.947027Z","title":"{Cost-Efficient} large language model serving for multi- turn conversations with {CachedAttention}","venue":null,"work_id":"9ea43160-97a3-4684-b082-f1b17604c49d","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.302064Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:585747e3713ab060615387a73f034112d734e6928e92770ace65015ef32ca515","observation_id":"fb353792-c84a-45fa-98b5-ff09cd5c5a15","resolution":{"observed_at":"2026-08-06T18:45:42.951768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.306995Z","title":"Generative agents: Interactive simulacra of human behavior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.306995Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:3e03a0ef0a93ace29259763fabad7e49261f5622b9a9f7f751c9cd0280fd3adf","observation_id":"6426a51c-213d-4d06-b5d7-2c56a4c8a539","resolution":{"observed_at":"2026-08-06T18:45:42.306995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.311794Z","title":"A survey on large language model based autonomous agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.311794Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:b7509c172fea87eda38bae40c2fa3c8a643e39e3919ce4f71261d3afd6aee914","observation_id":"96815315-538e-4beb-b77a-fa09f0deda9a","resolution":{"observed_at":"2026-08-06T18:45:42.311794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-14T11:14:55.351653Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-06T18:45:42.316209Z","title":"Webarena: A realistic web environment for building autonomous agents","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.316209Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:fc4d145d88eed18837b6cf6055ddf714ea5cacb6e5d189c5ef95483219bc16b2","observation_id":"8cf33364-7348-4f83-9dcf-2c133442380a","resolution":{"observed_at":"2026-08-06T18:45:42.316209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08500","last_updated":"2024-01-16T17:00:36Z","snapshot_observed_at":"2026-08-16T14:27:03.786025Z","submitted_at":"2024-01-16T17:00:36Z","title":"Code Generation with AlphaCodium: From Prompt Engineering to Flow Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08500","snapshot_observed_at":"2026-08-06T18:45:42.320701Z","title":"Code generation with alphacodium: From prompt engineering to flow engineering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.320701Z"},"links":{"cited_paper":"/paper/2401.08500","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:5c80d02f719f2dbbab66acfbd726ff21f5f67873f4089d622d43e09337546173","observation_id":"6ec7bd6f-7b16-49e6-be9b-08466e82c288","resolution":{"observed_at":"2026-08-06T18:45:42.320701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05300","last_updated":"2024-03-26T14:32:33Z","snapshot_observed_at":"2026-08-17T08:58:00.366226Z","submitted_at":"2023-07-11T14:45:19Z","title":"Unleashing the Emergent Cognitive Synergy in Large Language Models: A Task-Solving Agent through Multi-Persona Self-Collaboration","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05300","snapshot_observed_at":"2026-08-06T18:45:42.325909Z","title":"Unleashing the emergent cognitive synergy in large language models: A task-solving agent through multi- persona self-collaboration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.325909Z"},"links":{"cited_paper":"/paper/2307.05300","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:b80a22618915770a45e742541c1ac9d4396411efa9150b267b68d10d77f4120f","observation_id":"007a7681-db51-4dd4-9127-da403a12d622","resolution":{"observed_at":"2026-08-06T18:45:42.325909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07822","last_updated":"2024-12-10T21:53:55Z","snapshot_observed_at":"2026-08-14T12:51:34.096973Z","submitted_at":"2024-12-10T21:53:55Z","title":"MAGE: A Multi-Agent Engine for Automated RTL Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07822","snapshot_observed_at":"2026-08-06T18:45:42.330477Z","title":"Mage: A multi- agent engine for automated rtl code generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.330477Z"},"links":{"cited_paper":"/paper/2412.07822","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:0efbb5249a300ac2b851cf8801bd9643d2e5b84503b4e095f60ebc12fe1cbc36","observation_id":"efa75a61-7f40-4e16-8f3e-6bc7ec6816df","resolution":{"observed_at":"2026-08-06T18:45:42.330477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07924","last_updated":"2024-06-05T13:23:49Z","snapshot_observed_at":"2026-08-16T00:37:44.307785Z","submitted_at":"2023-07-16T02:11:34Z","title":"ChatDev: Communicative Agents for Software Development","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07924","snapshot_observed_at":"2026-08-06T18:45:42.334764Z","title":"Chatdev: Communicative agents for software development","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.334764Z"},"links":{"cited_paper":"/paper/2307.07924","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:a48c7bc412f7d50699e649c9f097d47fe60152ff1fcfbcbed5c85220b00bc031","observation_id":"0af19f0d-9703-4ccb-8a29-fe0a9137a7e4","resolution":{"observed_at":"2026-08-06T18:45:42.334764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.339249Z","title":"Improv- ing factuality and reasoning in language models through multiagent debate","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.339249Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:251fcb09d078ffe538302f9cd1f63033581c5d826b05b243dc7675915795683f","observation_id":"071ae83c-0559-41d4-9882-9ab8bc5e9250","resolution":{"observed_at":"2026-08-06T18:45:42.339249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-08-13T23:55:57.074762Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-06T18:45:42.344014Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.344014Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:654c8c15b9bb0754ab92dbb2c0b1020723f20bd7eec261c7a96d63856e935e11","observation_id":"c39ff46b-ee40-459a-8bda-3d5cb2e53ba3","resolution":{"observed_at":"2026-08-06T18:45:42.344014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.348481Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.348481Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:6c3577b94c75eb626e268cdb52caec5f2dd1508b4504b64844b44656342144f4","observation_id":"5a0484f4-020a-4727-8d2e-9342846f4c11","resolution":{"observed_at":"2026-08-06T18:45:42.348481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.890301Z","title":"Prompt lookup decoding, November 2023","venue":null,"work_id":"c6f1af01-44fe-4614-9a64-92a4e1e6f5eb","year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.352902Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:850ef33726b9f815a7ce39046cc65378b3bb5684ed921fcc339caff5ea3fbd3f","observation_id":"3ba568b7-6fb8-4c60-afe1-3312768270a2","resolution":{"observed_at":"2026-08-06T18:45:42.894668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.874661Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"d2afc668-dc27-4dde-bbdb-e5495e062f6a","year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.357195Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:467785463af3aa43563624deed6ad72207f0449971c0b5fcbae83a98fd878844","observation_id":"ef4c5fae-3d8f-48b2-a03c-032fc212b8eb","resolution":{"observed_at":"2026-08-06T18:45:42.879053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20993","last_updated":"2025-05-27T16:41:53Z","snapshot_observed_at":"2026-08-12T17:14:32.746931Z","submitted_at":"2024-12-30T14:57:53Z","title":"Efficiently Scaling LLM Reasoning with Certaindex","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20993","snapshot_observed_at":"2026-08-06T18:45:42.361717Z","title":"Efficiently serving llm reasoning programs with certaindex","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.361717Z"},"links":{"cited_paper":"/paper/2412.20993","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:b565584155593050011c8db32d35791f470c3ebd9c25e58fdfd930f9b0f35791","observation_id":"cf829135-f430-4acc-8754-43b503bed880","resolution":{"observed_at":"2026-08-06T18:45:42.361717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.366575Z","title":"Orca: A distributed serving system for {Transformer-Based} generative models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.366575Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:d0e94b56ea965ff8b387f6b784af163be47540638769e444a7f85b688138e374","observation_id":"218cb1c7-c682-42ad-a1f2-aa2bae8309cc","resolution":{"observed_at":"2026-08-06T18:45:42.366575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05920","last_updated":"2024-09-25T05:57:51Z","snapshot_observed_at":"2026-08-16T21:53:57.298060Z","submitted_at":"2023-05-10T06:17:50Z","title":"Fast Distributed Inference Serving for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05920","snapshot_observed_at":"2026-08-06T18:45:42.370910Z","title":"Fast distributed inference serving for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.370910Z"},"links":{"cited_paper":"/paper/2305.05920","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:422d939114d4b0ea3cc602ab005ac19dcd29dc5f04b28aa40fbe34937202f0b1","observation_id":"8fc98626-c13a-466f-aff9-12bf892ad6e8","resolution":{"observed_at":"2026-08-06T18:45:42.370910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16283","last_updated":"2024-12-13T07:01:16Z","snapshot_observed_at":"2026-08-16T13:58:02.684989Z","submitted_at":"2024-04-25T01:56:00Z","title":"Andes: Defining and Enhancing Quality-of-Experience in LLM-Based Text Streaming Services","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16283","snapshot_observed_at":"2026-08-06T18:45:42.375175Z","title":"Andes: Defining and enhancing quality-of-experience in llm-based text streaming services","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.375175Z"},"links":{"cited_paper":"/paper/2404.16283","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:42d947dce76f2e951e54cef3dac9d2e4c3d0b6d2ee934fcb3e35cfbaa8a443e3","observation_id":"66d38722-36b3-4010-bb3f-fde70f928c6d","resolution":{"observed_at":"2026-08-06T18:45:42.375175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.849179Z","title":"Stateful large language model serving with pensieve","venue":null,"work_id":"edd5744c-ca98-4c06-b781-abb7dfeb7396","year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.379599Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:ae8512ebdec170866e27ec4e45460dfa363bdc9f6b166d443acbc29cc85b45df","observation_id":"39572001-5ffb-47af-b551-e1bd8474c506","resolution":{"observed_at":"2026-08-06T18:45:42.853980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01869","last_updated":"2024-05-30T04:18:03Z","snapshot_observed_at":"2026-08-16T14:22:01.054215Z","submitted_at":"2024-02-02T19:47:57Z","title":"InferCept: Efficient Intercept Support for Augmented Large Language Model Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01869","snapshot_observed_at":"2026-08-06T18:45:42.384225Z","title":"Infercept: Efficient intercept support for augmented large language model inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.384225Z"},"links":{"cited_paper":"/paper/2402.01869","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:d9719ba92b8a374ad26f5f8f6c9f0aa7d7acfdd88d320271d30a3f759bc3b6c0","observation_id":"519ae05f-2cce-46bd-92ab-866c62479560","resolution":{"observed_at":"2026-08-06T18:45:42.384225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13965","last_updated":"2025-02-19T18:59:30Z","snapshot_observed_at":"2026-08-16T20:52:07.705600Z","submitted_at":"2025-02-19T18:59:30Z","title":"Autellix: An Efficient Serving Engine for LLM Agents as General Programs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13965","snapshot_observed_at":"2026-08-06T18:45:42.388683Z","title":"Autellix: An efficient serving engine for llm agents as general programs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.388683Z"},"links":{"cited_paper":"/paper/2502.13965","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:3def124b3570705cedd8c44b5536b4603e38b7c91ac8fa40b3ee62054f958de2","observation_id":"f300aba2-02cf-48da-a93b-cbe612a86f26","resolution":{"observed_at":"2026-08-06T18:45:42.388683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.832833Z","title":"Parrot: Efficient serving of {LLM-based} applications with semantic variable","venue":null,"work_id":"a59769e2-eb68-431a-9b6b-1b04ae377d5f","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.393131Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:31551a757fa70106bfaae0e3422ed718efe6b9aca182d932e5f0314ffb43441a","observation_id":"99c684cf-6b44-4846-b990-b15ee6860f83","resolution":{"observed_at":"2026-08-06T18:45:42.837952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.816644Z","title":"LangGraph","venue":null,"work_id":"8c3e22e0-16b2-4814-9b32-633cf3d182cb","year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.397557Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:33797d9f76416a1ef029a1ee0ae996fe2deeab52afbad4fe85b9c112517a1c9f","observation_id":"72716aa1-a196-4ab0-9289-d329a85fc8d1","resolution":{"observed_at":"2026-08-06T18:45:42.821121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.801462Z","title":"Building effective agents","venue":null,"work_id":"c4fe69d7-3162-4298-8d60-17f1527c7882","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.402250Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:ec117aa28f16e84f213597c2b5b5b50bd02993e94c884254dfd44d1831a3261a","observation_id":"9e15dc4e-6d66-4013-92a9-70b26b4662fe","resolution":{"observed_at":"2026-08-06T18:45:42.805802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14034","last_updated":"2024-05-20T04:01:08Z","snapshot_observed_at":"2026-08-16T14:16:44.366665Z","submitted_at":"2024-02-21T04:11:28Z","title":"AgentScope: A Flexible yet Robust Multi-Agent Platform","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14034","snapshot_observed_at":"2026-08-06T18:45:42.406791Z","title":"Agentscope: A flexible yet robust multi-agent platform","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.406791Z"},"links":{"cited_paper":"/paper/2402.14034","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:a4dba950fe5c4f7cb5e996250b1d55b5277dadbd5f4ec46388e71d1c6639a3ed","observation_id":"13f354ff-166e-4bb5-ace0-ee2b53f11b46","resolution":{"observed_at":"2026-08-06T18:45:42.406791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02506","last_updated":"2024-10-03T14:14:31Z","snapshot_observed_at":"2026-08-16T13:12:57.732074Z","submitted_at":"2024-10-03T14:14:31Z","title":"Cut the Crap: An Economical Communication Pipeline for LLM-based Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02506","snapshot_observed_at":"2026-08-06T18:45:42.411640Z","title":"Cut the crap: An economical communication pipeline for llm-based multi-agent systems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.411640Z"},"links":{"cited_paper":"/paper/2410.02506","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:cdec793603fe6598512123e189152a763636b5f954309f44282c1066a4d5c4eb","observation_id":"887322ec-44c8-4927-a54c-ed5fc257900b","resolution":{"observed_at":"2026-08-06T18:45:42.411640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-14T00:46:54.019135Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":1,"verified_fuzzy":11},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 16 inbound Pith citation observations for arXiv:2507.07400."}