{"as_of":"2026-08-08T11:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bd5d8b40fe643cc11b9d74bf211ef56f4b5c2ba16fc2e9dc8ddc4dc79e4b9603","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T11:23:00.475610Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20495/citation-record","integrity":"/paper/2607.20495/integrity","json":"/paper/2607.20495/citation-record.json","paper":"/paper/2607.20495"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.244902Z","title":"SWE-bench: Can language models resolve real- world github issues?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.244902Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:57ceb4a864b10a6f29217eb60054ed72650d61d0c4ae761895ee1b6d327dfe8f","observation_id":"929236fa-a99b-4695-9162-c38c21a8de79","resolution":{"observed_at":"2026-08-02T11:22:56.244902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.323738Z","title":"Aiopslab: A holistic framework for evaluating ai agents for enabling autonomous cloud,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.323738Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:484711c7ace69ef2106a346d64e1673f97a9d1ecacf5d32d9e34181dd5aa25ad","observation_id":"7d4107bf-4e3e-48a7-8c5b-39d3d9c2eece","resolution":{"observed_at":"2026-08-02T11:22:56.323738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-02T11:22:56.388148Z","title":"The AI scientist: Towards fully automated open-ended scientific discovery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.388148Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:4fb14c0eb12910ea4d1b56917dacec13aef2cf5f456b3c3e5fdc9ef940b49b8b","observation_id":"5def4b6b-1ca8-4ebe-ab25-d1e3d5cc24f7","resolution":{"observed_at":"2026-08-02T11:22:56.388148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-01T14:58:15.255937Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-02T11:22:56.497764Z","title":"The AI scientist-v2: Workshop-level automated scientific discovery via agentic tree search,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.497764Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:4ada7aaaa46fa5a88527d6c146823fce62e6ac9163a6e949ae30baa5a5f3767c","observation_id":"50d6676c-1960-47a3-a93b-3a5d5c23f305","resolution":{"observed_at":"2026-08-02T11:22:56.497764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.575077Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.575077Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:09f2b9f1dece19f82caba5dd675eaa8c105d9b4ed66af3d888f9adffdc5307b3","observation_id":"8a747cde-1bdf-4960-8215-318906cf4cd9","resolution":{"observed_at":"2026-08-02T11:22:56.575077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.675764Z","title":"A survey on large language model based autonomous agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.675764Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:eba90eb69cc88a3b44b24082b70fe5d2c3dfa37a4049108a6f02995a2e418cdc","observation_id":"90061d91-f8a1-4ad9-b68b-4397ec455986","resolution":{"observed_at":"2026-08-02T11:22:56.675764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23077","last_updated":"2025-08-13T15:48:46Z","snapshot_observed_at":"2026-08-07T16:28:35.345205Z","submitted_at":"2025-03-29T13:27:46Z","title":"Efficient Inference for Large Reasoning Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23077","snapshot_observed_at":"2026-08-02T11:22:56.753787Z","title":"Efficient inference for large reasoning models: A survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.753787Z"},"links":{"cited_paper":"/paper/2503.23077","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:8c38636dfbe811e25571fe9ba50337c2d2bc7cc28c89b58583adb78f2fc45dd6","observation_id":"85b5b12b-36e8-4b0b-ab69-02ab238a07b0","resolution":{"observed_at":"2026-08-02T11:22:56.753787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.818911Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.818911Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:83998ce16c7cb607d5d96d718602ebae9454e9acc5f5370702658df1ad0d6bfe","observation_id":"3405c3e0-4a79-4b3d-9bf2-ad2f27e3fbb3","resolution":{"observed_at":"2026-08-02T11:22:56.818911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.880620Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.880620Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:d97e713f4738dcad00824601cc5f1a3bdd7a93b96d531f6345864c72a0ce35be","observation_id":"f7a1abed-baae-4dc3-bca2-14da69c7c662","resolution":{"observed_at":"2026-08-02T11:22:56.880620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.950669Z","title":"SGLang: Efficient execution of structured language model programs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.950669Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:415ab24c651038404774989b0175d81c7f907deb9b427f8fed337b6e055d1c14","observation_id":"49f31b2d-98e7-4fac-9407-2043cfe631bd","resolution":{"observed_at":"2026-08-02T11:22:56.950669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-07T15:13:30.957626Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-02T11:22:57.020958Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.020958Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:2233603c4bbfc9b9f18b94b884a5af4f75fc816d1fa5273a4a6cfa439e131511","observation_id":"bd742d16-48fb-4143-9404-57f04d3397a2","resolution":{"observed_at":"2026-08-02T11:22:57.020958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.090168Z","title":"KVCOMM: Online cross-context KV-cache communication for efficient LLM-based multi-agent systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.090168Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:a7322de1800910787009f2c14103500a848ba2ab12a082d1f278f2da98bbc175","observation_id":"2051d56d-0e40-4490-bb31-e527fbc1032e","resolution":{"observed_at":"2026-08-02T11:22:57.090168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.161637Z","title":"GPTCache: An open-source semantic cache for LLM applications enabling faster answers and cost savings,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.161637Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:ae24812c9b1b90df9fe649b7fafefd63f1722563da05bf0e3d36c90d97512c5c","observation_id":"4cea82c2-b216-4db5-9c8a-7d1847b8794e","resolution":{"observed_at":"2026-08-02T11:22:57.161637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.219423Z","title":"Billion-scale similarity search with GPUs,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.219423Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:503d8e53b7931d1fb9a5f57ef62a132e8b4b80d248d293a598b552c1c1d4016e","observation_id":"7aa66d5f-b2f7-4a5a-9352-8a7667b76e68","resolution":{"observed_at":"2026-08-02T11:22:57.219423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.381659Z","title":"Cortex: Achieving low-latency, cost-efficient remote data access for llm via semantic-aware knowledge caching,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.381659Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:71f389e9ce9b2525493b49a5591724fb8325498eec800aa787ef8a2173311ce9","observation_id":"32ac36b4-b2b6-40ba-8ce0-2473484ad29f","resolution":{"observed_at":"2026-08-02T11:22:57.381659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.453149Z","title":"Agentic plan caching: Test- time memory for fast and cost-efficient LLM agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.453149Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:4d56fbb4b015c6a016ab9fc4a2fd847e927aaa480957208a5a09814a1d653593","observation_id":"0d6c4385-9bf7-473c-9e70-4ea0ff94bb21","resolution":{"observed_at":"2026-08-02T11:22:57.453149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.523453Z","title":"Semanticalli: Caching reasoning, not just responses, in agentic systems,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.523453Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:991f1714642b3c79ad38983ab15422034f631f3ec14d3aec80cfb035e4b1d73c","observation_id":"1e81c84c-8d48-4e90-b085-c25c0b521bbc","resolution":{"observed_at":"2026-08-02T11:22:57.523453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.708196Z","title":"Lrc: Dependency-aware cache management for data analytics clusters,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.708196Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:1b12594a00d8476ba4cd914db4040b3d2e210dbfe9803c3e7ae9184d05b73744","observation_id":"fbbfc3a4-a13a-485c-8f27-5ed4be2e024b","resolution":{"observed_at":"2026-08-02T11:22:57.708196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.823282Z","title":"Resilient distributed datasets: A {fault-tolerant}abstraction for{in-memory}cluster computing,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.823282Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:938ee0b938226625803ff2999aea0a69fe7014207709e426495d09b31bfa74bf","observation_id":"ea4c7af5-5500-4db9-aaa6-7002102504cb","resolution":{"observed_at":"2026-08-02T11:22:57.823282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.938531Z","title":"Lerc: Coordinated cache management for data-parallel systems,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.938531Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:53186080df834dedc585a42750ee555a852901f02b73247261a1606d825d568e","observation_id":"33598cc5-f8d4-4797-9b12-33ea4034a3aa","resolution":{"observed_at":"2026-08-02T11:22:57.938531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.063849Z","title":"S/c: Speeding up data materialization with bounded memory,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.063849Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:fddcf22eaa1cb042fe412d24c9ea7830b4d97e26f418fde14e508f7414fdc61d","observation_id":"4cfa7766-1f1a-45b0-988d-61df84c25e52","resolution":{"observed_at":"2026-08-02T11:22:58.063849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08018","last_updated":"2023-07-16T12:06:00Z","snapshot_observed_at":"2026-07-06T15:54:32.519590Z","submitted_at":"2023-07-16T12:06:00Z","title":"Real-Time Analytics by Coordinating Reuse and Work Sharing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08018","snapshot_observed_at":"2026-08-02T11:22:58.148809Z","title":"Real-time analytics by coordinating reuse and work sharing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.148809Z"},"links":{"cited_paper":"/paper/2307.08018","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:5a8571a34ac2cc839a4eb3e140bce2ce4c2b11acdf93fea36cbaf647f7195ab4","observation_id":"6aaff067-d55c-4781-a05b-0c954a1bd20b","resolution":{"observed_at":"2026-08-02T11:22:58.148809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.262762Z","title":"S-dag: A subject-based directed acyclic graph for multi-agent heterogeneous reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.262762Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:3b13ff91563c8d032e042e2d04a9aa7d1b9345c7c652c2fa5f1af2ac26d890a3","observation_id":"eedabd05-de26-4cd0-b203-b0ade40d9974","resolution":{"observed_at":"2026-08-02T11:22:58.262762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.365011Z","title":"Agentnet: Decentralized evolutionary coordination for LLM-based multi-agent systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.365011Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:be0faa930114a161ece0a0142f7b8c6fdf5cb768479ca40d00b9ec2315974c3c","observation_id":"b3ece365-7ef1-4941-a231-0b5975135091","resolution":{"observed_at":"2026-08-02T11:22:58.365011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.483202Z","title":"Benchmarking agentic workflow generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.483202Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:675dac568b509cb5ea79900d2a1aeaa3da93d72ac3bca2a399e21d63f9ead44b","observation_id":"74e5828f-e0d4-4f34-ac9b-336eb4aa8105","resolution":{"observed_at":"2026-08-02T11:22:58.483202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.628928Z","title":"Kairos: Low-latency multi-agent serving with shared llms and excessive loads in the public cloud,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.628928Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:8e88a24aafc7e23cf9f45d09f3bad86413584576bfb19ac85dbb39ff629094fd","observation_id":"3509fcfa-6633-41b4-9230-22a4839a9883","resolution":{"observed_at":"2026-08-02T11:22:58.628928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.843180Z","title":"Towards end-to-end optimization of llm-based applications with ayo,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.843180Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:6c9e7ca4c205be591c2db7e3324a56981e2da08267c527da2d541bab169e3a48","observation_id":"00ed3a32-6ad2-4bc9-ac69-e528b27ada66","resolution":{"observed_at":"2026-08-02T11:22:58.843180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.949619Z","title":"AFlow: Automating agentic workflow generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.949619Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:0925c77e510a831ed039e9dd5d75af8a2463d1101f7845bfb05cf0c0ee8f2481","observation_id":"26115895-48f4-4560-b761-93f7312ff447","resolution":{"observed_at":"2026-08-02T11:22:58.949619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.010703Z","title":"Automated design of agentic systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.010703Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:8de217b3b7838dba8699c24f2f5e6fc49851c0042c40e0f042aaab934c25428a","observation_id":"0a3e0a95-cba2-42ff-9729-71f81d33eff5","resolution":{"observed_at":"2026-08-02T11:22:59.010703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01747","last_updated":"2025-09-04T16:22:32Z","snapshot_observed_at":"2026-07-06T19:44:34.642049Z","submitted_at":"2024-11-04T02:08:59Z","title":"DynaSaur: Large Language Agents Beyond Predefined Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01747","snapshot_observed_at":"2026-08-02T11:22:59.122377Z","title":"Dynasaur: Large language agents beyond predefined actions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.122377Z"},"links":{"cited_paper":"/paper/2411.01747","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:7a034d9a6dea365d17e0ea740da324ba2c5b21a3be6a2225096de5c734152d35","observation_id":"14e41f65-5d2b-4709-8cfc-bdcb8e92980e","resolution":{"observed_at":"2026-08-02T11:22:59.122377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.288250Z","title":"Slidevqa: A dataset for document visual question answering on multiple images,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.288250Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:7959cca8d1d4c8b6e31502c1f6e385f9c59c34646c51b2044816307a707c1a33","observation_id":"81d7bae8-3ac3-4930-894c-15833ee89db3","resolution":{"observed_at":"2026-08-02T11:22:59.288250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05935","last_updated":"2023-04-01T10:00:35Z","snapshot_observed_at":"2026-08-07T11:26:39.139402Z","submitted_at":"2022-12-07T10:09:49Z","title":"Hierarchical multimodal transformers for Multi-Page DocVQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05935","snapshot_observed_at":"2026-08-02T11:22:59.426670Z","title":"Hierarchical multimodal transformers for multi-page docvqa,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.426670Z"},"links":{"cited_paper":"/paper/2212.05935","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:fda05bc7709792be1c247d35a8b8f835bb696fccde213a70097acc9e7ff6fc6b","observation_id":"a5c121cd-a98d-42da-bb1a-c495f9e5f330","resolution":{"observed_at":"2026-08-02T11:22:59.426670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.590150Z","title":"Video-mme: The first-ever comprehensive evaluation benchmark of multi-modal llms in video analysis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.590150Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:2acd96fc6150e4e47c19ddf8d909ef2d14197d4f8e06dfb7c2a7ff8b0716a6a0","observation_id":"6e0dcf2b-9b32-46d8-873c-7bc6fb172c8b","resolution":{"observed_at":"2026-08-02T11:22:59.590150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.700138Z","title":"Plan-and-act: Improving planning of agents for long-horizon tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.700138Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:0a16ec64816714f2fb638fd727773511d2a08ca738319eacf55d237d1870627d","observation_id":"5c62be42-8fd7-41a9-a95d-88abb906aec5","resolution":{"observed_at":"2026-08-02T11:22:59.700138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.809932Z","title":"ARC: A Self-Tuning, low overhead replacement cache,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.809932Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:7d4d2f99309c5abe0096652ba065fd1ba964731b9ab4c2f396139098210b58fa","observation_id":"ada20323-bc55-4679-aec6-8b0e0b1a5360","resolution":{"observed_at":"2026-08-02T11:22:59.809932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.966611Z","title":"An llm compiler for parallel function calling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.966611Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:582807420a7d3b46f9774b0fe96b1fb9b4316bec64cf79d45683edda75fc0f25","observation_id":"319da7b0-28c4-4b75-956f-6677510b5675","resolution":{"observed_at":"2026-08-02T11:22:59.966611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-02T11:23:00.070441Z","title":"Qwen2.5 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T11:23:00.070441Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:24dfb52fc934abfafdd55e9339c6605c1139f19fce5c21b63cc2eae7602f5595","observation_id":"262c7428-b251-4ebb-8c8a-ca3f8047d0fb","resolution":{"observed_at":"2026-08-02T11:23:00.070441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:23:00.195827Z","title":"Ollama: Run AI models locally,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T11:23:00.195827Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:52835a3fa070d4eaf38d6e93a885ae1eb19ecbe0d0005c72dee7ca87aacf016b","observation_id":"aeeb0b4c-e08d-4d81-9138-afe8f276eee5","resolution":{"observed_at":"2026-08-02T11:23:00.195827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16219","last_updated":"2024-11-15T22:37:48Z","snapshot_observed_at":"2026-08-06T10:58:17.028489Z","submitted_at":"2024-04-24T21:35:12Z","title":"Can Increasing the Hit Ratio Hurt Cache Throughput? (Long Version)","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16219","snapshot_observed_at":"2026-08-02T11:23:00.299874Z","title":"Can increasing the hit ratio hurt cache throughput? (long version),","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T11:23:00.299874Z"},"links":{"cited_paper":"/paper/2404.16219","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:c5c7336b79d502bedafb020b9715e727b134e4e61b5d464cc5c04d3bf06d8b7d","observation_id":"5aad65d3-e372-4ba7-b045-4e4fdebed334","resolution":{"observed_at":"2026-08-02T11:23:00.299874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:23:00.475610Z","title":"Mistral Small 3.2,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T11:23:00.475610Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:957ebf73289ec3b775d9cc649383152747b9466f82eee8f90c2e815505866555","observation_id":"413ff1bb-9d1c-4b29-9fc2-1c85d56c5a60","resolution":{"observed_at":"2026-08-02T11:23:00.475610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06948","last_updated":"2025-08-09T11:45:57Z","snapshot_observed_at":"2026-08-05T22:27:31.581238Z","submitted_at":"2025-08-09T11:45:57Z","title":"Kairos: Low-latency Multi-Agent Serving with Shared LLMs and Excessive Loads in the Public Cloud","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06948","snapshot_observed_at":"2026-08-02T11:22:58.727229Z","title":"Available: https://arxiv.org/abs/2508.06948","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.727229Z"},"links":{"cited_paper":"/paper/2508.06948","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:c7cc9eeab49643e52e3461773fe6354adc863124cf7cf4d45e3523f24a2cb8b1","observation_id":"f7ab6e29-14f5-4dec-a243-44f72d744e44","resolution":{"observed_at":"2026-08-02T11:22:58.727229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T17:08:54.410715Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2607.20495."}