{"as_of":"2026-08-13T14:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3051cca13203d3370cb52cfa613bae9f99d675444680b047fcd688d8462ffae6","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:21:09.423239Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.18736/citation-record","integrity":"/paper/2508.18736/integrity","json":"/paper/2508.18736/citation-record.json","paper":"/paper/2508.18736"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:08.967594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.967594Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:be8f44c4775dfe97baa8e9030a467c1cd49559b24f74f4047999b06464ec4b7f","observation_id":"c6919733-900e-40c9-a755-6eaa8fe6edfb","resolution":{"observed_at":"2026-08-05T16:21:08.967594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:08.973100Z","title":"Friedman, Thomas Williams, Ramesh K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.973100Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:072e3de7c2f621bd8d0b5fde437b0410a358e34642ac5dc4fad0575623430685","observation_id":"78d93f28-82a0-413b-8366-f54349e7937e","resolution":{"observed_at":"2026-08-05T16:21:08.973100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.206762Z","title":null,"venue":null,"work_id":"182eb270-29c6-468e-9432-5ae1ebf133d2","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.978284Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:4f8c22e98a9fccf92a236608b67300c3e924eccd7ded586b7238f68e9e6d5367","observation_id":"6cf8142c-8315-40bf-b5db-1a681bc9a22c","resolution":{"observed_at":"2026-08-05T16:21:11.212250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.187233Z","title":null,"venue":null,"work_id":"9f5af578-992c-48e0-a580-f19b240d8378","year":1999},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.983281Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e23085352276f5aeb78fbedacf76b53839c053e5d8f73b13751702afdb17e025","observation_id":"c52d962d-5b0a-4596-87cf-6ad0eb4a85a2","resolution":{"observed_at":"2026-08-05T16:21:11.194673Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.167054Z","title":"Diochnos, and György Turán","venue":null,"work_id":"c0e93dd8-95a8-413b-8af0-9895bc42ee61","year":2020},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.988478Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:513e5517a4483e1a086cc8e65984d9e54f31620ece5d08b31189b97bd8bc526d","observation_id":"d24b6b40-b210-4202-94bd-3cb5e61ea35b","resolution":{"observed_at":"2026-08-05T16:21:11.173770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.146690Z","title":null,"venue":null,"work_id":"19d21f9d-0b93-4473-9717-927811c689a1","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.993414Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:74bc6bfd4bc071d37359a46be101e25303965103c6f44a7797b7c5ed618043ec","observation_id":"858fafc1-c44d-42ab-9f1a-9cfbaa1a41df","resolution":{"observed_at":"2026-08-05T16:21:11.153324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.124183Z","title":null,"venue":null,"work_id":"5ad73984-fe86-46d2-a638-626610aaf7a1","year":2020},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.999121Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:22a7e8a23a761cf7d35a4aadf13da36344e493cb50f45a8aa8a7f0ff5328d02c","observation_id":"dabc0472-4746-4d4f-93fc-0463681757fc","resolution":{"observed_at":"2026-08-05T16:21:11.130237Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.106992Z","title":null,"venue":null,"work_id":"19b9903d-34d9-4956-9568-825f7027de45","year":2013},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.004112Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:d01343beed8d6ed51cb0b7f7e44cd8a8f8d409be1db1a7a369aa5cfb38c9678b","observation_id":"424a3847-d3d4-4b58-9a77-788707fb8b87","resolution":{"observed_at":"2026-08-05T16:21:11.112356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.090575Z","title":null,"venue":null,"work_id":"c4cb9a62-bb56-40b2-8eeb-750318662e9b","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.008942Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:517e9c5a4486ae95f4108c048c094922fbc558e9f8f34a8b20e0a28c9c6aac77","observation_id":"d39d6c18-c2f3-4c12-91f1-765ce14436d0","resolution":{"observed_at":"2026-08-05T16:21:11.095229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.073792Z","title":null,"venue":null,"work_id":"9e3cec6b-99d8-413c-8c7f-c6b6fa353980","year":2022},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.015714Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:0f018c48f650b69075755b769515e34aeedf0a6a00ee71e083991e388a093df6","observation_id":"1e87b0fe-fbec-419c-a703-8c48562ff3fe","resolution":{"observed_at":"2026-08-05T16:21:11.078762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.057284Z","title":null,"venue":null,"work_id":"af19c938-0e00-460e-9cd8-28323693a5df","year":1994},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.021044Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:2fa91a5291865838054d100b3c73ed229a764b636cd296d846e2e7d96219e552","observation_id":"d697c792-8196-43ff-a052-cd4431807435","resolution":{"observed_at":"2026-08-05T16:21:11.062376Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.038305Z","title":null,"venue":null,"work_id":"1028db39-f00e-4de4-a0b7-773ff989b55f","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.026770Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e1636762d00837d49a7b02c17d7b2442425221cd4ae5985ba6eb476cc5f0aa84","observation_id":"98d3eebb-f1f6-462d-af13-92c41bde8ebd","resolution":{"observed_at":"2026-08-05T16:21:11.044148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.016683Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christoph er Ré","venue":null,"work_id":"d399320d-7486-4274-98b5-918b647aa485","year":2022},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.031349Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:87010b8b9f3ef5d71de34cdefd1d699d0dc7e9dcd926d29795bf1d067397b933","observation_id":"ed20cb44-9cf8-40ad-aca8-4c9eb935319d","resolution":{"observed_at":"2026-08-05T16:21:11.021657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.000281Z","title":"Franklin, Björn Þór Jónsson, Divesh Srivast ava, and Michael Tan","venue":null,"work_id":"ca9ffde0-6b50-49fa-9a6d-5eebb3b65528","year":1996},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.036453Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:8c1ee18bd04fbca2fff436eb7aa40d160ed0b3f631b6d49303487dcda53bdd3c","observation_id":"8d1aa310-3765-4b35-8515-9a150867dca3","resolution":{"observed_at":"2026-08-05T16:21:11.005739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.984251Z","title":null,"venue":null,"work_id":"c1deb3bc-1687-4949-86b4-6c05dd12f9ee","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.041255Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e6505295c094c77a05a393a91319ebd5d584cac8a4349cce31f941aa2129b3a2","observation_id":"f1568b58-0736-4354-a949-aff88f306996","resolution":{"observed_at":"2026-08-05T16:21:10.988991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.968044Z","title":null,"venue":null,"work_id":"d4e67505-bd72-44f6-a53f-dd264c862705","year":2005},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.046577Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:d0cf51cc60e75c13a306b08ea0cde08f01bda423eb3450f7e040b2cf6084aca8","observation_id":"c3c04eae-ff93-427a-972b-9bd43047d2c1","resolution":{"observed_at":"2026-08-05T16:21:10.973134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.950249Z","title":null,"venue":null,"work_id":"87f26e7a-5b69-4e74-843c-dc60f3ea029d","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.051348Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:05e5685a2920022ccbff4100442373f98d7a8fa5ec589cdc536737d7f35620a1","observation_id":"e7bef831-e068-49b3-b57a-c831921aa8a4","resolution":{"observed_at":"2026-08-05T16:21:10.955802Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T16:21:09.056946Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.056946Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:d58128a4fe9bfc5479af199097d82f1dea7dfc786bb239fd0ed3c5de10df8abe","observation_id":"ab63d14c-727e-4337-beb5-c39b60ccca8c","resolution":{"observed_at":"2026-08-05T16:21:09.056946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-05T16:21:09.063232Z","title":"Hashimoto","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.063232Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:6653133dd6771eced36bccc5e83d43bc6b5d322eddc5111e94c3ca853147671f","observation_id":"05b381e6-b7d8-4916-b995-7dd8de9f97aa","resolution":{"observed_at":"2026-08-05T16:21:09.063232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.931723Z","title":null,"venue":null,"work_id":"cc862329-d6b0-4c6b-87c4-f0c346c347ad","year":1996},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.068768Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:2b6b5a388787076f94852c6d954df700135f532282e5752393bbbafb417ed643","observation_id":"4ad55ba6-b621-4db7-9911-1c4a24949c93","resolution":{"observed_at":"2026-08-05T16:21:10.937342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.914341Z","title":null,"venue":null,"work_id":"21158c48-ba38-485e-bdd7-b8ce04afb687","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.075098Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:1533291506eeb9340103ac45ee02f71de9508928c2a9d0d053c41445a1f26359","observation_id":"69b63203-c8d6-4f99-ae25-7d17f7b98a11","resolution":{"observed_at":"2026-08-05T16:21:10.919321Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02694","last_updated":"2025-03-07T14:49:07Z","snapshot_observed_at":"2026-08-13T04:03:21.839194Z","submitted_at":"2024-03-05T06:23:50Z","title":"MeanCache: User-Centric Semantic Caching for LLM Web Services","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02694","snapshot_observed_at":"2026-08-05T16:21:09.080027Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.080027Z"},"links":{"cited_paper":"/paper/2403.02694","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:082dd00770e1d25133d3c17492105c32d7c2b3fa658abf77a0c4ae73737ed4ab","observation_id":"c5054ce4-24c9-4b66-845a-01721d0ddbe9","resolution":{"observed_at":"2026-08-05T16:21:09.080027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.896844Z","title":null,"venue":null,"work_id":"2973dfd9-f17b-4ecf-b1bb-0ca7d96bce95","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.085155Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:3bc116ec80856b10dcc4fe2fd6010b51fdc0a47df7ddf6adf791ffe00c8b0c6d","observation_id":"941ffc24-8cd7-439c-acf9-2a8a1b248d64","resolution":{"observed_at":"2026-08-05T16:21:10.902435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.876391Z","title":null,"venue":null,"work_id":"9864499a-2913-4854-85dc-ab179be8ab8a","year":2017},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.090467Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e2379b2730b8ac1d693000a2a04ea01d229dcd17545d76b8fd8f3adcb84df7fc","observation_id":"5c8a123f-0514-41a4-ad41-7b363bd16b09","resolution":{"observed_at":"2026-08-05T16:21:10.881636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.858816Z","title":null,"venue":null,"work_id":"283e1134-fcfd-4c62-9240-352b2a0f3adb","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.097010Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:d746a6ce75fa73db0ee175b0ad829ab4d431a3b2f28a0486ce3e83905718f888","observation_id":"d92789fe-cabf-4ec1-bfd1-3dd951288b53","resolution":{"observed_at":"2026-08-05T16:21:10.864701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08671","last_updated":"2024-01-09T06:49:40Z","snapshot_observed_at":"2026-08-13T10:02:11.727756Z","submitted_at":"2024-01-09T06:49:40Z","title":"DeepSpeed-FastGen: High-throughput Text Generation for LLMs via MII and DeepSpeed-Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08671","snapshot_observed_at":"2026-08-05T16:21:09.103693Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.103693Z"},"links":{"cited_paper":"/paper/2401.08671","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:723323e1114c49260a097331e4ba155cea9c3e86d8bf3feb1de760c249e486e1","observation_id":"f846ec65-36d7-4250-8207-3cbfadd1c795","resolution":{"observed_at":"2026-08-05T16:21:09.103693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.840140Z","title":null,"venue":null,"work_id":"9e92169e-f9cb-4246-9556-8558b18f4edd","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.110862Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:965c882545205f44213f1cdefff317cdb1a29082748ab66c510e738e3d6b9caa","observation_id":"843860fe-3f61-4436-ae99-f329249799c4","resolution":{"observed_at":"2026-08-05T16:21:10.846298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.822648Z","title":null,"venue":null,"work_id":"9dfed572-fc58-4046-aae1-53267cb1dca7","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.117131Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:938944d5340609e10fd7a38eb48fd4c3cb973a81cf8b19761c92bf046d0c6059","observation_id":"f1ae3ebd-4f17-474c-92f4-3c37b430e1fe","resolution":{"observed_at":"2026-08-05T16:21:10.827848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.803979Z","title":"Mahoney, Yakun Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"8531b5aa-43bb-4db7-bcc9-c3685bb3be8f","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.123173Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:7c856aad40c891cccaeddb74074d246862fc321684e7629a119b2455c4a5e162","observation_id":"8993b5fd-8ef2-416d-80d9-c35d0730e9f6","resolution":{"observed_at":"2026-08-05T16:21:10.810191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:09.128203Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.128203Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:b22d121a427f9cc97da25c187dfee4101256985894dd8cf96e9ab31445d08f6e","observation_id":"91052a79-25e5-4150-ad23-def344ee98e2","resolution":{"observed_at":"2026-08-05T16:21:09.128203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14966","last_updated":"2025-06-12T01:39:50Z","snapshot_observed_at":"2026-08-12T03:57:33.625241Z","submitted_at":"2025-04-21T08:48:48Z","title":"SLO-Aware Scheduling for Large Language Model Inferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14966","snapshot_observed_at":"2026-08-05T16:21:09.138449Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.138449Z"},"links":{"cited_paper":"/paper/2504.14966","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:f51f2e2ef3bf34e3326e8ca8da676e9a4cfc0b2e9498c7752eca58d80b40195f","observation_id":"9023d0cc-e6af-4fb3-8471-e632336756a3","resolution":{"observed_at":"2026-08-05T16:21:09.138449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.772270Z","title":null,"venue":null,"work_id":"6295e6b2-eccb-4ace-a637-87bdad4d8f34","year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.145016Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:76a3f92d0a7c30382b152cee2304aff4655800ff224b9c8d426b3187d89aea07","observation_id":"548772b9-8582-4a74-9677-78ec1450fcb3","resolution":{"observed_at":"2026-08-05T16:21:10.777691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.736683Z","title":null,"venue":null,"work_id":"30b8dbae-f1fc-49db-a518-582d777e6350","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.157714Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:b1e5a0d373de374fd3328f7ef793e06e0e1ec6ab0744df0328ae4da37e56e776","observation_id":"0dc1b74d-cbdd-4973-bac4-523907d2bde0","resolution":{"observed_at":"2026-08-05T16:21:10.742811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.718521Z","title":"Keller and J","venue":null,"work_id":"26de1436-e4b7-45a6-b8a0-7cadb244f303","year":1994},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.164092Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:49a2efcbce682733e2ec96dffe0413598b94fdbf9dfe6c91cbbf484065d65930","observation_id":"0f94cee0-4e17-43b9-8baa-301b7705ccf8","resolution":{"observed_at":"2026-08-05T16:21:10.724036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.699604Z","title":"Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":null,"work_id":"1327da8f-a8c4-4ab8-9cc2-a0d2e11e3ecf","year":2019},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.169295Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:bca6f98f38981c125d3ddeae4f0f4888de8fac47d24db26c6412b90648084755","observation_id":"e706cb84-df1a-4035-b704-cfbe66d3acc6","resolution":{"observed_at":"2026-08-05T16:21:10.705134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:09.173911Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.173911Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:63f44e3b90c038d5120b96146d3ffc6e89be689693fbc48e83551b93bba15ea9","observation_id":"30721561-cd4e-4256-b1dd-4ef242573086","resolution":{"observed_at":"2026-08-05T16:21:09.173911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.01792","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:09.888344Z","title":null,"venue":null,"work_id":"f2d08731-1b2d-4b81-936c-b4731112c1f1","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.188871Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:d94e1caa622e54708e90e2f9e255c3b2e1491532794c9752d10241fafa27cee1","observation_id":"809e895c-b432-46c3-85fd-aad2674f0039","resolution":{"observed_at":"2026-08-05T16:21:09.897655Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.654392Z","title":null,"venue":null,"work_id":"837b5920-c312-4e68-aeee-2ed388ee375b","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.193662Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:ba32c32f127a7c4895a56d08a905b716602b44293056f5280129dcfb96c567a6","observation_id":"b1e353c8-9791-40db-9ef9-ebf54d58fc84","resolution":{"observed_at":"2026-08-05T16:21:10.659375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00025","last_updated":"2024-05-24T08:16:22Z","snapshot_observed_at":"2026-08-12T23:59:02.374422Z","submitted_at":"2024-05-24T08:16:22Z","title":"SCALM: Towards Semantic Caching for Automated Chat Services with Large Language Models","version":1},"cited_work":{"arxiv_id":"2406.00025","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.00025","snapshot_observed_at":"2026-08-05T16:21:09.714795Z","title":"SCALM: Towards Semantic Caching for Automated Chat Services with Large Language Models","venue":"cs.CL","work_id":"0c1fae36-6ab8-4148-979c-ee364bf28c8a","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.198859Z"},"links":{"cited_paper":"/paper/2406.00025","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:65a061bfef3baeaa905fe8f276852f279a3afb6b943706396f242e73f93fcb8d","observation_id":"fb45f469-4fe9-4896-8071-26ba282ff407","resolution":{"observed_at":"2026-08-05T16:21:09.723500Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.636610Z","title":"Gonza- lez, and Ion Stoica","venue":null,"work_id":"409a348f-c46e-45cb-a63f-f351091384ce","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.204659Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:caf7ec52caa30e88132fead67374ab88deccdea41cb3bcdf9809f0f787062745","observation_id":"33f3a0f6-ebee-449d-b5ee-e12b70fb293c","resolution":{"observed_at":"2026-08-05T16:21:10.642783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.617325Z","title":"Gonza- lez, and Ion Stoica","venue":null,"work_id":"72613e45-6b38-43b2-a9bf-d0b184db241e","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.209930Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:fa39203bf3ac4b46a251775fe9647743f1dad14baca8b6b33f6cddda98bbd890","observation_id":"a2e288ed-815e-41bb-8133-04ea3df53e1c","resolution":{"observed_at":"2026-08-05T16:21:10.622493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.600962Z","title":null,"venue":null,"work_id":"916069ff-6948-41d4-bd4e-5b43651972a9","year":1967},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.215171Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:0fc6c7fb26fba8859c5d6efbe4b2cc3048aafa88c45dfeb6b825bcd6c0da2f59","observation_id":"cf76bc90-910f-41c2-b5fa-ca53b53bc8e4","resolution":{"observed_at":"2026-08-05T16:21:10.605791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.585165Z","title":"Malkov and D","venue":null,"work_id":"cba855b0-5f0f-4ea0-aeb7-a7081740f246","year":2020},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.220161Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:3b4d6b53576ef56de5813923abdbb1586fb06ecddb3328c20175c8fe20109af0","observation_id":"ebb2e859-9449-4f03-ad87-4ef3c35da9fe","resolution":{"observed_at":"2026-08-05T16:21:10.590105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.568848Z","title":null,"venue":null,"work_id":"4eae6e8a-a87b-42da-aa97-aaf8c26215be","year":2020},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.225585Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:1ae89b7dfb4eeb4284549d625b20783458bf303548233539617b5fafb87e4b2e","observation_id":"50de1bc4-33e6-4e44-9f7c-3214d039437c","resolution":{"observed_at":"2026-08-05T16:21:10.573853Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.550826Z","title":null,"venue":null,"work_id":"f3862924-4e0a-4c6c-9172-3d629702bbf7","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.230565Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:bdc4d583eb80863c3336ed67b25a400e098d8a092599baf30677fd3d633b2daf","observation_id":"08528559-690a-4823-9962-d9af11592ab6","resolution":{"observed_at":"2026-08-05T16:21:10.556522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.530029Z","title":null,"venue":null,"work_id":"139cfb8b-8ab2-4507-9129-4f04ba1b3496","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.235440Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:3e9181a7f80d47df4aa9393752ef02eac8ad292558f2a393a142b7c9ab110913","observation_id":"65e7e229-1d21-4d2d-a5df-d9a5b90b870a","resolution":{"observed_at":"2026-08-05T16:21:10.536276Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09268","last_updated":"2018-10-31T14:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-11-28T18:14:11Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09268","snapshot_observed_at":"2026-08-05T16:21:09.240683Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.240683Z"},"links":{"cited_paper":"/paper/1611.09268","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:acabc249f4a392b5861cdfb4c6f15f88452d0c138bbe97a6ecfb0734e68baa4f","observation_id":"f7db5e7e-297f-4cb1-8781-7d70db603bd1","resolution":{"observed_at":"2026-08-05T16:21:09.240683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06856","last_updated":"2024-05-11T00:00:23Z","snapshot_observed_at":"2026-08-13T00:09:55.953046Z","submitted_at":"2024-05-11T00:00:23Z","title":"Aladdin: Joint Placement and Scaling for SLO-Aware LLM Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06856","snapshot_observed_at":"2026-08-05T16:21:09.246158Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.246158Z"},"links":{"cited_paper":"/paper/2405.06856","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:61c34c8f5378771f897517d9262c8c0744bc45c2e32d015148b7b97753a70f0a","observation_id":"bb85f735-5cd7-433c-8523-843499596bbd","resolution":{"observed_at":"2026-08-05T16:21:09.246158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.511617Z","title":"Li, Ryan McElroy, Mike Paleczny, Daniel Peek, Paul Saab, David Staﬀord, Tony Tung, and Venkateshwaran Venkatara- mani","venue":null,"work_id":"a76c7666-5db4-4373-bbb0-7136dde9a624","year":2013},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.252250Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:06adb075f6ec9556d35524421f61ca01dba6116e68ccf4c10ddbc981c23b15a8","observation_id":"ab04e361-d65f-4e2c-aee0-9246b33488b3","resolution":{"observed_at":"2026-08-05T16:21:10.517001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.495430Z","title":null,"venue":null,"work_id":"162dda60-4e8f-400a-9c02-ec4fdd652bb2","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.257750Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:bcdcd53504f3bb2f7f1fcd2295f466646167fa60ff48af1e1ed0b20158fb4b43","observation_id":"a15bd645-d68f-44f2-8a9b-4b2cd0aa6930","resolution":{"observed_at":"2026-08-05T16:21:10.500703Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.476930Z","title":null,"venue":null,"work_id":"b1662479-c983-4067-bafc-da56a8d0113f","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.262757Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:14b82ca4b04e7b29e99626f933fec8f06ed68a4fdc3a48d6b2aff73f96888c9c","observation_id":"787cb3ac-176d-4594-a319-c059f9cb9f7f","resolution":{"observed_at":"2026-08-05T16:21:10.483331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.458703Z","title":null,"venue":null,"work_id":"f24cf219-eba4-4632-936f-cfaa8770868d","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.269055Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:46143e9c0a353aa6c4a0f7bdfbc3e5b852ec607e21929f10053d7634c8e7edb4","observation_id":"abb4f7b7-6f2c-4f23-b64f-44b614e804ea","resolution":{"observed_at":"2026-08-05T16:21:10.465128Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.440999Z","title":null,"venue":null,"work_id":"83f5ec5d-e567-4602-99a6-a48920d3cb99","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.274137Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:bdcf440e562f438cfe81da3c5b4b5fa3a9079c21806c686d35358f3dfeeea53f","observation_id":"f8e19c4f-0826-428b-a2b3-ce090d85c25a","resolution":{"observed_at":"2026-08-05T16:21:10.446545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.424374Z","title":null,"venue":null,"work_id":"52800593-6ff9-4861-90f3-56f8e9d0384f","year":2019},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.280136Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:0254946a82b6a664be034c93aa0f35b67bbb2c3ded2fc6fafd0bfcdb8a4a3e16","observation_id":"4b7cc5cd-d30e-4fcd-959e-cc2923a3983d","resolution":{"observed_at":"2026-08-05T16:21:10.429408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.408345Z","title":null,"venue":null,"work_id":"8490a4b6-56da-4067-9eda-feef17ccd132","year":2019},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.285632Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:68ddccdcfa7e63bf9f032155c91a090eb2ed964dedc743a1f5dcea5686d77a74","observation_id":"884fa414-ae66-4c3f-966a-7d45b295d531","resolution":{"observed_at":"2026-08-05T16:21:10.413316Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.392431Z","title":null,"venue":null,"work_id":"23efa50f-087f-4152-8c47-2879e58670cc","year":2018},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.290873Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:f636b0b882e45b8c28ab0ccbb0c9ab5d5e3a75f158a6bfa31243ea92a546f0f5","observation_id":"c707dc79-687d-4b18-ad7a-f0feb3733c58","resolution":{"observed_at":"2026-08-05T16:21:10.397088Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.376265Z","title":null,"venue":null,"work_id":"82545821-d140-4030-8e93-c6cc21833614","year":2021},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.297167Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:485e873174eb1a9d3638f0cb26e08308fcc12345cb5c310a3de6d78850fc7d0c","observation_id":"bce12e52-d28b-432b-9ae4-2560c989b838","resolution":{"observed_at":"2026-08-05T16:21:10.381252Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.359580Z","title":null,"venue":null,"work_id":"c1838556-a859-41d2-9b88-4106ee63a921","year":2021},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.302230Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:c99150f256feff75b2e2cd529c19ee694dcb8542eda496d9e7a878a4c9e7ba8d","observation_id":"419f8545-e046-494c-a059-174570235ff8","resolution":{"observed_at":"2026-08-05T16:21:10.365141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.342893Z","title":null,"venue":null,"work_id":"d8d5c40a-a9e8-4db2-ba9f-cf928a57775a","year":2021},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.308640Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:9aa4e662df7224fd9f8821ac41786e679f60c455ff3b719cac0d9ad5b01b9a96","observation_id":"cbff29ce-a53e-472f-916e-f4f0097ac196","resolution":{"observed_at":"2026-08-05T16:21:10.348066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.324752Z","title":null,"venue":null,"work_id":"ed66c8d0-da71-4bc2-a119-44f3667e0a64","year":2021},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.313933Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:4d58813a9710b8c539d6a2e2f90f0e93b99240f6881c1e0f7a8dabdcb5b292e0","observation_id":"563d8a5c-1628-44bc-b128-6e42dffcad0e","resolution":{"observed_at":"2026-08-05T16:21:10.330817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.308105Z","title":null,"venue":null,"work_id":"2ffece35-3d66-4707-b5cd-e81dd8009f76","year":2019},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.319215Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e235ff382ae0215ec9007531cf288e76986260f218d4dfeac1dfc24d59cce9ea","observation_id":"5a9a7728-b671-4314-821c-813cad5fc6f4","resolution":{"observed_at":"2026-08-05T16:21:10.313738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.291251Z","title":null,"venue":null,"work_id":"2734f503-7a4b-4958-a349-b10bbb8ab3e0","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.324671Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:2fc3c2a986a608c5aeff208df9a772178d8611c0468eaf7db185e4ef8f203c49","observation_id":"c1265cfe-dc78-4a28-8011-b9db93548c71","resolution":{"observed_at":"2026-08-05T16:21:10.297087Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.275543Z","title":null,"venue":null,"work_id":"230b8a82-bc89-40ad-bc67-d4e154e22958","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.330590Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:55e471032c10cf2dc3a1f64e6aa0b066eefc9499ce7d9d5088a8a986f115ca8a","observation_id":"4fc9da3f-a3e4-4ef9-8541-8bd5edf9938c","resolution":{"observed_at":"2026-08-05T16:21:10.280509Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.257492Z","title":null,"venue":null,"work_id":"f9a71b70-cba5-40f6-a3f4-f359641dc303","year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.336887Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:351812d43969a2ee44b8a0c2545311fffe79059cc8e284ffc82f2c71f7db8d7c","observation_id":"52b4e011-3fba-4752-9556-a88657827f8f","resolution":{"observed_at":"2026-08-05T16:21:10.263219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.226466Z","title":null,"venue":null,"work_id":"f3caef4e-12af-480b-a7cc-41fde0a2f309","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.349587Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:ea164302378a10b7b4330ffd915062d5a4f182e11a1183386c36755cd67bf36e","observation_id":"2e24ba91-68a4-49f0-bf68-df4efc7b28e9","resolution":{"observed_at":"2026-08-05T16:21:10.231566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.208462Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"4fe03367-577e-4982-a38e-e3b190a411ba","year":2017},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.354859Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:02f239f023df7f594a1a1e46d95fc0cc8a2e3e14786e098ac2e2aa47df1ae3e7","observation_id":"a53b6413-e3d0-41c5-994d-a80c3663be81","resolution":{"observed_at":"2026-08-05T16:21:10.214582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.192578Z","title":null,"venue":null,"work_id":"2c3b6df6-04f2-4bc6-a685-22709da5b1e4","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.360102Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:68702c9b162728aba9b57e193ff6781320815d419e427a2bb29bc94dcc2cb194","observation_id":"390f9e4a-3751-4094-a3d1-e1f43a6a69b1","resolution":{"observed_at":"2026-08-05T16:21:10.197327Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.242126Z","title":"Ma- chine Intelligence Research (2024)","venue":null,"work_id":"ed727e7a-7663-449c-aa5e-3278336cf665","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.343904Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:0d4c5a5b74706761b8e7dbb43b3334d1ffb868f5d797b065b988c6a2885aca5b","observation_id":"98affff9-56a9-45e6-bc16-41e70b2997ce","resolution":{"observed_at":"2026-08-05T16:21:10.246931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17644","last_updated":"2025-05-26T16:16:43Z","snapshot_observed_at":"2026-08-13T04:30:27.268209Z","submitted_at":"2024-01-31T07:52:48Z","title":"BurstGPT: A Real-world Workload Dataset to Optimize LLM Serving Systems","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17644","snapshot_observed_at":"2026-08-05T16:21:09.370531Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.370531Z"},"links":{"cited_paper":"/paper/2401.17644","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:c1f5a8d8455db9ee97c2dc6b42b368bc4247af2dd165073b883a50544eb2aab7","observation_id":"c132c0cb-e3cd-44e3-8c06-33ebda30f0fa","resolution":{"observed_at":"2026-08-05T16:21:09.370531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.159026Z","title":null,"venue":null,"work_id":"22946070-88ea-4f6f-813c-f29bdd5b16b9","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.376275Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:4d9ea89042a65610ca9c9516f67f439b80fa3bdcba2127b53cf6da3d34930cf0","observation_id":"b2c13c4c-1f27-4077-aae1-005df32ab4eb","resolution":{"observed_at":"2026-08-05T16:21:10.164038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.140475Z","title":null,"venue":null,"work_id":"b1ef7032-90cb-4b15-819e-6c64f403c559","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.382885Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:674da576e1568c8d174e4b6d3f1800e322fb3f8985246e13dfc064d567aebd1d","observation_id":"dea5fae5-a24a-4771-9174-65cc0b545f0a","resolution":{"observed_at":"2026-08-05T16:21:10.146045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.175154Z","title":null,"venue":null,"work_id":"4ca9d962-6606-423a-8664-df15fdb49b86","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.365077Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:6eb85cf4e5c7fafce4a7e3af541db84bcc90551b78e69bd2b28f310971eec997","observation_id":"70cea444-94c6-4f8f-a5c2-842c947796d3","resolution":{"observed_at":"2026-08-05T16:21:10.181195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.098374Z","title":null,"venue":null,"work_id":"5c831cc6-c7a1-481f-9738-25c8c5e38ac0","year":2022},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.394868Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:bc7b86d86debf6854d5cace5c5751405fcfb50c909e6f1d563192b3183909e2e","observation_id":"beec0a8b-0396-43d9-b630-dd47d7a2ab98","resolution":{"observed_at":"2026-08-05T16:21:10.103985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04021","last_updated":"2026-06-10T23:04:53Z","snapshot_observed_at":"2026-08-13T13:12:38.016781Z","submitted_at":"2025-05-06T23:38:33Z","title":"Prism: Cost-Efficient Multi-LLM Serving via GPU Memory Ballooning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04021","snapshot_observed_at":"2026-08-05T16:21:09.400403Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.400403Z"},"links":{"cited_paper":"/paper/2505.04021","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:780d50f33ffb75c97c0829cbf5defc03678eb538f97afe0fb042cdc566fffef7","observation_id":"1c356270-700d-40cc-84ad-f2816662e4a4","resolution":{"observed_at":"2026-08-05T16:21:09.400403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01470","last_updated":"2024-05-02T17:00:02Z","snapshot_observed_at":"2026-08-13T13:43:58.816757Z","submitted_at":"2024-05-02T17:00:02Z","title":"WildChat: 1M ChatGPT Interaction Logs in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01470","snapshot_observed_at":"2026-08-05T16:21:09.407392Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.407392Z"},"links":{"cited_paper":"/paper/2405.01470","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:3291164e7c7e5346538c98b47e763dabd74a4efaccdd4d1081baf84d1354c7d9","observation_id":"73f7f60e-1790-4364-a6e3-fe8f68ee72d8","resolution":{"observed_at":"2026-08-05T16:21:09.407392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.120343Z","title":null,"venue":null,"work_id":"86c2f004-f5f3-4a81-9cd3-fe92f1d577cc","year":2019},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.389391Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e4bf201b1f5e9be4f5f497518397f6c43a73e0f9a249d38078bb930bc346c744","observation_id":"6cb44975-2f9b-482e-9848-53e122e49588","resolution":{"observed_at":"2026-08-05T16:21:10.126153Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.055508Z","title":null,"venue":null,"work_id":"c02f32ad-cebd-4a09-9399-55f7cdc5ef25","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.417516Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:2c409795c94df77519955384d91312f659693f22e59bb560480797ffd70fb8ce","observation_id":"f172d1db-6f20-460e-8b11-eaeef9c40a98","resolution":{"observed_at":"2026-08-05T16:21:10.061292Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.033983Z","title":null,"venue":null,"work_id":"9ae370b0-fcc1-4305-be90-c93c6f0db930","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.423239Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:204a869a93bde15745dca35f906716371370241df846cc93af7a2b5df377be52","observation_id":"e1fe9667-7b09-47f9-9e75-d4e6a3e4c40d","resolution":{"observed_at":"2026-08-05T16:21:10.040349Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.076536Z","title":"Gonzalez, Clark Barrett, and Ying Sheng","venue":null,"work_id":"48cab0f3-7d22-4212-a913-1896c07efaf5","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.412712Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:5607b625fb0f9367ed74606ffaab44188a6ac6134a002c2c00d1fd96b3eff092","observation_id":"619d160c-e013-416a-8cba-239af1d8a28c","resolution":{"observed_at":"2026-08-05T16:21:10.081746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.755059Z","title":"h/t_tps://www.quora.com/q/quoradata/First-/Q_uora-Dataset-Release-/Q_uestion-Pairs","venue":null,"work_id":"4a5eef06-6b3c-40e9-8139-23dbf652a8be","year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.152177Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:798e101c29b28b5bfa3bf604511eee70fbd927a2e28057d7aa45b83ec2605fc3","observation_id":"89fb8be1-e82c-46ec-ad40-631c3b91b81c","resolution":{"observed_at":"2026-08-05T16:21:10.760220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.671014Z","title":"In Proceedings of the Symposium on Operat- ing Systems Principles","venue":null,"work_id":"138714a7-5187-48da-a682-e9ce9ddfd145","year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.183131Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:c0ba82fabcef3650b277784049ef1b5728be764242949efaf58a753b94953797","observation_id":"95c35d69-799e-4c75-a098-4174eb9da609","resolution":{"observed_at":"2026-08-05T16:21:10.676486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17565","last_updated":"2024-12-21T13:55:49Z","snapshot_observed_at":"2026-08-12T23:35:15.696880Z","submitted_at":"2024-06-25T14:02:08Z","title":"MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17565","snapshot_observed_at":"2026-08-05T16:21:09.133223Z","title":"arXiv:2406.17565","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.133223Z"},"links":{"cited_paper":"/paper/2406.17565","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:ca10e68d4f63abffbb5cc320b5eceb757611a3a05f54403776d05549e7034ecb","observation_id":"cb7ffe8d-b83e-4d3b-9d8f-7859cb9a33bf","resolution":{"observed_at":"2026-08-05T16:21:09.133223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","latest_version":1,"primary_category":"cs.DB","snapshot_observed_at":"2026-08-13T13:45:01.745429Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 0 inbound Pith citation observations for arXiv:2508.18736."}