{"as_of":"2026-08-06T05:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:25eee1de21d4b30e965bf49a4aa1a8d5f4d2d3904668ac923e91d01d1ca9fe2b","coverage":[{"denominator":130,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T15:59:04.724780Z","state":"measured"},{"denominator":107,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":107,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T03:37:50.095065Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02922","snapshot_observed_at":"2026-08-03T03:37:50.095065Z","title":"Retroinfer: A vector-storage approach for scalable long-context llm inference.arXiv preprint arXiv:2505.02922,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.07721","last_updated":"2026-05-28T23:34:23Z","snapshot_observed_at":"2026-08-03T03:37:48.402653Z","submitted_at":"2026-02-07T22:26:45Z","title":"ParisKV: Fast and Drift-Robust KV-Cache Retrieval for Long-Context LLMs","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T03:37:50.095065Z"},"links":{"cited_paper":"/paper/2505.02922","citing_paper":"/paper/2602.07721"},"observation_digest":"sha256:133be304be8f1bd5e47448702368f120ebe82f6f1e0a2194d06693158eb19cc0","observation_id":"fbe5c4c8-4ee5-4cb0-a9ba-40ed5b9e9896","resolution":{"observed_at":"2026-08-03T03:37:50.095065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"cited_work":{"arxiv_id":"2505.02922","doi":"10.48550/arxiv.2505.02922","metadata_source":"pith","pith_arxiv_id":"2505.02922","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","venue":"cs.LG","work_id":"84919d57-8b37-4b60-8bbc-0745e6b90c89","year":2025},"citing_paper":{"arxiv_id":"2604.26837","last_updated":"2026-04-29T16:02:00Z","snapshot_observed_at":"2026-07-06T23:12:24.456023Z","submitted_at":"2026-04-29T16:02:00Z","title":"Unifying Sparse Attention with Hierarchical Memory for Scalable Long-Context LLM Serving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T13:15:21.201950Z"},"links":{"cited_paper":"/paper/2505.02922","citing_paper":"/paper/2604.26837"},"observation_digest":"sha256:378d5c51946a258ce2d7bfb2680fad78c7699e5965e4e442bfc0ee75b4327775","observation_id":"0f610407-c86b-4b27-b2cd-1bbb69ab6f1c","resolution":{"observed_at":"2026-05-09T03:35:03.472207Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"cited_work":{"arxiv_id":"2505.02922","doi":"10.48550/arxiv.2505.02922","metadata_source":"pith","pith_arxiv_id":"2505.02922","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","venue":"cs.LG","work_id":"84919d57-8b37-4b60-8bbc-0745e6b90c89","year":2025},"citing_paper":{"arxiv_id":"2605.12110","last_updated":"2026-05-12T13:23:55Z","snapshot_observed_at":"2026-07-06T23:23:48.960874Z","submitted_at":"2026-05-12T13:23:55Z","title":"AB-Sparse: Sparse Attention with Adaptive Block Size for Accurate and Efficient Long-Context Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T04:42:26.433689Z"},"links":{"cited_paper":"/paper/2505.02922","citing_paper":"/paper/2605.12110"},"observation_digest":"sha256:6bf371c0e5609026781b19f0843405da50a474313a486c7c3abea46aaf78f2e5","observation_id":"c25f27fb-c430-4a88-8147-5838e0f887c6","resolution":{"observed_at":"2026-05-13T05:12:18.462548Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"cited_work":{"arxiv_id":"2505.02922","doi":"10.48550/arxiv.2505.02922","metadata_source":"pith","pith_arxiv_id":"2505.02922","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","venue":"cs.LG","work_id":"84919d57-8b37-4b60-8bbc-0745e6b90c89","year":2025},"citing_paper":{"arxiv_id":"2605.18071","last_updated":"2026-05-18T08:54:16Z","snapshot_observed_at":"2026-08-02T15:32:20.092680Z","submitted_at":"2026-05-18T08:54:16Z","title":"KVDrive: A Holistic Multi-Tier KV Cache Management System for Long-Context LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T11:13:46.098095Z"},"links":{"cited_paper":"/paper/2505.02922","citing_paper":"/paper/2605.18071"},"observation_digest":"sha256:479ae98ee58adf10a0f3538df213e8886d6306b2b0ba511f4d9ead3571739018","observation_id":"f2f9e22f-e5e3-41d8-8e85-0a0a92d729d2","resolution":{"observed_at":"2026-05-20T11:18:13.973417Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"cited_work":{"arxiv_id":"2505.02922","doi":"10.48550/arxiv.2505.02922","metadata_source":"pith","pith_arxiv_id":"2505.02922","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","venue":"cs.LG","work_id":"84919d57-8b37-4b60-8bbc-0745e6b90c89","year":2025},"citing_paper":{"arxiv_id":"2607.00760","last_updated":"2026-07-01T10:44:57Z","snapshot_observed_at":"2026-07-07T00:06:25.004202Z","submitted_at":"2026-07-01T10:44:57Z","title":"MosaicKV: Serving Long-Context LLM with Dynamic Two-D KV Cache Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-02T16:12:12.043127Z"},"links":{"cited_paper":"/paper/2505.02922","citing_paper":"/paper/2607.00760"},"observation_digest":"sha256:e343a9d8f0d986fb76d7cb88b130b930180da36e19657c9889340493d9ea6b7a","observation_id":"fccb8cce-7d31-476e-b9c8-e5b960ba08c9","resolution":{"observed_at":"2026-07-02T16:17:08.398647Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"cited_work":{"arxiv_id":"2505.02922","doi":"10.48550/arxiv.2505.02922","metadata_source":"pith","pith_arxiv_id":"2505.02922","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","venue":"cs.LG","work_id":"84919d57-8b37-4b60-8bbc-0745e6b90c89","year":2025},"citing_paper":{"arxiv_id":"2607.07144","last_updated":"2026-07-08T08:37:49Z","snapshot_observed_at":"2026-08-03T21:27:53.528630Z","submitted_at":"2026-07-08T08:37:49Z","title":"Fractal KV-Cache Archives: Lossless Symbolic Storage with In-Place Retrieval for Long-Context LLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-09T19:13:15.765652Z"},"links":{"cited_paper":"/paper/2505.02922","citing_paper":"/paper/2607.07144"},"observation_digest":"sha256:07ae610331a7ba9ea4b6a57c80630f575114eb11174d08d5dba736d6fbaabcb9","observation_id":"7492cd46-33b6-45bc-a959-890f3a429a76","resolution":{"observed_at":"2026-07-09T19:16:27.751670Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02922","snapshot_observed_at":"2026-08-01T12:00:24.299424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26633","last_updated":"2026-07-29T08:58:04Z","snapshot_observed_at":"2026-08-01T23:27:58.423236Z","submitted_at":"2026-07-29T08:58:04Z","title":"NELSSA: A GPU-PNM Heterogeneous System for Mixed-Length LLM Serving via Length-based Request Placement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T12:00:24.299424Z"},"links":{"cited_paper":"/paper/2505.02922","citing_paper":"/paper/2607.26633"},"observation_digest":"sha256:ed3cc23337a13b31dc23283555f2483f57b0ac348e2416ea9e18bc07226df459","observation_id":"810f9efd-b7d2-4c6e-85ed-ae8e99ac010b","resolution":{"observed_at":"2026-08-01T12:00:24.299424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.02922/citation-record","integrity":"/paper/2505.02922/integrity","json":"/paper/2505.02922/citation-record.json","paper":"/paper/2505.02922"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e9c4de15-307d-4a08-a677-1dd01097b010","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:9f031025c3dab4e3f9f3a21c40d43a0866f63c73188237103756d7db6956c0c4","observation_id":"083ffe61-a42a-4486-b355-000a2d3ba949","resolution":{"observed_at":"2026-05-09T06:35:26.527899Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8b45141e-05e1-4451-b863-906de6ef1d40","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:566b8810aa84a9f1c13959154e59e27e876048d0df5cf02297051c404bf76d62","observation_id":"052df340-0c55-4db1-be6f-7e6e557380d2","resolution":{"observed_at":"2026-05-09T06:35:26.076470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gulavani, Alexey Tumanov, and Ramachandran Ramjee","venue":null,"work_id":"40b58bcb-06c2-4810-a3c8-509775faa0a4","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:e75fa09bd482be5d717d3dc8a44919bf2bdc9beff54db283c1bed98fdd5d11c5","observation_id":"5cc3e635-c7f9-41ca-9814-399eb53ce8b1","resolution":{"observed_at":"2026-05-09T06:35:26.086328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16369","last_updated":"2023-08-31T00:03:02Z","snapshot_observed_at":"2026-08-01T15:59:13.579598Z","submitted_at":"2023-08-31T00:03:02Z","title":"SARATHI: Efficient LLM Inference by Piggybacking Decodes with Chunked Prefills","version":1},"cited_work":{"arxiv_id":"2308.16369","doi":"10.48550/arxiv.2308.16369","metadata_source":"pith","pith_arxiv_id":"2308.16369","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SARATHI: Efficient LLM Inference by Piggybacking Decodes with Chunked Prefills","venue":"cs.LG","work_id":"3dbdd757-ca01-436f-acfd-12ffcd6f64c6","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2308.16369","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:4c6a559b7f95a02a097100ee9a87ffee6f6c8d5205150ab8891bf56f47d5e508","observation_id":"2b6323c5-3711-4110-b424-4813dec83e4f","resolution":{"observed_at":"2026-05-16T06:31:47.535686Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"66a7dbec-9cdd-485c-99a6-c7dde0044f75","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:afdde39b82a87ec1390c2c2647bb1a199800a55fcb9ee42d0934586dbf35f827","observation_id":"80e81f82-b384-4ab6-adae-0531d69ef635","resolution":{"observed_at":"2026-05-09T06:35:26.215806Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/2024.acl-long","venue":null,"work_id":"e64e1390-0d6b-4cce-8ac9-ae2f912f16f6","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:c6110146206901d984ff06e70483978e0f16695cdd2f4c99af7b87dc33fb3aa6","observation_id":"73f5103f-7fa8-4c55-b2ed-450b068e5012","resolution":{"observed_at":"2026-05-09T06:35:23.971869Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-16T20:20:45.990552+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T20:20:45.990552+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"50d26cce-ebde-4216-9098-8076fa9bcd70","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:de2d353bc8ab16a6571b605c0e80e581aeae84c91ae9af694e1b5d128e718b38","observation_id":"f1dfa0c9-fbcb-4d45-898d-a894a7bfd400","resolution":{"observed_at":"2026-05-09T06:35:26.298010Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"C., Arun Iyer, Suresh Parthasarathy, Sriram K","venue":null,"work_id":"59c536b8-c9d8-40a2-84fe-542c31eb6ee9","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:7cd739858d5a1aa56969b62708469976a5efa3219d2e4af49550e8be824798e6","observation_id":"63549e75-e30b-4a85-8e54-fe25687e54d8","resolution":{"observed_at":"2026-05-09T06:35:26.300434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3643757","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T23:15:07.256527Z","title":"Bairi, A","venue":"Proceedings of the ACM on Software Engineering","work_id":"1c8736d7-8136-4c18-a6b7-6b2114fd6feb","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:dd6439d5ff52ce4ee291e27ebf1f3373732187337632e4efcbb2634524c82f4b","observation_id":"d8296ae3-5551-4435-8c7d-79ece0d20301","resolution":{"observed_at":"2026-05-09T06:35:25.125544Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T21:23:25.987653+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T21:23:25.987653+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":"2406.02069","doi":"10.48550/arxiv.2406.02069","metadata_source":"pith","pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","venue":"cs.CL","work_id":"6317700d-f903-4ce1-8f53-b43cb146d48b","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:774403dd4b3a562d41f4602df0e71ea6dec36925c53c93a15d6fd89078f817e4","observation_id":"01914110-32ad-4d4b-85db-ec6ad85e851d","resolution":{"observed_at":"2026-05-12T09:58:29.304691Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:26.042348+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:26.042348+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":"2302.01318","doi":"10.48550/arxiv.2302.01318","metadata_source":"pith","pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","venue":"cs.CL","work_id":"b53b11e5-8613-439d-9d9d-0e2a9090d79f","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:7adbe1a07a246f817e300569aed789db771c21d6c576e3bb212a96fd2f4f149e","observation_id":"9ebf5404-31f4-438c-9275-ff82a099184c","resolution":{"observed_at":"2026-05-11T07:29:36.391032Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"13f5eb9c-1e7f-4a98-8584-78bdda0f25cc","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:12240d77c08c9193971f2b7431fd191f9fb926ccfa78c670b7d3d43e134b884a","observation_id":"d6275436-9217-49ed-aaa0-d40d14483baa","resolution":{"observed_at":"2026-05-09T06:35:23.811333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.14778/3681954.3681956","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sean Wang","venue":"Proceedings of the VLDB Endowment","work_id":"114b2078-d35c-403d-846f-fb53e612fad8","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:8cd964ac49cd9b4d125d5c1e455352488c69f0e338ee4138b785fc57998c955a","observation_id":"3543e10c-6646-423a-a51c-aa9b64cbd21f","resolution":{"observed_at":"2026-05-09T06:35:23.818588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"08fd9e0a-b901-4165-a3ec-45040c03bb2d","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:50aeac90a00e074133a50e4f0e5e4b547b4fe513f470e7f2e4f69a91d00ce68d","observation_id":"15752c80-aee2-4c3f-9be8-ae08cd3d78c5","resolution":{"observed_at":"2026-05-09T06:35:26.302487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":"2412.21187","doi":"10.48550/arxiv.2412.21187","metadata_source":"pith","pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","venue":"cs.CL","work_id":"d79f8b7d-560d-4fbd-bd70-4d084f6d9ad6","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:160b9f9a68232eb3c6495e054ff99970da9a229c2f4f42b844fe025f01e9c2b3","observation_id":"18113728-5cd6-4d11-a8cc-ff2aba59d8c7","resolution":{"observed_at":"2026-05-13T15:51:30.429014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.719296+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.719296+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6f46a137-e356-4232-87cc-8a4b35e6fc9c","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:d0f26956f774673f8e30ea4ec1da944e77e87d0c91c886f4953d4a992fea8b7f","observation_id":"c8625887-51f3-44ee-84a6-98e1fbfa9504","resolution":{"observed_at":"2026-05-09T06:35:26.304456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":"1904.10509","doi":"10.48550/arxiv.1904.10509","metadata_source":"pith","pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Generating Long Sequences with Sparse Transformers","venue":"cs.LG","work_id":"c5b81688-45ee-4a9a-b095-e6290f45cb6c","year":2019},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:1f398df4991e15683b6dcbfb1ac0a01daa9894b3cd1291304f71970319364f97","observation_id":"1b0f9053-9cd4-4812-a4e0-2a1a92ca16b6","resolution":{"observed_at":"2026-05-10T19:50:53.465869Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:59.71041+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:59.71041+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1223","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Niculae, Vlad and Martins, André F.T","venue":"Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing (EMNLP-IJCNLP)","work_id":"02ecbfe2-dd25-4184-9b1c-b077b46a50de","year":2019},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:91a3830fca9470ae8be858715547dd13be8f33fcadf5ce5cd4f38161df9ad268","observation_id":"1497cdf8-4dfc-4fe3-8048-9bce7b667be4","resolution":{"observed_at":"2026-05-09T06:35:24.985864Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T20:52:55.342853+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T20:52:55.342853+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":"94e5c80a-518c-4f9b-ae8e-172545d78a0b","year":2022},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:0968b58217d1af5e178a597aea202aa31bb20ce667822a0df0153b02e82d66da","observation_id":"5091544e-c12c-42d2-8e81-96002520b868","resolution":{"observed_at":"2026-05-09T06:35:26.306525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ce66296f-d921-480d-8216-e78201c8efce","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:67e8a17b093e5c35ca60a92569df8c6e2f0cdf55dbacfd41849cb40dc579cdb7","observation_id":"11891bba-4e39-4bef-bd96-cbc5b0b23ace","resolution":{"observed_at":"2026-05-09T06:35:26.311819Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"914118ee-632b-45ae-8ed0-0708c77657c4","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:61367d9a2cb6b35a491256eba6af6c48569491e57edebb5f19de063245e37444","observation_id":"51fecdc5-b64d-4d90-a6cc-4aed968817ef","resolution":{"observed_at":"2026-05-09T06:35:26.341972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:8de49719be25b4983186aa76f1476f9c14b9828a3d19b92e2fa8049c21b966c5","observation_id":"0322336e-a359-49ae-b64a-48297f7bbb6f","resolution":{"observed_at":"2026-05-09T06:35:25.153201Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02690","last_updated":"2025-02-12T14:32:46Z","snapshot_observed_at":"2026-07-06T17:55:03.561275Z","submitted_at":"2024-04-03T12:37:34Z","title":"How Sparse Attention Approximates Exact Attention? Your Attention is Naturally $n^C$-Sparse","version":2},"cited_work":{"arxiv_id":"2404.02690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.02690","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How sparse attention approximates exact atten- tion? your attention is naturallyn c-sparse","venue":null,"work_id":"732649a0-e1f2-44bb-bfe4-e9f9f4c41935","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2404.02690","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:4a4e4058b2f0854c664fef0f5e18c5ef2b4692f23f2ef72696ee50a9ea058b1a","observation_id":"306b84cf-2d37-462e-b28a-8c935a3f14ce","resolution":{"observed_at":"2026-05-09T06:35:25.134551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2212.37244","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T06:06:40.917130Z","title":null,"venue":null,"work_id":"a6ad9f0c-53f5-4a63-a55c-ce8b68006ee0","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:bb59ea53d9e87b1413bbe942dd4ab6b909def0f0d6c456c6d0cfd267bcb8d36a","observation_id":"d3067b03-09a4-4bd2-b148-f1a6ce210574","resolution":{"observed_at":"2026-05-09T06:35:25.140896Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f114d3c9-fe3f-45bc-9176-865b77b3c574","year":2019},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:b9eae0b7932caf96f1dace75472016882dbc2465a0c2bcef7f1972611e69d4d4","observation_id":"96eadf58-eb6d-4e46-ae60-821e97eadf02","resolution":{"observed_at":"2026-05-09T06:35:23.804093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"276e4f2c-3a61-45cc-abf8-83ff0ada066b","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:7644c811b04e68b11701983d6e2fa9e1f320c56add9766c34c0d7fd93e6d0d8b","observation_id":"0a771d77-d7e9-46a2-81b5-bd21b614c448","resolution":{"observed_at":"2026-05-09T06:35:26.344218Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b3f39753-4716-4df1-85b6-85752cca28e9","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:08d60900e76b80cf71b097bf51df2c88a34f636c223a7a1fb2eca11c3e61a525","observation_id":"69bc421b-4d40-4a79-97fa-a47fca85302f","resolution":{"observed_at":"2026-05-09T06:35:26.466331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3689031.3696071","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"f83b095d-a7cf-4976-976d-bbe2cf47afe1","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:e6b04ae38673c69d8aec582fc1049d88be3bca4321aac85dd9ff46bb2f0972af","observation_id":"6eaef795-2152-402d-ba25-8f630c2ed82b","resolution":{"observed_at":"2026-05-09T06:35:23.841093Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3725394","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Proceedings of the ACM on Management of Data","work_id":"4a0f9b18-440c-4b31-a4b2-f6d154d32780","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:823283115e9f643bbbfef45bedf7f7e61d45cfd2485d4d8735a6f23a95c3144a","observation_id":"7a663703-f977-4823-afac-45c30f0ed270","resolution":{"observed_at":"2026-05-09T06:35:23.848481Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T10:53:15.752025+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T10:53:15.752025+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:fe220cbc7b40f471f4da5b0f1f89f4c77cad539557eabe40de8eaff68a4a6548","observation_id":"3e802f0b-f9c6-49af-99d5-3c8fb50e2ff9","resolution":{"observed_at":"2026-05-09T06:35:25.149555Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1216e95f-49eb-4212-9898-104ad77d0fec","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:45c41a3c0298796f7081fd68925aa100de463a54f0aaa63a7125a341d059d65d","observation_id":"f6211286-0dba-4f45-b0cd-97db28cae74e","resolution":{"observed_at":"2026-05-09T06:35:26.469030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fde1c075-4860-41af-a7ba-2bfa4c9b882f","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:8f939be565c1a9c52596ac71408dd9ff1bd4ab1aab65ae29bb07643e2fafd116","observation_id":"1fad0a2f-abb9-47c6-a34b-84386390b34f","resolution":{"observed_at":"2026-05-09T06:35:26.470909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"102354f5-3e71-42a7-8962-b22fd9223e5a","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:07308dc90874a415abb7cd1b770f9b8306d9a8d8e2ee61e335cbdfde9aa7aa11","observation_id":"3cc4f96c-ff9c-454a-9970-767c8cbd6635","resolution":{"observed_at":"2026-05-09T06:35:26.472617Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.14778/3554821.3554843","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Proceedings of the VLDB Endowment","work_id":"823c9474-c12b-40d4-b091-d9ae2552e8c2","year":2022},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:00ae9d679e47640f0479355040814821a4e5ea85e2ca19384471a98d7e4a9af3","observation_id":"18bd3e6b-f9c4-4eac-a8a0-945481b500b9","resolution":{"observed_at":"2026-05-09T06:35:24.577514Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, Yakun Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"72b3ec8b-a9d6-49b4-a584-17f81a94b47b","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:d861e52cbf87a8e6fa17b0c96fb478b2b4d88f1a4700faee860c3f30f7a9eb4c","observation_id":"8656c612-2b35-49be-b81c-6a69dc5120b5","resolution":{"observed_at":"2026-05-09T06:35:26.477915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"0af1e13d-9bab-43a6-b5be-600b6fdcb57b","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:d3be41bb0bd37b1d4d1e4879e567c6ec76718a03800425684ca485a531076ef4","observation_id":"f8fb0b75-53dd-454c-a3b8-655a5e99ded8","resolution":{"observed_at":"2026-05-09T06:35:26.480027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"09d9319b-16d8-4ae6-bc6f-2a234bfe4730","year":2012},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:77e8ed100f280378b8043aa6a95656598ab0441c766de144a069d264840959eb","observation_id":"acb5927a-b3af-4175-ab6f-fbaed145547d","resolution":{"observed_at":"2026-05-09T06:35:26.481901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":"2404.06654","doi":"10.48550/arxiv.2404.06654","metadata_source":"pith","pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","venue":"cs.CL","work_id":"c0bc4689-3ce8-4e3d-9442-bd74869445bb","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:e2a6d8a23e837f801f8dc7a242956833c0b37f8811b232cf2afd0a4edbce230a","observation_id":"3cebae00-ee04-4f0e-88c7-c73c4f6e159c","resolution":{"observed_at":"2026-05-11T03:55:20.729537Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"23 Herve Jegou, Matthijs Douze, and Cordelia Schmid","venue":null,"work_id":"11cde7cc-19c7-48ce-b82b-d99f0855c45b","year":1998},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:3477ec41f553c1ffd6ac115928b0b046b7edc4dc7f3b94f664717ca88993a1a8","observation_id":"61c367f4-431d-4d31-8e82-ff644ed44a68","resolution":{"observed_at":"2026-05-09T06:35:23.753776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7d2ac305-2f61-40c8-b594-827103be9df6","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:f394f07f9e48cedf1fb3939f907dfecc84356d532eb9d0393462cd7e00c00d59","observation_id":"b220a4bd-deac-4139-9fbf-6d006dfb07c8","resolution":{"observed_at":"2026-05-09T06:35:26.483584Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3bd6b31c-f104-47b6-9cd9-193cecb408d1","year":1906},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:b94f12b292fed89818f318264f5c27d231d081ae3ab3f0afcb8dcac2be6711d0","observation_id":"57eae92d-c976-4ef3-b496-e07aeeb19564","resolution":{"observed_at":"2026-05-09T06:35:26.485308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Abdi, Dongsheng Li, Chin-Yew Lin, Yuqing Yang, and Lili Qiu","venue":null,"work_id":"69c91f79-a927-451f-a8db-d539936db267","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:24b3baf3fbd0f091a29ee060c08e03e2b87c5297a717affd1a1ba216d74151a6","observation_id":"632ce54a-15a0-4ca2-a71d-59e42c6a8a3f","resolution":{"observed_at":"2026-05-09T06:35:26.487128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3600006.3613166","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InProceedings of the 29th Symposium on Operating Systems Principles (SOSP ’23)","venue":null,"work_id":"d19f8180-1287-4110-9e3e-65910a553e9d","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:45b33c2883dc269e196c4fe3f5a5f177f4785734f09792ce9ee9e88331162786","observation_id":"76ad8b0e-a286-44d3-b569-8dcaac60f316","resolution":{"observed_at":"2026-05-09T06:35:23.741863Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-06-01T20:56:20.49107+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T20:56:20.49107+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"67ef2778-b078-4bef-a10b-3843244f08d1","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:464cba83cd559cab9428704469ed08b2f7c397878468120ddcc9349f90e8d600","observation_id":"ab678d50-8de8-4daf-90bd-e2576b505c67","resolution":{"observed_at":"2026-05-09T06:35:26.488872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dff12ae2-54b9-475e-ab1f-d91c26992bf0","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:0ba340cc198b0dc74cbdab551a34bc8d8811af271a4fa426c71ade93374a0fa1","observation_id":"522e0f48-8aaf-48cd-ad4a-ab622cfd4c58","resolution":{"observed_at":"2026-05-09T06:35:25.137485Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f6196f4d-91e7-4358-9624-c3e0b57a2153","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:f8a4d3fbe26f4e161a239da0f27e440c0684f1cf4d87b5e4fe200e1e61d8fc99","observation_id":"33770d50-48cb-49fa-b164-5cc02e5de8f2","resolution":{"observed_at":"2026-05-09T06:35:26.493014Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c792ca2f-e0cb-4211-823d-c31d146ebcaf","year":2020},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:6e35e096dd15d30219a284a7fb7cf1d815bc87f0a4dce65cc058ed75c58898cd","observation_id":"53b8a889-697a-4977-a37a-065f4e359abf","resolution":{"observed_at":"2026-05-09T06:35:26.494749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"44e59d01-ff51-46cf-88fc-8c662c260e21","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:5ac5745982113ba411318a66fe62f32ccd4d906af6d42cc48c1b19f15e727bda","observation_id":"10d92e4f-045d-4349-8ca0-f82ece9034a9","resolution":{"observed_at":"2026-05-09T06:35:26.500002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"312b8af0-b274-4cd7-93d4-7e4a36ad459b","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:9b7ebd478fe35f531df47b3a4359fbacb19ba980da1baae71c31a3627fdd5f41","observation_id":"5771dd0b-adc9-4c02-b3a8-5d43452d05b0","resolution":{"observed_at":"2026-05-09T06:35:26.501891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"0b7e1010-6a10-4baa-87f6-ccebdfbfcf19","year":null},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:a28890ad0abdd89c9610d84502f8fd99d7dae9ad575cfa24830cace1deac390d","observation_id":"635d363f-05e6-4099-9aa9-41bdc674148b","resolution":{"observed_at":"2026-05-09T06:35:26.503848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In17th USENIX Symposium on Operating Systems Design and Implementation","venue":null,"work_id":"0d582d5a-1da7-40f2-8eef-e3a4ff022514","year":null},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:808bca7882a53eaeef2b5445cfec1482db5956aa16d1e554ce2ce781c2503a70","observation_id":"b8d85c43-6572-4f3c-89f2-20a08def16e5","resolution":{"observed_at":"2026-05-09T06:35:26.506013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6b22eff2-1016-4ee1-8b9d-57f7bcabc542","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:e0367c7f55d570d01432e49089bf6e8f87c21dfa0ef82837a41dbae3e92443a5","observation_id":"fbf7c9a2-30c4-42fa-98a5-6c80128a4a68","resolution":{"observed_at":"2026-05-09T06:35:26.508941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dfe66875-0c73-40af-a785-b144bc8cfc7b","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:8e3f0f9b09f6008f07bf9ae95fb35a921879f9e4b7e0d2d140b7189dd8fbef37","observation_id":"6112f56f-342f-4de9-a973-9ef372b10c4c","resolution":{"observed_at":"2026-05-09T06:35:26.510698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10516","last_updated":"2024-12-31T07:11:00Z","snapshot_observed_at":"2026-07-06T19:16:14.638445Z","submitted_at":"2024-09-16T17:59:52Z","title":"RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval","version":3},"cited_work":{"arxiv_id":"2409.10516","doi":"10.48550/arxiv.2409.10516","metadata_source":"pith","pith_arxiv_id":"2409.10516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval","venue":"cs.LG","work_id":"96e08aaa-a828-4d47-8eb6-182994c0f8f2","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2409.10516","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:13f3b19cd065822a5bb538688a1dcb419289c4715268b8c8ea7eb54bf22b0f3a","observation_id":"37d8729d-fb77-4706-967c-f7347e2aa8e0","resolution":{"observed_at":"2026-05-18T08:12:02.395521Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/dac63849.2025.11132099","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hassan Najafi, Sercan Aygun, and Marc Riedel","venue":null,"work_id":"64d2fb44-1645-4aaa-845f-0e318b1ba63f","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:3f399457c4470366930744c50cc200cc64585ba7c7480a03153686593a30a1ef","observation_id":"191dc174-bfb1-4d3c-8178-67b4712765a9","resolution":{"observed_at":"2026-05-09T06:35:23.880443Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3722212.3724450","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Companion of the 2025 International Conference on Management of Data","venue":null,"work_id":"f007c569-7532-422a-8edb-98b16afbe1df","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:e08ce1b2a3609e563b1a7e1aa75959ae6c554d048d248559765ad3be8182fe52","observation_id":"0bf3d40f-9117-49bd-8b4e-f47702af8481","resolution":{"observed_at":"2026-05-09T06:35:23.904743Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"43c56748-8597-42fc-98e0-80b7bf3b8640","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:9d18aa0d6da58d5cd0401cfa1b5899f0d1237b4ab5901fbf10da141b671dc564","observation_id":"7dfbe55d-eb52-4301-b79c-8ee54b0cd6f0","resolution":{"observed_at":"2026-05-09T06:35:26.512349Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.14778/3489496.3489506","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Proceedings of the VLDB Endowment","work_id":"24ac2cc4-b6c8-4363-a67c-ab5614082a10","year":2021},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:6e5567420392803523f31da80a29fb6642222d80a5c588e2c7c76401c1394dc2","observation_id":"60182ffb-12a7-45f9-a193-6f844e7090a4","resolution":{"observed_at":"2026-05-09T06:35:23.968439Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8ebcaf75-045f-4899-b08d-05dcb9721f41","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:4015ebdb17ceda87cb8d586098b3a0b508ec4f3d355b7431da4cc4ed0e04188a","observation_id":"4b465186-03a4-4647-91b3-dd2fe728d044","resolution":{"observed_at":"2026-05-09T06:35:26.518786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Malkov and Dmitry A","venue":null,"work_id":"55ebda4b-9173-47ea-9123-81d5c84be898","year":2020},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:a74a5cd6dfdd74c2b4ca9a04e9a50b9ff589c9764d8155246eb739e7bc4c1d72","observation_id":"b72a6607-7786-43d5-a8d7-e0749c3362cb","resolution":{"observed_at":"2026-05-09T06:35:23.980968Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7a96a380-ef82-440c-9a1b-6578cc8dc91c","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:de6d498267e03507a724b38c9d5be0fcf4c75fc07b467067daabb70591901132","observation_id":"e9f5a5c7-3062-43a9-8bdc-542a5dfc2514","resolution":{"observed_at":"2026-05-09T06:35:23.987499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f206f5d9-ecff-4af7-a9dc-bac1004a0aa0","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:5c365d4c69d8d9e14442fec6f44f4c8aee25033ab69210de2731c3074351e0d2","observation_id":"b54a9796-217a-41c0-b8cb-07f0fe2d9057","resolution":{"observed_at":"2026-05-09T06:35:26.520768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"799451e3-0358-418d-a496-5eb605fa34e1","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:edaabc8f92928639acd372404a4f88d1d1b74984a2cdcf1049b6c8b71f1c93b7","observation_id":"9accc376-8087-4f35-8174-4b38846f6ecc","resolution":{"observed_at":"2026-05-09T06:35:26.522550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3589777","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ilyas, Umar Farooq Minhas, Jeffrey Pound, and Theodoros Rekatsinas","venue":"Proceedings of the ACM on Management of Data","work_id":"07ec5490-93e0-4f8e-bac3-4770b3ea0195","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:3ed3fa4f9917e58e28bbe21907144fab3fe337db4a70d786498df53c88ad1557","observation_id":"663a69ee-66d2-4c84-9c23-483bdb8361ce","resolution":{"observed_at":"2026-05-09T06:35:24.648542Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"adf7f211-4083-4b5a-b07d-8bd994c3fe9c","year":2018},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:62a7bc0b80d4c60a3ea30a5c5718907d3814519bf2b997d58b31e991ec7b1e3e","observation_id":"285a0244-8f41-4325-9e80-da9566fb35b5","resolution":{"observed_at":"2026-05-09T06:35:26.524634Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dd1f86ad-8250-4ec1-9a78-ea9cdab32e20","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:b1d6878720fdeaa1bab2742f8361a9b1d7ef0aa3a7e54984610b8428f9f14c0e","observation_id":"33ac1940-2175-4e13-9bbe-bb73caf3d787","resolution":{"observed_at":"2026-05-09T06:35:26.068781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"365b3cf2-91c1-4209-a7fd-8946bab0f080","year":2020},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:552082c08014ad0890771195355a99dadd571c77c5430b33c83d2859b112b93a","observation_id":"06fd3f35-ec1e-4369-b049-4453dc1214b4","resolution":{"observed_at":"2026-05-09T06:35:26.533331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fe03cfe4-2906-478b-a2df-0fbeedc965cd","year":2020},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:f63de9505df8b1d685a0246dc3c45a2bc7f409c7a9f602562e497e3f89289c8f","observation_id":"a8f232a1-9269-450e-b91e-0f7a5f041b29","resolution":{"observed_at":"2026-05-09T06:35:26.535518Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ba6fa3e2-dbe2-4206-8e13-8b688a2b16b6","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:3fe3c19f718aa13974611afe7f279831695c9322a7b0e9176416a93cee572cfd","observation_id":"5eb68141-ab64-4d1c-8802-243d17db10dd","resolution":{"observed_at":"2026-05-09T06:35:26.586297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/icde60146.2024.00118","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"51d18042-4319-44e7-b811-630ad86f714e","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:d6b4f6fa1de7cab5a26d71b1cba4133e28b31a3c0c436c6383926a45ddaea215","observation_id":"9e2855fc-a512-416f-bc76-952e315c4046","resolution":{"observed_at":"2026-05-09T06:35:23.783912Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T14:53:12.297562+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T14:53:12.297562+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"57123d2f-4b1a-40ba-90ed-0b7ac7d7cba0","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:5236086a2403a43687701a6e3a78afeef32addce9ed5bdce3149d96fb0cbd2cc","observation_id":"b882cb66-3a7c-4427-888f-088afec1289b","resolution":{"observed_at":"2026-05-09T06:35:26.589819Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5f57f664-e4c0-470e-be7f-f9fc43acb2b9","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:5b0270abcfcb9a6c09fa395dfa594c4a6d15e2e1043cc664369aafbd24c19571","observation_id":"74644f65-7444-4719-b9da-197fead490a1","resolution":{"observed_at":"2026-05-09T06:35:26.591872Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3654923","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Acorn: Performant and predicate-agnostic search over vector embeddings and structured data,","venue":"Proceedings of the ACM on Management of Data","work_id":"ae411d48-1b03-48c8-b54a-f7bb46f8e313","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:03dac2d0c0be92be3bbc0f831b0f370187cc373155273f311593a0212bfaa371","observation_id":"e2e16d11-25b2-46f5-af18-a98fc053a35b","resolution":{"observed_at":"2026-05-09T06:35:23.799756Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-06-01T20:56:19.092302+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T20:56:19.092302+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"385eb6d1-f7b7-43ed-9124-ca201420dc56","year":null},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:b861d8e1b7d168d71a72aaf99df9ca208733a164e0e5790213ac8ebb967988f0","observation_id":"9379e1b8-3bcb-46f8-8427-5ae0beaf1331","resolution":{"observed_at":"2026-05-09T06:35:26.596865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the Sixth Conference on Machine Learning and Systems","venue":null,"work_id":"28ad53fb-3d42-4c9e-97f8-fa1b87b1e1ff","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:a5a083395d9ea868c05d69f3b1d66e956cc33ea248da16c9d5368cd2348434b1","observation_id":"2c583892-89da-4a09-83d4-de538368babb","resolution":{"observed_at":"2026-05-09T06:35:26.598998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"081f7e52-a19e-417a-b324-2a0812c8f963","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:9a6a7e361e8f1854563920f66d89bb82ae5e81d40cb796177c6108a7757bfd87","observation_id":"9141c342-c12a-4b37-a4c6-fbb70ba857e5","resolution":{"observed_at":"2026-05-09T06:35:26.604322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"62872a1f-c7ef-404f-a1d1-904618f1f54d","year":2025},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:ff262fc26263faec921484cf318396c4496bde450c40a8dd64b194055744fc92","observation_id":"e987aec9-a466-4a8e-996c-1ce62affac2e","resolution":{"observed_at":"2026-05-09T06:35:26.606334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c66e02f5-10c2-4dd0-83af-31e4ff1313ed","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:bdaff8b54ce94baecdf49bedd2bcbefd73cbe19984688c2f0dd2425d32f50542","observation_id":"b1c56ecd-7b0c-4242-9331-e49c1bc54f68","resolution":{"observed_at":"2026-05-09T06:35:26.608141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cc8def42-e5c1-4b62-922a-71033e48e2f1","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:1e2374ee2cd9d7ff9e8e4a0ce5cd1bafa70c95ed3a0c6846a9dc60face4b2a6b","observation_id":"a45d866a-7cf3-43b4-bf62-07c04793c8f2","resolution":{"observed_at":"2026-05-09T06:35:26.610142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9dd3b4d6-8a0c-47e4-a8fd-70f69ad22cec","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:a4bb85571f7e06be7df66f3d365b47bccbc673c1cc1f7c358df368d71c0b9194","observation_id":"a470cf56-e332-4f98-8552-e153cb2bc72a","resolution":{"observed_at":"2026-05-09T06:35:26.611999Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/2339530.2339677","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"e401a1dd-2db3-42f3-b083-3fd648b3cb3c","year":2012},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:76809bd0260ce4cf2c1bd59a95b32eb9f16a309d8637dacf0f5f8092153ccc9a","observation_id":"8a1b467e-3ea3-441b-820d-c6d6b94f38e2","resolution":{"observed_at":"2026-05-09T06:35:23.825518Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":"2311.12022","doi":"10.48550/arxiv.2311.12022","metadata_source":"pith","pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","venue":"cs.AI","work_id":"9e2a976b-f5ad-4aee-af5c-243fe0fe75d2","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:b56507b5f06d36b675b8121ccd1de8b57367373db0ce89e4a659f9e6598da135","observation_id":"812cd78b-08aa-48d9-8d1b-c5a5ff68e41f","resolution":{"observed_at":"2026-05-11T04:00:34.729655Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.941438+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.941438+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fc178f84-8e6c-4d93-9cd7-f864b41ed63d","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:99d0dd019da1b0f93c598923b72160964cf6c58022eeb9d12e450f5525182538","observation_id":"96515c8a-0b79-41e8-a3f4-53b67b9e1586","resolution":{"observed_at":"2026-05-09T06:35:26.614725Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"8aec679c-7008-4c17-8a59-56274db2a0b1","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:b4df2b2dd90c67cd060312f9f309b6bdb34871a74a3324673948e18298c67c36","observation_id":"983c66c8-b38a-40f3-a6ba-2219c3ea3bcd","resolution":{"observed_at":"2026-05-09T06:35:26.616565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e82cd2c7-9243-4d91-905a-f5645fb1d144","year":2023},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:a1bafd2c9e4382930d66f17467a1d046b0406facaa2471574b370b6cd103ba4c","observation_id":"7026c902-3b1e-4210-8ae9-a5fff20436f4","resolution":{"observed_at":"2026-05-09T06:35:26.618396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cd4d8d0f-93b6-4f85-9602-a5802621615b","year":2014},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:2cffbcaa8424e48986eb8aa903238601cc04d09d23d1a696408755ff518f5e1a","observation_id":"b7cd29be-6e95-4786-9806-9837d3971e97","resolution":{"observed_at":"2026-05-09T06:35:26.622522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iccv.2003.1238663","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"c35acb26-984a-426a-be1c-837779379e1f","year":2003},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:44cfb449546e0958aaade5cbca135b998f418e42c471ac3c76e81d963c2016d0","observation_id":"6284460f-c3a1-45e6-a52e-0dd644c1ccc7","resolution":{"observed_at":"2026-05-09T06:35:23.856033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3694715.3695964","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"e5b33999-5cdf-4036-ad67-e9a8765b957a","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:92aca76653a23a695f2e0609c538a034abcc1f7b5646f20711988bbbda2bec7a","observation_id":"cb64d4a5-7119-47a8-806c-4b185eef6b09","resolution":{"observed_at":"2026-05-09T06:35:23.863288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.neucom.2023","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T21:38:29.379053Z","title":"Zanatta, A","venue":null,"work_id":"c2696737-b52e-4cf0-b01b-412e2c915a6e","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:070a739acbc3766e1949320a73de8343d56219123d99868aaf0d3283e1a2e6a2","observation_id":"3372dd9e-5358-477a-b6ce-59a8266e5ae6","resolution":{"observed_at":"2026-05-09T06:35:23.873082Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T17:53:43.665589+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T17:53:43.665589+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d49cfc90-2b69-4121-b39b-07781164f75e","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:a55c377d24b9545e26841529abb2e3bba5b56a31408e0c6268e41c7349b38b27","observation_id":"38079d9f-9bea-4d88-b43a-1c4350791380","resolution":{"observed_at":"2026-05-09T06:35:26.624342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7fa10f39-4d5b-4987-82fc-f64369037b80","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:9c0d2a54f02461fc9f08178e54bf0b66f949c25f37cb6c7cafe16733333c39e8","observation_id":"4c06fed1-6338-40ca-9b5d-49e22021ecc4","resolution":{"observed_at":"2026-05-09T06:35:26.626860Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Triton : an intermediate language and compiler for tiled neural network computations","venue":null,"work_id":"95824d24-41eb-4032-8328-ab9e1c0ef648","year":2019},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:d1e8cf8c300f1603f3178193e5760dada41d3af0c60a91ef6db1f2d9e39d9ab7","observation_id":"9d52678e-96e0-4f82-b277-c53d89f1a626","resolution":{"observed_at":"2026-05-09T06:35:23.894700Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"b17aa7b0-755a-4c45-b880-d01f0b46eeb2","year":2017},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:745598df4fdc09ac3fac25d7529c0a6e9ce0d7444bc4e010a0065a5948ace1d5","observation_id":"80ef92fb-f8ef-4cd5-9e16-86bdd76cbf0b","resolution":{"observed_at":"2026-05-09T06:35:26.628719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/85.238389","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"IEEE Annals of the History of Computing","work_id":"0556c39b-71e5-4ad3-8cc8-8327f13ce77a","year":1993},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:09b8c3e63a7eed8561c970915e60c95f03f911c9b8abe98a43c1c473f2707486","observation_id":"cf0db3fc-f81d-4f46-a388-96484443b221","resolution":{"observed_at":"2026-05-09T06:35:23.907680Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13035","last_updated":"2025-03-13T03:16:43Z","snapshot_observed_at":"2026-08-05T10:25:57.608223Z","submitted_at":"2024-06-18T20:01:51Z","title":"D2O: Dynamic Discriminative Operations for Efficient Long-Context Inference of Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.13035","doi":"10.48550/arxiv.2406.13035","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.13035","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"D2o: Dynamic discriminative operations for efficient long-context inference of large language models","venue":"arXiv (Cornell University)","work_id":"f09f2382-0966-4621-bead-fb76431fe32b","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2406.13035","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:02917ccf2032af36984b6ccf2d26713309bd0122d0946954b84b8c89ccd49650","observation_id":"018a36cf-76ec-44a7-a8b9-39ad8074989d","resolution":{"observed_at":"2026-05-09T06:35:23.911835Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"adc10bd9-590a-460e-843c-de1ae887656f","year":2021},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:e6af4fa54f011403b31718f08247aec28ea91d2b9a4d8c3a9866c79d81a6f67f","observation_id":"60ca069a-eb79-406f-be05-bc20366f79dd","resolution":{"observed_at":"2026-05-09T06:35:23.919744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.14778/3424573.3424580","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Proceedings of the VLDB Endowment","work_id":"d1bf7c29-3ffd-4987-b70e-4b9e1141b93c","year":2020},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:3651a9decc7ef0d4a34b6bbd54f797455221b9cd48cfbd2f7b16bc6a1229ea2e","observation_id":"f2f68b56-96e8-4cab-aeab-ae53ee591023","resolution":{"observed_at":"2026-05-09T06:35:23.927931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Abel, Xu Guo, Jianbing Dong, Ji Shi, and Kunlun Li","venue":null,"work_id":"e8bd2961-b28f-40b7-9430-df1ea1a2cdd8","year":2022},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:b64d804d2137b00a7a2d1b4248781d649a9a858e712844987c0cbd5fff0f9591","observation_id":"5a9f05a8-7b83-4b50-997d-e37d80125611","resolution":{"observed_at":"2026-05-09T06:35:23.931220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"579b89b3-21f1-414a-b554-631d61a98602","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:dfe866055bfc31d00dc6471d227cc484c14362e93442f86bee10e5a11fa38dbd","observation_id":"62e77f20-7601-49a1-bc42-268920fdf8c6","resolution":{"observed_at":"2026-05-09T06:35:23.934257Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chi, Quoc V","venue":null,"work_id":"e420b177-f456-4a3b-9733-9c14b788c121","year":2022},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:695a9cc2d9c4c5ee1f60c10b89e8079b7a08467ef6db4f69f8ca8666d2584f9a","observation_id":"8e62d199-5277-40a4-9ba7-65a7848b4144","resolution":{"observed_at":"2026-05-09T06:35:26.634096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":6,"metadata_mismatch":8,"parse_uncertain":0,"unresolved":42,"verified_exact":32,"verified_fuzzy":12},"total_outbound_references":130},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 100 of 130 outbound references and 7 inbound Pith citation observations for arXiv:2505.02922."}