{"as_of":"2026-08-08T23:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:11279dc9282efcd06802c0651761cf8d774794f7b73f359ee5585b5da2e1da03","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:05:42.701392Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00049/citation-record","integrity":"/paper/2506.00049/integrity","json":"/paper/2506.00049/citation-record.json","paper":"/paper/2506.00049"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.14469","last_updated":"2024-03-21T15:16:50Z","snapshot_observed_at":"2026-08-02T16:07:09.151281Z","submitted_at":"2024-03-21T15:16:50Z","title":"ChatGPT Alternative Solutions: Large Language Models Survey","version":1},"cited_work":{"arxiv_id":"2403.14469","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.14469","snapshot_observed_at":"2026-08-07T13:05:43.422636Z","title":"ChatGPT Alternative Solutions: Large Language Models Survey","venue":"cs.CL","work_id":"1a29aad8-57ed-499f-b697-b6a80a75f843","year":2024},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:40.643078Z"},"links":{"cited_paper":"/paper/2403.14469","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:957e70b66b3a9f46ed7c33b9a9ebe0df5e8c831e5da272dc817e557952863b56","observation_id":"31a1e125-14d3-4314-b7b8-d0ce3b8f122f","resolution":{"observed_at":"2026-08-07T13:05:43.476742Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09326","last_updated":"2022-03-17T13:53:46Z","snapshot_observed_at":"2026-08-01T22:01:37.717415Z","submitted_at":"2022-03-17T13:53:46Z","title":"Combining Static and Contextualised Multilingual Embeddings","version":1},"cited_work":{"arxiv_id":"2203.09326","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.09326","snapshot_observed_at":"2026-08-07T13:05:43.269368Z","title":"Combining Static and Contextualised Multilingual Embeddings","venue":"cs.CL","work_id":"7d20d8c0-726d-4200-9304-ce9bfaf7079e","year":2022},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:40.759186Z"},"links":{"cited_paper":"/paper/2203.09326","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:ad200db18663d93f05ef0c9c3c52abf9afc659394790132f410478cda89b3059","observation_id":"48c871dd-3118-416e-ba71-42379cd18677","resolution":{"observed_at":"2026-08-07T13:05:43.332228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:45.498130Z","title":"Generative multi-modal knowledge retrieval with large language models,","venue":null,"work_id":"d9a929bf-e69f-46a5-8d4c-f028611236a1","year":2024},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:40.874448Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:30e7fb85eff978c0d0bc3501636e4a10503511ff0290da8835ad6e7b88483d4c","observation_id":"69b7eb3c-dbed-4cc7-8cb8-2a1958bfa02d","resolution":{"observed_at":"2026-08-07T13:05:45.579319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06564","last_updated":"2024-07-09T05:42:53Z","snapshot_observed_at":"2026-07-06T18:43:26.425575Z","submitted_at":"2024-07-09T05:42:53Z","title":"Combining Knowledge Graphs and Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06564","snapshot_observed_at":"2026-08-07T13:05:41.050595Z","title":"Combining knowledge graphs and large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.050595Z"},"links":{"cited_paper":"/paper/2407.06564","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:d648a975c4b5da08d288c6a2408ff24b148804140fd5bbf3ad15d1e4809c7714","observation_id":"1e93cc45-a067-4251-824d-c2de0e46ffa2","resolution":{"observed_at":"2026-08-07T13:05:41.050595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:45.389114Z","title":"Semantic-embedding guided graph network for cross-modal retrieval,","venue":null,"work_id":"0d10029d-7b29-420c-b275-cf798a83b734","year":2023},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.177934Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:53e52a08e46c7517418a27fad97f891d9957a1f6194785a0c2dd7ec52d3e8ad7","observation_id":"92cbe90f-510c-490c-a674-7ab8ba60dc44","resolution":{"observed_at":"2026-08-07T13:05:45.445148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.12832","last_updated":"2020-06-04T05:28:21Z","snapshot_observed_at":"2026-08-04T09:38:32.896372Z","submitted_at":"2020-04-27T14:21:03Z","title":"ColBERT: Efficient and Effective Passage Search via Contextualized Late Interaction over BERT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.12832","snapshot_observed_at":"2026-08-07T13:05:41.309394Z","title":"ColBERT: Efficient and effective passage search via contextualized late interaction over BERT,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.309394Z"},"links":{"cited_paper":"/paper/2004.12832","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:6a9ec9861f6ebed7018b8fb3c20bb4ace7424b6dcbee5c6caf151cc3edf4a36d","observation_id":"797a1782-feae-4760-8c76-eac93bc8096c","resolution":{"observed_at":"2026-08-07T13:05:41.309394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:45.197153Z","title":"ColBERTv2: Effective and efficient retrieval via lightweight late interaction,","venue":null,"work_id":"811a7ebf-5317-4a80-8751-8d76d62dd37a","year":2021},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.393215Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:c6a4dc4707039900d5674521386c1ee061db8ba0d2c009a946ed975a4e85a6f9","observation_id":"eea6ed0f-9e02-4c22-a61d-72acefeb5ef1","resolution":{"observed_at":"2026-08-07T13:05:45.298622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:45.062047Z","title":"COIL: Revisit Exact Lexical Match in Information Retrieval with Contextualized Inverted List,","venue":null,"work_id":"df962918-6ef8-4507-bbea-a68ca4d41dff","year":2021},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.468975Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:b3e6d94ec82c2bc973e26c26dd99695bfc99b2d60d57d98a261a8ba354539b8f","observation_id":"be6ae041-01f0-4bfd-a37a-b5d76022754a","resolution":{"observed_at":"2026-08-07T13:05:45.143268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23013","last_updated":"2025-03-29T08:35:01Z","snapshot_observed_at":"2026-08-07T16:28:47.298118Z","submitted_at":"2025-03-29T08:35:01Z","title":"DAT: Dynamic Alpha Tuning for Hybrid Retrieval in Retrieval-Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23013","snapshot_observed_at":"2026-08-07T13:05:41.558233Z","title":"DAT: Dynamic alpha tuning for hybrid retrieval in retrieval-augmented generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.558233Z"},"links":{"cited_paper":"/paper/2503.23013","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:360765511da4d4a3aae56e9119717b06f914985b3c7eac9ee4389e355f52c9c4","observation_id":"8d613c87-3c9f-4028-988f-8b1aa4e86deb","resolution":{"observed_at":"2026-08-07T13:05:41.558233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.922825Z","title":"Sentence-BERT: Sentence embeddings using siamese BERT-networks,","venue":null,"work_id":"63b2ba69-3cf7-4c15-8501-30f2002f1d10","year":2019},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.627406Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:495fdc1096049528f77f133d576636172c86f34fa02266319c5778e324554155","observation_id":"041522bf-7e3d-4ceb-902f-b92a69374429","resolution":{"observed_at":"2026-08-07T13:05:44.975123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.731301Z","title":"Dense passage retrieval for open-domain question answering,","venue":null,"work_id":"2926a756-e841-4fae-b689-32d89c19382c","year":2020},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.700647Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:0f1306c03b893f097b9f97b0972a33c4eea1abd7eb6ea85cf27f54a40279895d","observation_id":"00fa5ffa-7c4c-4d59-8579-ad63777af205","resolution":{"observed_at":"2026-08-07T13:05:44.817932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07168","last_updated":"2023-07-14T05:34:13Z","snapshot_observed_at":"2026-07-06T15:53:57.519425Z","submitted_at":"2023-07-14T05:34:13Z","title":"Adaptive Region Selection for Active Learning in Whole Slide Image Semantic Segmentation","version":1},"cited_work":{"arxiv_id":"2307.07168","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.07168","snapshot_observed_at":"2026-08-07T13:05:43.071376Z","title":"Adaptive Region Selection for Active Learning in Whole Slide Image Semantic Segmentation","venue":"cs.CV","work_id":"ef8f6b83-f372-41c9-bfea-19bdc352cfe5","year":2023},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.788490Z"},"links":{"cited_paper":"/paper/2307.07168","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:b1ffc3fd1999951ca3d7a784ac0e91beb9c3d4e59b97fac6aa61c0959aba33ad","observation_id":"75d83684-6b32-46ca-8b94-4493f755110e","resolution":{"observed_at":"2026-08-07T13:05:43.124640Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T13:05:41.854282Z","title":"Scaling laws for neural language models,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.854282Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:d5b58c821102fceb69ee2bedca7f92f6b9863289896586b4b06d97245184e694","observation_id":"37b280df-10ba-4b49-84eb-61f776cc094a","resolution":{"observed_at":"2026-08-07T13:05:41.854282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.552297Z","title":"RetroMAE: Pre-training retrieval-oriented language models with masked auto-encoder","venue":null,"work_id":"906682db-4838-4c8c-a731-7acfd0c88b9d","year":null},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:41.916722Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:74868903b16b16c54be502232832652aa9a8187a0a754024b2f49108528b9f5f","observation_id":"829130c8-465c-4f31-be5b-c83ed67923ab","resolution":{"observed_at":"2026-08-07T13:05:44.623052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10496","last_updated":"2022-12-20T18:09:52Z","snapshot_observed_at":"2026-07-06T14:33:08.041820Z","submitted_at":"2022-12-20T18:09:52Z","title":"Precise Zero-Shot Dense Retrieval without Relevance Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10496","snapshot_observed_at":"2026-08-07T13:05:42.001955Z","title":"Precise zero-shot dense retrieval without relevance labels,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.001955Z"},"links":{"cited_paper":"/paper/2212.10496","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:3089bc8c1a2f905d07d04faa6daaa6b4803a0135739212eab8108d25c6211015","observation_id":"eb679451-4adf-4706-a9b6-c4393949b7af","resolution":{"observed_at":"2026-08-07T13:05:42.001955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09128","last_updated":"2021-04-12T17:59:17Z","snapshot_observed_at":"2026-08-08T08:03:32.443428Z","submitted_at":"2020-12-16T18:16:32Z","title":"Varied phenomenology of models displaying dynamical large-deviation singularities","version":2},"cited_work":{"arxiv_id":"2012.09128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.09128","snapshot_observed_at":"2026-08-07T13:05:42.872486Z","title":"Varied phenomenology of models displaying dynamical large-deviation singularities","venue":"cond-mat.stat-mech","work_id":"ba44ecfb-c236-49b4-bfc1-21177672b2ed","year":2020},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.068941Z"},"links":{"cited_paper":"/paper/2012.09128","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:41d2aaa8227ab8429057775676021b4701000c3bcd5711473b1e25937a4a375b","observation_id":"370b4999-05c5-46d0-b90e-bb6e3162f65a","resolution":{"observed_at":"2026-08-07T13:05:42.939787Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.433895Z","title":"MiniLM: Deep self-attention distillation for task-agnostic compression of pre- trained transformers,","venue":null,"work_id":"d8915b12-0db3-43fe-97c1-56f5118c5b41","year":2020},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.163253Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:8c9622520a82f46b37a0298a69b56d20a34b42ad2ddd89a97875f97135c26d1e","observation_id":"678d33a2-c5a8-4af4-bcb6-181ac9822bf1","resolution":{"observed_at":"2026-08-07T13:05:44.483135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11401","last_updated":"2021-04-12T15:42:18Z","snapshot_observed_at":"2026-08-07T05:44:30.677502Z","submitted_at":"2020-05-22T21:34:34Z","title":"Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11401","snapshot_observed_at":"2026-08-07T13:05:42.234451Z","title":"Retrieval-augmented generation for knowledge-intensive NLP tasks,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.234451Z"},"links":{"cited_paper":"/paper/2005.11401","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:67a300ea53546e4ded053b5af62005ef209bbc0ae7ee19e8c9fcfbca1be1c01b","observation_id":"eb68fc14-87d2-44af-8b2b-463c0639f213","resolution":{"observed_at":"2026-08-07T13:05:42.234451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.277060Z","title":"Retrieval augmented generation or long-context LLMs? A comprehensive study and hybrid approach,","venue":null,"work_id":"318ade16-f4e9-4c98-b926-771383d19c07","year":2024},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.329808Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:cc059d811ec53b09c1a52ce89c22f3ba7be47b5b4d71fba663ce21ecffcbc057","observation_id":"72f9dd12-b14f-4708-b074-e54ec352d3d5","resolution":{"observed_at":"2026-08-07T13:05:44.355358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:44.103251Z","title":"Blended RAG: Improving RAG (retriever-augmented generation) accuracy with semantic search and hybrid query-based retrievers,","venue":null,"work_id":"11f7677e-af40-4c68-ba9e-ea368cf7b35f","year":2024},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.368581Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:b4faf58e03af8f658157c4497ec1df2c19ac248b1a912fdec8465dd82730d2c3","observation_id":"ae578d0b-31d7-4a57-a4ab-1069181bf991","resolution":{"observed_at":"2026-08-07T13:05:44.177604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:43.922029Z","title":"Self-RAG: Learning to retrieve, generate, and critique through self-reflection","venue":null,"work_id":"c113c329-32f1-4bef-9add-6f309297eef8","year":null},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.423863Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:1a5c21a6e651abfb4b67e2c4f182df4abe0614dd17c5576a36dace9d6c78f1fc","observation_id":"0c9b5c3a-2cfa-4868-8c6c-5ebac555c91d","resolution":{"observed_at":"2026-08-07T13:05:44.011927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:43.686487Z","title":"Few-shot learning with retrieval-augmented language models,","venue":null,"work_id":"1a2ac11c-00b1-4efc-9e1d-27840cb992d0","year":2021},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.533638Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:15077671abab6eaf363482cd3c9a18896eec4aead5ac4ecd322a7703c0777952","observation_id":"68f7d33b-86a6-4456-8997-b6f2fbd0e020","resolution":{"observed_at":"2026-08-07T13:05:43.830554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00172","last_updated":"2020-02-15T01:04:52Z","snapshot_observed_at":"2026-07-06T08:33:58.970043Z","submitted_at":"2019-11-01T01:09:53Z","title":"Generalization through Memorization: Nearest Neighbor Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.00172","snapshot_observed_at":"2026-08-07T13:05:42.586334Z","title":"Generalization through memorization: Nearest neighbor language models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.586334Z"},"links":{"cited_paper":"/paper/1911.00172","citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:24406b6417226ead2bbc088b17dfa9c906fdf177b2588d25b47175995eb4b73d","observation_id":"c1c6dac0-e024-4d0e-93ec-412e708a696c","resolution":{"observed_at":"2026-08-07T13:05:42.586334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:05:43.550357Z","title":"A graph based document retrieval method,","venue":null,"work_id":"ed4b1145-305e-494a-865f-55c8575eb79d","year":2018},"citing_paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:42.701392Z"},"links":{"citing_paper":"/paper/2506.00049"},"observation_digest":"sha256:08cb688f5c47927b3351cfa865abad49c3dcf12f98b500e1970800b42fd38026","observation_id":"57eccb2d-6dca-401b-bb9a-eba4ad1b45da","resolution":{"observed_at":"2026-08-07T13:05:43.581691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00049","last_updated":"2025-05-28T18:39:40Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-07T12:58:28.597770Z","submitted_at":"2025-05-28T18:39:40Z","title":"Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":7,"verified_exact":2,"verified_fuzzy":13},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2506.00049."}