{"as_of":"2026-08-08T04:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:06989d36473f37ba3f893d100c1859d36e3e16d0a21b267f2c1640a7a0e01e91","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:09:33.958225Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T15:59:56.182550Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":"2309.01431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-07-04T15:59:56.182550Z","title":"Benchmarking large lan- guage models in retrieval-augmented generation","venue":null,"work_id":"0cedce0f-ffd3-4107-b96a-00f53c8c3d37","year":2023},"citing_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"reference_index":167,"source":"pdf_text","source_observed_at":"2026-05-24T05:10:25.171044Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2312.10997"},"observation_digest":"sha256:6428d7774cbff939f2822f0b6876e753c40c4c7aad4433edded7cf74d0bddfd7","observation_id":"33845667-6395-494e-8b4e-83727b5c8f1e","resolution":{"observed_at":"2026-05-24T05:13:56.515375Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":"2309.01431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-07-04T15:59:56.182550Z","title":"Benchmarking large lan- guage models in retrieval-augmented generation","venue":null,"work_id":"0cedce0f-ffd3-4107-b96a-00f53c8c3d37","year":2023},"citing_paper":{"arxiv_id":"2401.15391","last_updated":"2024-01-27T11:41:48Z","snapshot_observed_at":"2026-08-02T18:59:01.488566Z","submitted_at":"2024-01-27T11:41:48Z","title":"MultiHop-RAG: Benchmarking Retrieval-Augmented Generation for Multi-Hop Queries","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-15T13:54:19.264893Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2401.15391"},"observation_digest":"sha256:c3218d0dc93a4c1871acc441b2effb948561f1839f0eda172b34af5e64de134d","observation_id":"e212d72d-dc8a-4fab-b5a0-8479cbd48790","resolution":{"observed_at":"2026-05-15T13:54:19.677200Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-08-07T12:09:33.958225Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02037","last_updated":"2025-09-01T10:49:18Z","snapshot_observed_at":"2026-08-07T12:04:39.794252Z","submitted_at":"2025-05-31T03:50:19Z","title":"FinS-Pilot: A Benchmark for Online Financial RAG System","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:33.958225Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2506.02037"},"observation_digest":"sha256:17b244affdc9de9a9072b68ca9dcb9bba3be4dd34b4446693a44252a1e2112cc","observation_id":"ff75edf6-ce90-4e86-8e1d-97709f4fc640","resolution":{"observed_at":"2026-08-07T12:09:33.958225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-08-07T05:42:30.832377Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11111","last_updated":"2025-07-09T06:18:33Z","snapshot_observed_at":"2026-08-07T05:37:03.363226Z","submitted_at":"2025-06-08T16:20:12Z","title":"Evaluating and Improving Robustness in Large Language Models: A Survey and Future Directions","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:42:30.832377Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2506.11111"},"observation_digest":"sha256:f37b0c03e8f43d70e03990b82597e3bdfd11be4c36615e11adcf1a356ede6618","observation_id":"1c0023b4-c832-424b-a09d-244b1892ae4c","resolution":{"observed_at":"2026-08-07T05:42:30.832377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-08-06T19:24:50.354323Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05714","last_updated":"2025-09-10T03:00:18Z","snapshot_observed_at":"2026-08-07T22:03:13.607033Z","submitted_at":"2025-07-08T06:53:28Z","title":"HIRAG: Hierarchical-Thought Instruction-Tuning Retrieval-Augmented Generation","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T19:24:50.354323Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2507.05714"},"observation_digest":"sha256:e9dd0bd44d22fb0ca516fc5bd5d5cc990d9b190e515acd1a9148551d5bab6f28","observation_id":"b07cf664-b701-4a39-a7aa-72b453789ac8","resolution":{"observed_at":"2026-08-06T19:24:50.354323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-08-06T18:55:54.682167Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06956","last_updated":"2025-07-09T15:39:17Z","snapshot_observed_at":"2026-08-07T20:46:16.086010Z","submitted_at":"2025-07-09T15:39:17Z","title":"Investigating the Robustness of Retrieval-Augmented Generation at the Query Level","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T18:55:54.682167Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2507.06956"},"observation_digest":"sha256:a3480fe4a5a945b4de85dd45a8fd7e37eff7b522ab0509cd2869b249b54aafb8","observation_id":"14f09286-b735-4ce0-8edd-f3ddb910014e","resolution":{"observed_at":"2026-08-06T18:55:54.682167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-08-06T14:47:45.647885Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22927","last_updated":"2025-07-23T16:14:08Z","snapshot_observed_at":"2026-08-07T22:03:25.136366Z","submitted_at":"2025-07-23T16:14:08Z","title":"PRGB Benchmark: A Robust Placeholder-Assisted Algorithm for Benchmarking Retrieval-Augmented Generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T14:47:45.647885Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2507.22927"},"observation_digest":"sha256:7188fa7cc7b934fb3d70182e2f37c8b583a44ad61374cf0c2cd3425921bc43f1","observation_id":"858b08f1-d929-47a5-bf18-0706f073017e","resolution":{"observed_at":"2026-08-06T14:47:45.647885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":"2309.01431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-07-04T15:59:56.182550Z","title":"Benchmarking large lan- guage models in retrieval-augmented generation","venue":null,"work_id":"0cedce0f-ffd3-4107-b96a-00f53c8c3d37","year":2023},"citing_paper":{"arxiv_id":"2512.14554","last_updated":"2026-04-17T10:30:55Z","snapshot_observed_at":"2026-08-04T02:33:48.320135Z","submitted_at":"2025-12-16T16:28:32Z","title":"VLegal-Bench: Cognitively Grounded Benchmark for Vietnamese Legal Reasoning of Large Language Models","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T21:36:24.376401Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2512.14554"},"observation_digest":"sha256:b18adebe7645e260457e0036384ab937c41512fcc292e553328b5f72afa8939f","observation_id":"9e88a9eb-a9f0-4166-b1c5-21f292897a40","resolution":{"observed_at":"2026-05-16T21:38:34.169422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":"2309.01431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-07-04T15:59:56.182550Z","title":"Benchmarking large lan- guage models in retrieval-augmented generation","venue":null,"work_id":"0cedce0f-ffd3-4107-b96a-00f53c8c3d37","year":2023},"citing_paper":{"arxiv_id":"2604.03174","last_updated":"2026-04-03T16:49:09Z","snapshot_observed_at":"2026-07-06T22:52:25.307426Z","submitted_at":"2026-04-03T16:49:09Z","title":"Beyond the Parameters: A Technical Survey of Contextual Enrichment in Large Language Models: From In-Context Prompting to Causal Retrieval-Augmented Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T20:02:02.300824Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2604.03174"},"observation_digest":"sha256:dd5e58f26c84bfa0cf08571257b3e887d96f8f4f7b900b8c8a781243c1cb172c","observation_id":"45e1bd51-d266-44b2-bcc8-409a45e9d33f","resolution":{"observed_at":"2026-05-13T20:03:12.194813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":"2309.01431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-07-04T15:59:56.182550Z","title":"Benchmarking large lan- guage models in retrieval-augmented generation","venue":null,"work_id":"0cedce0f-ffd3-4107-b96a-00f53c8c3d37","year":2023},"citing_paper":{"arxiv_id":"2605.10339","last_updated":"2026-05-11T10:42:26Z","snapshot_observed_at":"2026-07-06T23:22:18.704329Z","submitted_at":"2026-05-11T10:42:26Z","title":"An Annotation Scheme and Classifier for Personal Facts in Dialogue","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T04:53:28.491889Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2605.10339"},"observation_digest":"sha256:d58a27a803b0c47fb6e1961352f696e847a16d569723c719631bcee04b327abb","observation_id":"74d8f0b9-40fe-4346-9836-72879ab207eb","resolution":{"observed_at":"2026-05-12T05:51:25.334681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":"2309.01431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-07-04T15:59:56.182550Z","title":"Benchmarking large lan- guage models in retrieval-augmented generation","venue":null,"work_id":"0cedce0f-ffd3-4107-b96a-00f53c8c3d37","year":2023},"citing_paper":{"arxiv_id":"2606.26449","last_updated":"2026-06-24T23:22:38Z","snapshot_observed_at":"2026-08-02T00:01:28.009267Z","submitted_at":"2026-06-24T23:22:38Z","title":"ProvenAI: Provenance-Native Traces of Evidence in Generated Answers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T01:13:29.166367Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2606.26449"},"observation_digest":"sha256:7ab1093a78c0fcefbd1d1dbb6da4d71fef33e914fa45af553a7a1c48b50db788","observation_id":"c6d22939-05f9-4a1a-8605-c567d774fe9e","resolution":{"observed_at":"2026-07-04T15:59:56.184397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":"2309.01431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01431","snapshot_observed_at":"2026-07-04T15:59:56.182550Z","title":"Benchmarking large lan- guage models in retrieval-augmented generation","venue":null,"work_id":"0cedce0f-ffd3-4107-b96a-00f53c8c3d37","year":2023},"citing_paper":{"arxiv_id":"2606.30306","last_updated":"2026-06-29T13:47:42Z","snapshot_observed_at":"2026-08-03T21:13:43.609810Z","submitted_at":"2026-06-29T13:47:42Z","title":"Always-OnAgents:A Survey of Persistent Memory, State, and Governance in LLMAgents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T03:44:51.320606Z"},"links":{"cited_paper":"/paper/2309.01431","citing_paper":"/paper/2606.30306"},"observation_digest":"sha256:d4384a7efaec4e3f6f33a296bfe9c0e9cbe3268a3c76b20406c084cd81548d7d","observation_id":"2f416189-c012-435d-aa98-57777ae7b434","resolution":{"observed_at":"2026-07-01T15:15:48.392474Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2309.01431/citation-record","integrity":"/paper/2309.01431/integrity","json":"/paper/2309.01431/citation-record.json","paper":"/paper/2309.01431"},"outbound":[],"paper":{"arxiv_id":"2309.01431","last_updated":"2023-12-20T11:54:11Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T06:17:58.307195Z","submitted_at":"2023-09-04T08:28:44Z","title":"Benchmarking Large Language Models in Retrieval-Augmented Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2309.01431."}