{"as_of":"2026-08-18T01:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7ffa13a97d74ae02cbf54fca22be68c2a1c55fc601a53979c374bb7cb3792fba","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:30:54.621441Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07370/citation-record","integrity":"/paper/2608.07370/integrity","json":"/paper/2608.07370/citation-record.json","paper":"/paper/2608.07370"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.14199","last_updated":"2024-11-21T15:07:42Z","snapshot_observed_at":"2026-08-15T22:46:04.473064Z","submitted_at":"2024-11-21T15:07:42Z","title":"OpenScholar: Synthesizing Scientific Literature with Retrieval-augmented LMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14199","snapshot_observed_at":"2026-08-15T14:30:54.531848Z","title":"org/abs/2411.14199","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.531848Z"},"links":{"cited_paper":"/paper/2411.14199","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:fe002136256ba1b482eb94736ddbede8a19e3b62ddd9cb81bf70d0f1cdae6603","observation_id":"c5ce9259-b330-4c06-bb51-b7397cfc39c0","resolution":{"observed_at":"2026-08-15T14:30:54.531848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07559","last_updated":"2023-12-14T19:40:04Z","snapshot_observed_at":"2026-08-16T14:36:26.086381Z","submitted_at":"2023-12-08T18:50:20Z","title":"PaperQA: Retrieval-Augmented Generative Agent for Scientific Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07559","snapshot_observed_at":"2026-08-15T14:30:54.559909Z","title":"10 Yoonjoo Lee, Kyungjae Lee, Sunghyun Park, Dasol Hwang, Jaehyeon Kim, Hong-In Lee, and Moontae Lee","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.559909Z"},"links":{"cited_paper":"/paper/2312.07559","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:351f01492d9ed98ff1366750524cce726956933d8748301e81db484528879626","observation_id":"20b53561-cd31-45df-a79e-1075dc16da3b","resolution":{"observed_at":"2026-08-15T14:30:54.559909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04075","last_updated":"2024-11-06T17:52:01Z","snapshot_observed_at":"2026-08-16T13:02:22.030735Z","submitted_at":"2024-11-06T17:52:01Z","title":"M3SciQA: A Multi-Modal Multi-Document Scientific QA Benchmark for Evaluating Foundation Models","version":1},"cited_work":{"arxiv_id":"2411.04075","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.04075","snapshot_observed_at":"2026-08-15T14:30:54.855758Z","title":"M3SciQA: A Multi-Modal Multi-Document Scientific QA Benchmark for Evaluating Foundation Models","venue":"cs.CL","work_id":"f7e6eb43-e760-4c33-b88c-1a2b8cd26cf6","year":2024},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.566258Z"},"links":{"cited_paper":"/paper/2411.04075","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:82ade1d029d1536a1aea433a3259cc9f32d8c7386155b7c9626ad4c1022b3d14","observation_id":"8dc66b33-a677-46e4-8c19-b060447f9bef","resolution":{"observed_at":"2026-08-15T14:30:54.860778Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02782","last_updated":"2020-07-07T00:40:21Z","snapshot_observed_at":"2026-08-10T20:43:18.553766Z","submitted_at":"2019-11-07T07:34:43Z","title":"S2ORC: The Semantic Scholar Open Research Corpus","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02782","snapshot_observed_at":"2026-08-15T14:30:54.571713Z","title":"URL https://arxiv.org/abs/1911.02782","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.571713Z"},"links":{"cited_paper":"/paper/1911.02782","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:1ec567d0eac1a6f3430ee50a4263cfcb8d4920a0f93a2e3fd106ac4b37dd19df","observation_id":"31252226-3cc8-4c92-a46b-c9c6b6f3a393","resolution":{"observed_at":"2026-08-15T14:30:54.571713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:54.985609Z","title":"SciRepEval: A multi-format benchmark for scientific document representations","venue":null,"work_id":"09c2f63b-6edd-4bb4-8dd4-8e587b749133","year":2023},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.580981Z"},"links":{"citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:fd5cdd5341681dc6d895fbab7e95b21faa49d297808277d71b7ea8b26d06dac6","observation_id":"1858a3f2-562d-40ce-b596-1b4d41c80e0a","resolution":{"observed_at":"2026-08-15T14:30:54.990301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13308","last_updated":"2023-11-13T18:25:27Z","snapshot_observed_at":"2026-08-16T16:13:44.446127Z","submitted_at":"2022-11-23T21:25:39Z","title":"SciRepEval: A Multi-Format Benchmark for Scientific Document Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13308","snapshot_observed_at":"2026-08-15T14:30:54.586872Z","title":"2211.13308","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.586872Z"},"links":{"cited_paper":"/paper/2211.13308","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:796749f4bee66bf9917e0bfcc737b91b27576766efb22beb80278f249d695982","observation_id":"eda2aec2-06c5-4e32-9965-1dd26933dbaa","resolution":{"observed_at":"2026-08-15T14:30:54.586872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14974","last_updated":"2020-10-03T04:31:06Z","snapshot_observed_at":"2026-08-10T13:25:07.438493Z","submitted_at":"2020-04-30T17:22:57Z","title":"Fact or Fiction: Verifying Scientific Claims","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14974","snapshot_observed_at":"2026-08-15T14:30:54.591331Z","title":"2004.14974","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.591331Z"},"links":{"cited_paper":"/paper/2004.14974","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:a74daa64213b91562a314823a57035cb517d55ef777142d4f6912f5d004afd14","observation_id":"b0376d14-a1e3-41cc-bdbc-99849335f3b8","resolution":{"observed_at":"2026-08-15T14:30:54.591331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09644","last_updated":"2026-06-08T15:39:06Z","snapshot_observed_at":"2026-08-17T03:26:21.439157Z","submitted_at":"2026-06-08T15:39:06Z","title":"Where Does the Answer Come From? Benchmarking View-Level Visual Evidence Identification in Multi-View MLLMs for Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2606.09644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.09644","snapshot_observed_at":"2026-08-15T14:30:54.817497Z","title":"Where Does the Answer Come From? Benchmarking View-Level Visual Evidence Identification in Multi-View MLLMs for Autonomous Driving","venue":"cs.CL","work_id":"e38b47f5-19b9-4af4-985c-2585e0b13b23","year":2026},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.595867Z"},"links":{"cited_paper":"/paper/2606.09644","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:4b2c4b978e79faca0b5d85ab327df7bb0f91730d9bbd20fc68f9cf6182d15a68","observation_id":"25367024-c1c6-489f-84a3-17b2c85c15a0","resolution":{"observed_at":"2026-08-15T14:30:54.821797Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:54.970577Z","title":"URLhttps://aclanthology.org/2025.findings-acl.199/","venue":null,"work_id":"6227b8c6-d691-46cd-b0c2-6f38ed5f8316","year":2025},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.607791Z"},"links":{"citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:52fb9a27231d9ea1a3e28055cdd30d0c1a806decfcdcf0229bdb150b4879dca3","observation_id":"00a3ce9b-719d-4285-bf6a-6112fb56a0be","resolution":{"observed_at":"2026-08-15T14:30:54.976125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:54.954367Z","title":"1.ev 001:naacl2025 00963, source typecitation context, Section 2.1 Model Compression–Quantization","venue":null,"work_id":"30985f0e-03f9-4fdd-9a69-3ff0ac830a00","year":2022},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.612490Z"},"links":{"citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:8999cf1505242ce78dca1ccb3ac0e6d5d0424559d5dfab9cc708cf5f6326f835","observation_id":"6135d7c7-3b8b-492b-bcd7-38641803d549","resolution":{"observed_at":"2026-08-15T14:30:54.960140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:54.936130Z","title":"Frantar and Alistarh (2022) adapt the OBS framework to quantization","venue":null,"work_id":"c6e769f2-3ce3-4ad9-804f-09aa6fef9208","year":2022},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.617351Z"},"links":{"citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:434c6d6f8497bd7b561d2eae4b2e89b180c090cdb28d174ea82d085d2224ba04","observation_id":"b3cba4af-8d3e-4cc9-9c0b-578c5a257e57","resolution":{"observed_at":"2026-08-15T14:30:54.943089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:54.919212Z","title":"Gold answer object.The answer options are: A, Frantar et al","venue":null,"work_id":"d15805dd-7584-4fa6-998d-61fcba8da9da","year":2023},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.621441Z"},"links":{"citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:285027d0533ea00607855ba7d210c7a0098c93cc63eaedef9bfad2a042cbd8b4","observation_id":"3e931642-6267-43f7-94a6-c271509017f1","resolution":{"observed_at":"2026-08-15T14:30:54.924985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.04177","last_updated":"2020-05-14T14:55:33Z","snapshot_observed_at":"2026-08-11T00:10:18.496978Z","submitted_at":"2020-05-08T17:16:35Z","title":"Evidence Inference 2.0: More Data, Better Models","version":2},"cited_work":{"arxiv_id":"2005.04177","doi":"10.48550/arxiv.2005.04177","metadata_source":"pith","pith_arxiv_id":"2005.04177","snapshot_observed_at":"2026-08-15T18:16:14.067578Z","title":"Evidence Inference 2.0: More Data, Better Models","venue":"cs.CL","work_id":"0a27ef18-8ba3-43bc-adaa-073027013591","year":2020},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.548443Z"},"links":{"cited_paper":"/paper/2005.04177","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:90c21ce6b16e5132a3c190b4ae38a2737a7e718ecc617721383b8bf83eacb361","observation_id":"a2ce1356-5956-43a6-8a3b-74ca49cbd2eb","resolution":{"observed_at":"2026-08-15T14:30:54.722008Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T18:38:15.925871+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T18:38:15.925871+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T18:38:15.925871+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.03011","last_updated":"2021-05-07T00:12:34Z","snapshot_observed_at":"2026-08-16T18:26:27.965819Z","submitted_at":"2021-05-07T00:12:34Z","title":"A Dataset of Information-Seeking Questions and Answers Anchored in Research Papers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.03011","snapshot_observed_at":"2026-08-15T14:30:54.543810Z","title":"URL https://arxiv.org/abs/2105.03011","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.543810Z"},"links":{"cited_paper":"/paper/2105.03011","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:279268485efcf77519d2912db222ac796f7ca01a8f58b4fdc4eea6d0d96e9564","observation_id":"5fafacc8-a6f1-4f17-ad6b-de2850a8dd8c","resolution":{"observed_at":"2026-08-15T14:30:54.543810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08037","last_updated":"2023-02-10T20:04:05Z","snapshot_observed_at":"2026-08-16T16:08:20.780586Z","submitted_at":"2022-12-15T18:45:29Z","title":"Attributed Question Answering: Evaluation and Modeling for Attributed Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08037","snapshot_observed_at":"2026-08-15T14:30:54.538294Z","title":"Pradeep Dasigi, Kyle Lo, Iz Beltagy, Arman Cohan, Noah A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.538294Z"},"links":{"cited_paper":"/paper/2212.08037","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:90a4ee3f0478f9aa06b89a38140b27305adf15e8a401af120df4d4dfbb378f86","observation_id":"8d6e2008-de3c-43fb-8c7a-e47d8f3ccfaf","resolution":{"observed_at":"2026-08-15T14:30:54.538294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14627","last_updated":"2023-10-31T15:04:35Z","snapshot_observed_at":"2026-08-17T02:40:50.509296Z","submitted_at":"2023-05-24T01:53:49Z","title":"Enabling Large Language Models to Generate Text with Citations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14627","snapshot_observed_at":"2026-08-15T14:30:54.555017Z","title":"URLhttps://arxiv.org/ abs/2305.14627","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.555017Z"},"links":{"cited_paper":"/paper/2305.14627","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:303632fca52f6773032c49a05d7a39ded913311a9ae1965535c2516e2d81c0bb","observation_id":"d2e5d653-9761-4363-ba00-d83f896cd0e8","resolution":{"observed_at":"2026-08-15T14:30:54.555017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18940","last_updated":"2024-10-16T18:37:15Z","snapshot_observed_at":"2026-08-16T13:35:19.580211Z","submitted_at":"2024-07-10T18:00:03Z","title":"LitSearch: A Retrieval Benchmark for Scientific Literature Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18940","snapshot_observed_at":"2026-08-15T14:30:54.524028Z","title":"org/abs/2407.18940","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.524028Z"},"links":{"cited_paper":"/paper/2407.18940","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:d8aab09145fd44edad69f3564bbc482ab85c7a5cb3525110111cb8f5936bbe7a","observation_id":"ce84ca4f-24a2-4421-a458-b3452b34c027","resolution":{"observed_at":"2026-08-15T14:30:54.524028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:54.601275Z","title":"Xuanliang Zhang, Dingzirui Wang, Baoxin Wang, Longxu Dou, Xinyuan Lu, Keyan Xu, Dayong Wu, and Qingfu Zhu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.601275Z"},"links":{"citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:0cd3b86afdad580cb3619e117c71922026085e40ae179568c5e8d45404234908","observation_id":"d42ecd88-28be-4411-8de4-8222621d70d8","resolution":{"observed_at":"2026-08-15T14:30:54.601275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20676","last_updated":"2026-05-20T03:44:06Z","snapshot_observed_at":"2026-08-13T06:56:21.543253Z","submitted_at":"2026-05-20T03:44:06Z","title":"VISTAQA: Benchmarking Joint Visual Question Answering and Pixel-Level Evidence","version":1},"cited_work":{"arxiv_id":"2605.20676","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20676","snapshot_observed_at":"2026-08-15T14:30:54.837053Z","title":"VISTAQA: Benchmarking Joint Visual Question Answering and Pixel-Level Evidence","venue":"cs.CV","work_id":"79f02215-a8bb-4e91-93f9-0158b45f29be","year":2026},"citing_paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-15T14:30:54.576261Z"},"links":{"cited_paper":"/paper/2605.20676","citing_paper":"/paper/2608.07370"},"observation_digest":"sha256:d965f68466e02e2566b11b963190a1668c76912d6198cb081dcb41c027654cec","observation_id":"517a6875-2d50-41e5-ac40-08da59e2afa4","resolution":{"observed_at":"2026-08-15T14:30:54.842123Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.07370","last_updated":"2026-08-07T16:11:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T09:56:23.937145Z","submitted_at":"2026-08-07T16:11:52Z","title":"LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2608.07370."}