{"as_of":"2026-08-08T13:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:316a188713b598017b2ea169e8cd26f57e406c1b7c9669fb4ebe9550cf2f50a6","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:41.769511Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T11:07:25.667648Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T10:45:42.818877Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"cited_work":{"arxiv_id":"2505.14212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14212","snapshot_observed_at":"2026-07-01T10:45:42.818877Z","title":"arXiv preprint arXiv:2505.14212 , year=","venue":null,"work_id":"1b3c71c1-c209-4b07-aa73-7408c8d1a4ae","year":2025},"citing_paper":{"arxiv_id":"2604.17943","last_updated":"2026-05-27T05:56:37Z","snapshot_observed_at":"2026-08-01T22:59:27.194899Z","submitted_at":"2026-04-20T08:22:15Z","title":"A Benchmark Construction and Evaluation Framework for Specialist Domains: Case Study on Defense-related Documents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-10T04:51:28.638793Z"},"links":{"cited_paper":"/paper/2505.14212","citing_paper":"/paper/2604.17943"},"observation_digest":"sha256:322d24ba2e510d291f089be697907e7b4cc14a4f56c3286d40ba375804948066","observation_id":"eeaa444b-e0dc-4ac3-9ca2-7a2b5c0d1402","resolution":{"observed_at":"2026-05-10T11:30:19.560054Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"cited_work":{"arxiv_id":"2505.14212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14212","snapshot_observed_at":"2026-07-01T10:45:42.818877Z","title":"arXiv preprint arXiv:2505.14212 , year=","venue":null,"work_id":"1b3c71c1-c209-4b07-aa73-7408c8d1a4ae","year":2025},"citing_paper":{"arxiv_id":"2606.32002","last_updated":"2026-06-30T17:35:14Z","snapshot_observed_at":"2026-08-02T13:47:40.317163Z","submitted_at":"2026-06-30T17:35:14Z","title":"Self-Study Reconsidered: The Hidden Fragility of Learning from Self-Generated QA","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-01T05:07:58.441326Z"},"links":{"cited_paper":"/paper/2505.14212","citing_paper":"/paper/2606.32002"},"observation_digest":"sha256:2efade60927f3c3c30aacf54e2278a77e035720309b430435f14ed9e0e34d394","observation_id":"d9a7987f-303e-4fd2-9401-33766b320323","resolution":{"observed_at":"2026-07-01T10:45:42.820233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14212","snapshot_observed_at":"2026-07-30T11:07:25.667648Z","title":"Automatic dataset generation for knowledge intensive question answering tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27182","last_updated":"2026-07-29T17:52:53Z","snapshot_observed_at":"2026-08-06T08:26:02.944409Z","submitted_at":"2026-07-29T17:52:53Z","title":"GraphQAG: A Knowledge-Graph-Guided Visual Analytics Framework for Question-Answer Pairs Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T11:07:25.667648Z"},"links":{"cited_paper":"/paper/2505.14212","citing_paper":"/paper/2607.27182"},"observation_digest":"sha256:c825e17592d6beb40b78023db162c675b2a6b7195e03e14149f05bb97671a103","observation_id":"afd2a806-9d73-4379-9da8-64ad15f8d019","resolution":{"observed_at":"2026-07-30T11:07:25.667648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14212/citation-record","integrity":"/paper/2505.14212/integrity","json":"/paper/2505.14212/citation-record.json","paper":"/paper/2505.14212"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.928908Z","title":"A bert baseline for the natural questions","venue":null,"work_id":"ee947eaa-261d-4242-b2ef-83d9103399c1","year":2019},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:36.973217Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:d72ca6a7d14ce53882d4008279e4cfb0b8a29cfedf15577c760d65061c86929f","observation_id":"883f2447-cdd6-4e91-a1ce-e4c60fea91d8","resolution":{"observed_at":"2026-08-07T15:42:45.992196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.692745Z","title":"Self-RAG: Learning to retrieve, generate, and critique through self-reflection","venue":null,"work_id":"db786b3b-90e4-4fb5-a58a-c37371ddb084","year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.098029Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:473b6c6a600593f56651acd7380b3808066d72918009af919622f8422240bfdb","observation_id":"83f50275-8c56-4628-8269-31f3c292f8ea","resolution":{"observed_at":"2026-08-07T15:42:45.757436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08406","last_updated":"2024-01-30T13:55:34Z","snapshot_observed_at":"2026-07-06T17:16:13.055978Z","submitted_at":"2024-01-16T14:44:47Z","title":"RAG vs Fine-tuning: Pipelines, Tradeoffs, and a Case Study on Agriculture","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08406","snapshot_observed_at":"2026-08-07T15:42:37.200193Z","title":"Estevão Filho, Todd Hendry, Daniel Holstein, Jennifer Marsman, Nick Mecklenburg, Sara Malvar, Leonardo O","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.200193Z"},"links":{"cited_paper":"/paper/2401.08406","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:6b8f9e3114e328a70137d4efb56182a1cc8cffa127fa9c6eea55516f7640e732","observation_id":"ca39461f-c058-42d9-89d4-e561298ec2c3","resolution":{"observed_at":"2026-08-07T15:42:37.200193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05856","last_updated":"2024-01-11T12:04:11Z","snapshot_observed_at":"2026-07-06T17:14:15.453464Z","submitted_at":"2024-01-11T12:04:11Z","title":"Seven Failure Points When Engineering a Retrieval Augmented Generation System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05856","snapshot_observed_at":"2026-08-07T15:42:37.271291Z","title":"Seven failure points when engineering a retrieval augmented generation system, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.271291Z"},"links":{"cited_paper":"/paper/2401.05856","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:2763f3325a3733e79498d793b8e1750abec18f8243994ea6b38a25f5646fee2f","observation_id":"dd170161-37f0-4969-b722-c72937590584","resolution":{"observed_at":"2026-08-07T15:42:37.271291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:37.366055Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.366055Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:466d3c1035d5b562e9fbe636d408662f0baa59caace4e3310b68ba09ce5009a2","observation_id":"3ea29277-ef8a-4336-a335-707891d956e3","resolution":{"observed_at":"2026-08-07T15:42:37.366055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T15:42:37.430426Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.430426Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:9056f20443c5081130daeef328a7172599b5debf248c2546d79a6c25b315b128","observation_id":"0d601c7b-8cbc-4cb2-abda-a3c6b8e0aea8","resolution":{"observed_at":"2026-08-07T15:42:37.430426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:37.540607Z","title":"The TechQA dataset","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.540607Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:dcda5d14e0d25845a90ac1411684860a2ad2f37965bcb289100c202734399eea","observation_id":"c64f706d-1e08-4ef6-b426-535fd1b856ce","resolution":{"observed_at":"2026-08-07T15:42:37.540607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.449907Z","title":"Legal-bert: The muppets straight out of law school","venue":null,"work_id":"abb56671-c431-4c23-aac5-57f07640a293","year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.676038Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:b528f6359d37835a203fca2aab83927ca59c5480145df3f0afee9ac33fca13e4","observation_id":"e4fd9083-19f5-48eb-bf40-16f9b1087172","resolution":{"observed_at":"2026-08-07T15:42:45.541323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:37.774638Z","title":"Reading Wikipedia to answer open-domain questions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.774638Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:4f0fc1cb25c25c82334b488b3ba61352d013fb1e32b609c2a5e9e9d3ebba37e7","observation_id":"0021b0f8-e8f2-41f5-9f00-adbd17bedbb1","resolution":{"observed_at":"2026-08-07T15:42:37.774638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.230249Z","title":"Dialog inpainting: Turning documents to dialogs","venue":null,"work_id":"3404d6f4-082f-4f01-966b-d66a389b265f","year":2022},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.895457Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:bbc00a167472367ba2f2fb8f19774b2d8ff2d33aca59a7de7709006cfa828c73","observation_id":"872002b5-8c2f-4c60-b592-04e8b037ce88","resolution":{"observed_at":"2026-08-07T15:42:45.334160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.051110Z","title":"Unsloth, 2023","venue":null,"work_id":"e1febb5c-eddf-4d33-8af9-a6e872caba0d","year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:37.956956Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:ed02c586b93adb84cc9728c8f2cd281c0308be397acabe7eec115d2b6a56f9b7","observation_id":"5c4d2bce-3afd-4cb0-a92c-f7b844f20dea","resolution":{"observed_at":"2026-08-07T15:42:45.163237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-07T15:42:38.104744Z","title":"Qlora: Efficient finetuning of quantized llms, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.104744Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:33ed51b3e541e8afb18cec71fcf2e75f452776cd6e4f4e460ac314a91ce86544","observation_id":"ea3b9f92-27c1-4202-a383-9ab2cab21d32","resolution":{"observed_at":"2026-08-07T15:42:38.104744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T15:42:38.208343Z","title":"Bert: Pre-training of deep bidirec- tional transformers for language understanding.arXiv preprint arXiv:1810.04805, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.208343Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:2b9ea5bc7a31d875114a03090bc948f6212cb0da4cada5c84b05e641975df548","observation_id":"aadc6bb6-0e39-492a-b903-a1162bd243f6","resolution":{"observed_at":"2026-08-07T15:42:38.208343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10496","last_updated":"2022-12-20T18:09:52Z","snapshot_observed_at":"2026-07-06T14:33:08.041820Z","submitted_at":"2022-12-20T18:09:52Z","title":"Precise Zero-Shot Dense Retrieval without Relevance Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10496","snapshot_observed_at":"2026-08-07T15:42:38.323013Z","title":"Precise zero-shot dense retrieval without relevance labels, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.323013Z"},"links":{"cited_paper":"/paper/2212.10496","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:6f85c6762040b8dc438e5e5e8364f1cf03f7b4269d685b85f9ec258e749947d7","observation_id":"31a48569-3b1d-4a5c-9b96-e00af5550e78","resolution":{"observed_at":"2026-08-07T15:42:38.323013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-07T15:42:38.423678Z","title":"Retrieval-augmented generation for large language models: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.423678Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:bc664065ae5eea6c3262474f527029a7ebf8ed7bc2a17e95b6287be365717e53","observation_id":"7901d312-a284-4e0f-99cd-3e60c283a006","resolution":{"observed_at":"2026-08-07T15:42:38.423678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.918353Z","title":"Re2g: Retrieve, rerank, generate","venue":null,"work_id":"4e363b43-6956-42d1-a928-f0e79f9188c9","year":2022},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.494922Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:e0401987fa722cb22ed619c92dc0be0a4983a3363d52e7e5af06a46804377d0b","observation_id":"f2e4f2ac-d485-4bc0-ad45-8220d626ddb2","resolution":{"observed_at":"2026-08-07T15:42:44.994942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:42:38.597842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.597842Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:5e71917b618d682fa128a3fbe64eeead995401858103649b5f7996b0cdaed366","observation_id":"e5f892c8-b6b6-4993-b427-575ef4b3688a","resolution":{"observed_at":"2026-08-07T15:42:38.597842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:42.383363Z","title":"Evaluating large language models in generating synthetic hci research data: a case study","venue":null,"work_id":"f7e9d28f-310a-46d2-a7ea-3579b4c65a94","year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.709033Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:8226dab0dbd6e157a537e2ec3209b50ce63a8f3296a9358aadf65594fc52e41f","observation_id":"87de8dff-a5e6-4bb2-b29d-08b3ef5f86d0","resolution":{"observed_at":"2026-08-07T15:42:42.436498Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.732015Z","title":"Retrieve, annotate, evaluate, repeat: Leveraging multimodal llms for large-scale product retrieval evaluation,","venue":null,"work_id":"2090df6b-25f6-4e25-b330-45329d189dc9","year":null},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.798538Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:f73175023f7f8937c9ef3f33539d6d26f01f15d64480dcaeeadebb604bb61966","observation_id":"3ffc02e1-5c2a-4978-b6de-8bbc44805849","resolution":{"observed_at":"2026-08-07T15:42:44.807141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T15:42:38.951239Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.951239Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:703635979eebed7bd8d6cd1a4572966752028dfbc77d45562446c1f0e974e201","observation_id":"f08ec513-4fb1-4d70-9d52-be6861f8e631","resolution":{"observed_at":"2026-08-07T15:42:38.951239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.01282","last_updated":"2021-02-03T09:18:34Z","snapshot_observed_at":"2026-08-03T22:53:08.799163Z","submitted_at":"2020-07-02T17:44:57Z","title":"Leveraging Passage Retrieval with Generative Models for Open Domain Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.01282","snapshot_observed_at":"2026-08-07T15:42:39.041590Z","title":"Leveraging passage retrieval with generative models for open domain question answering, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.041590Z"},"links":{"cited_paper":"/paper/2007.01282","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:f77cbb43b43c11d226f9bdbdc986657d586b4bbceb6f8b8d58dfa3cb97e8b7bd","observation_id":"72f2d793-f29d-4dc3-a963-78f46bbbb289","resolution":{"observed_at":"2026-08-07T15:42:39.041590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:39.151195Z","title":"Perplexity—a measure of the difficulty of speech recognition tasks.The Journal of the Acoustical Society of America, 62(S1):S63–S63, 1977","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.151195Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:2bad941e7e751129234894b3a7e446dd71a5995390bc0361a03462ab4a197610","observation_id":"1eb595b0-13ea-4f15-8124-23b8988bc241","resolution":{"observed_at":"2026-08-07T15:42:39.151195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.602392Z","title":"Adaptive-rag: Learning to adapt retrieval-augmented large language models through question complexity","venue":null,"work_id":"de4e7995-37be-48d0-bf34-caf4f031b4c6","year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.239093Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:35f28d6ce3cb5c8b25de9d1949b96d45e5989e3206c2e98dd27f26066ae31cda","observation_id":"102530bd-8e0f-4fa2-8d44-c991067c27b6","resolution":{"observed_at":"2026-08-07T15:42:44.658777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T15:42:39.438054Z","title":"Mistral 7b (2023).arXiv preprint arXiv:2310.06825, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.438054Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:e6862972fa1dd9f505716d96034a970354af864f4a408e7466965627024f1973","observation_id":"f073ddd3-6836-4d19-a9f6-cc42f293d988","resolution":{"observed_at":"2026-08-07T15:42:39.438054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:39.512000Z","title":"Weld, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.512000Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:39bc1c0a6994ccf48059b1c9f22c8ff6f544540af0e40ffdb94c811042698365","observation_id":"439054b6-2f3f-4481-b59a-806469cfd443","resolution":{"observed_at":"2026-08-07T15:42:39.512000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04906","last_updated":"2020-09-30T21:27:13Z","snapshot_observed_at":"2026-07-06T09:11:26.109763Z","submitted_at":"2020-04-10T04:53:17Z","title":"Dense Passage Retrieval for Open-Domain Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04906","snapshot_observed_at":"2026-08-07T15:42:39.611689Z","title":"Dense passage retrieval for open-domain question answering, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.611689Z"},"links":{"cited_paper":"/paper/2004.04906","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:56d1b199e9e7ed0eb83f93e41aa733f2453122360c60dbf31cd5f4388d4e0596","observation_id":"878fe62c-97d1-490b-aa8b-f603eff3e4b0","resolution":{"observed_at":"2026-08-07T15:42:39.611689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.455422Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":"9a1eb314-f606-4c9a-92ef-867ddfb36de2","year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.706834Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:ced8d984093be095afffc28ec6d83c369c97912d33df851807271f1d35a8483b","observation_id":"7a44a33d-1abb-4ec6-90a9-0d378d35fc2c","resolution":{"observed_at":"2026-08-07T15:42:44.517065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:39.822638Z","title":"Retrieval-augmented generation for knowledge- intensive nlp tasks.Advances in Neural Information Processing Systems, 33:9459–9474, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.822638Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:0819e6aaaac648d06d9f9a6c37f76de299378e6667412705e14ec5963856fae0","observation_id":"2aa0f8d1-c564-4a56-bf0a-bd007209b014","resolution":{"observed_at":"2026-08-07T15:42:39.822638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.275789Z","title":"Synthetic data generation with large language models for text classification: Potential and limitations, 2023","venue":null,"work_id":"0d3eaed0-9987-4ff5-919f-46cc7bf15789","year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.919423Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:ccc83dab4d69ca99d2ffda901d2ecde93825a6d812210a728240baff2cd1ded3","observation_id":"47d9b97e-b580-45e9-82bd-be61bc545d83","resolution":{"observed_at":"2026-08-07T15:42:44.361996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:39.989028Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.989028Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:c4213e85ad0c5881ce22235ec5b1481bbe2d6ffde2382e33fbb8a00bfb3e4290","observation_id":"14e58741-4e7b-4c09-8ca1-66ffb88798e3","resolution":{"observed_at":"2026-08-07T15:42:39.989028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.135458Z","title":"RA-DIT: Retrieval- augmented dual instruction tuning","venue":null,"work_id":"ecf797cf-135b-40e9-a347-95919d44e501","year":null},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.062575Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:9eaa52050a003d1146d1dcfb5c9287e0d8d7022e6743dc346b769ad35534b949","observation_id":"ad93998d-cbe7-4d35-b0c7-6708318199d0","resolution":{"observed_at":"2026-08-07T15:42:44.187043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14283","last_updated":"2023-10-23T02:34:49Z","snapshot_observed_at":"2026-07-06T15:31:41.985646Z","submitted_at":"2023-05-23T17:27:50Z","title":"Query Rewriting for Retrieval-Augmented Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14283","snapshot_observed_at":"2026-08-07T15:42:40.223793Z","title":"Query rewriting for retrieval-augmented large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.223793Z"},"links":{"cited_paper":"/paper/2305.14283","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:658474e4b5adb7016df36f08b2bfc576e3e1f016519e0ce544468c01536f081e","observation_id":"8706be44-2056-423f-a05a-14dc3a253a0b","resolution":{"observed_at":"2026-08-07T15:42:40.223793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.934343Z","title":null,"venue":null,"work_id":"824c60ad-7d95-47ec-a490-a8bc83d16698","year":null},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.159221Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:20cc0195586eaaf0094a2a60758f6219fac0815b158d380a2b2a7f39c26f11a4","observation_id":"109f26a5-9217-4b9b-ab1c-4de610b46857","resolution":{"observed_at":"2026-08-07T15:42:44.018366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05934","last_updated":"2024-01-30T11:58:10Z","snapshot_observed_at":"2026-08-05T09:41:20.689942Z","submitted_at":"2023-12-10T16:52:00Z","title":"Fine-Tuning or Retrieval? Comparing Knowledge Injection in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05934","snapshot_observed_at":"2026-08-07T15:42:40.407545Z","title":"Fine-tuning or retrieval? comparing knowledge injection in llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.407545Z"},"links":{"cited_paper":"/paper/2312.05934","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:583b9964bd69d84e4d1c4e6452a78c2814915bf84b54a85d1afd81503c9d1017","observation_id":"7396d248-b413-4692-902e-4641d776686c","resolution":{"observed_at":"2026-08-07T15:42:40.407545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:40.310149Z","title":"Synthetic data generation using large language models: Advances in text and code, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.310149Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:5c5037eed6787af5b88379844315b37b1815c13cb19d421cca675cc01e8f29af","observation_id":"8baded44-eb95-426e-adb2-b9f063e32362","resolution":{"observed_at":"2026-08-07T15:42:40.310149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.629105Z","title":"Replug: Retrieval-augmented black-box language models","venue":null,"work_id":"ddfd52ee-7686-4d2c-a9c4-f173d4d57722","year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.597237Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:ed8053732cdd229a36c04e5db5151bc96fbb9011af6eee8b4c0cbf926a8f8068","observation_id":"b79e5b7d-7dad-4dea-9f85-e6cbd58a05e3","resolution":{"observed_at":"2026-08-07T15:42:43.728246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.793587Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"518e1ca9-308f-42f9-b4bd-11719a8b0b1e","year":2002},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.477085Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:3731f78cb80653cfa9b9089211db1c0172e38129586dd2745d22c425f0eecc8e","observation_id":"ca6187f5-5525-4c81-8e78-61a9c5c3c2b2","resolution":{"observed_at":"2026-08-07T15:42:43.871340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15391","last_updated":"2024-01-27T11:41:48Z","snapshot_observed_at":"2026-08-02T18:59:01.488566Z","submitted_at":"2024-01-27T11:41:48Z","title":"MultiHop-RAG: Benchmarking Retrieval-Augmented Generation for Multi-Hop Queries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15391","snapshot_observed_at":"2026-08-07T15:42:40.814274Z","title":"Multihop-rag: Benchmarking retrieval-augmented generation for multi-hop queries, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.814274Z"},"links":{"cited_paper":"/paper/2401.15391","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:b8a4686655f7d669ff3fac7e68b7015006de7aed7b97e29fb6efdde3d3ea0a66","observation_id":"1940c952-2775-44e0-af51-091bd059c073","resolution":{"observed_at":"2026-08-07T15:42:40.814274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11517","last_updated":"2021-06-22T03:17:59Z","snapshot_observed_at":"2026-08-08T07:39:49.422013Z","submitted_at":"2021-06-22T03:17:59Z","title":"Fine-tune the Entire RAG Architecture (including DPR retriever) for Question-Answering","version":1},"cited_work":{"arxiv_id":"2106.11517","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.11517","snapshot_observed_at":"2026-08-07T15:42:41.907820Z","title":"Fine-tune the Entire RAG Architecture (including DPR retriever) for Question-Answering","venue":"cs.IR","work_id":"1fb3bc64-e534-49dc-ad6a-0bbc7289ee0f","year":2021},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.723536Z"},"links":{"cited_paper":"/paper/2106.11517","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:972d0bcc86a42322198c75ef5510d08908793b663f70114515c68eb4413ce2c9","observation_id":"a32d2a33-f545-466c-9c95-e9cd0a15d681","resolution":{"observed_at":"2026-08-07T15:42:41.944474Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07176","last_updated":"2025-05-31T04:07:21Z","snapshot_observed_at":"2026-07-06T19:30:39.426499Z","submitted_at":"2024-10-09T17:59:58Z","title":"Astute RAG: Overcoming Imperfect Retrieval Augmentation and Knowledge Conflicts for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07176","snapshot_observed_at":"2026-08-07T15:42:41.009889Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.009889Z"},"links":{"cited_paper":"/paper/2410.07176","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:bde2e9d75da6c69988ec77c4d1124fd22cd7943bd58b939bf5d30d0477cbd10b","observation_id":"bb6cfa74-840c-4a20-ab11-31254aa7f71a","resolution":{"observed_at":"2026-08-07T15:42:41.009889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:40.916194Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.916194Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:7f6a091e3b6c5a6409d7a49c040178ae0644178abdb8c0a85bfd8c423e6b576b","observation_id":"3362cb33-a730-403e-9b8b-e2e28732e26c","resolution":{"observed_at":"2026-08-07T15:42:40.916194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.262447Z","title":"Cohen, Ruslan Salakhutdinov, and Christopher D","venue":null,"work_id":"b9bc006c-96e9-4a95-8a51-e27d24fbe584","year":2018},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.324026Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:343100f8c93d81151f4aab1643dae60d0150b3ba9e6f3e7296bcef3d703d6b06","observation_id":"60f8bb13-fe9a-49ad-a2b8-92a0b2112bf6","resolution":{"observed_at":"2026-08-07T15:42:43.340041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.450043Z","title":"Towards system 2 reasoning in llms: Learning how to think with meta chain-of-thought,","venue":null,"work_id":"ac0ef7f1-d177-43b5-ba97-ef889338a2ff","year":null},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.140068Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:71a50a11406a6873d3543cdabaf09d7e33762c1804bc41968928b5da4d1d1571","observation_id":"f3706b0f-9452-4ba3-a236-bce2058023bb","resolution":{"observed_at":"2026-08-07T15:42:43.550612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:42.814606Z","title":"Limitations","venue":null,"work_id":"403c40be-c24a-41a4-a933-84c83b7b19c4","year":2020},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.601093Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:61e2e951c08e627f54559ff92cf5b4d00dc8df1d2fa48c32173fe11316850bc4","observation_id":"5959e0aa-7424-4e59-9da2-53b1da599da6","resolution":{"observed_at":"2026-08-07T15:42:42.895189Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.040712Z","title":"Boosting conversational question answering with fine-grained retrieval-augmentation and self-check","venue":null,"work_id":"624cad7f-9b7f-48be-874c-d542a87cf68d","year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.427031Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:62d890220a40f2d59fb4383a04e9b4ecb2fa366960e433885b24f551b3702f7b","observation_id":"9a873439-7ef1-42fd-8bbd-3825ae6f777d","resolution":{"observed_at":"2026-08-07T15:42:43.146750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:42.649885Z","title":"20 • Depending on the country in which research is conducted, IRB approval (or equivalent) may be required for any human subjects research","venue":null,"work_id":"1e3f8906-08ac-4f8b-9dd4-39d045131677","year":2025},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.769511Z"},"links":{"citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:15725ce6636d3610d4abd7071510dde85c48a4fe9840e6dd425cd57457cc6504","observation_id":"fa825ad6-012a-4b6d-b0a1-d776e10aae85","resolution":{"observed_at":"2026-08-07T15:42:42.737214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11860","last_updated":"2024-09-18T10:30:50Z","snapshot_observed_at":"2026-07-06T19:17:28.308643Z","submitted_at":"2024-09-18T10:30:50Z","title":"Retrieve, Annotate, Evaluate, Repeat: Leveraging Multimodal LLMs for Large-Scale Product Retrieval Evaluation","version":1},"cited_work":{"arxiv_id":"2409.11860","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.11860","snapshot_observed_at":"2026-08-07T15:42:42.166440Z","title":"Retrieve, Annotate, Evaluate, Repeat: Leveraging Multimodal LLMs for Large-Scale Product Retrieval Evaluation","venue":"cs.IR","work_id":"0a7a32b3-58fa-4029-8666-da706f73341f","year":2024},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.899569Z"},"links":{"cited_paper":"/paper/2409.11860","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:fa1ecbfc1a0c4aa221b99dbd9a7269814302bd0bea8b5f9b43b23b5f370b392a","observation_id":"6d981240-12ea-42af-a874-8988038e7dae","resolution":{"observed_at":"2026-08-07T15:42:42.279027Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04682","last_updated":"2025-01-08T18:42:48Z","snapshot_observed_at":"2026-07-06T20:18:21.419068Z","submitted_at":"2025-01-08T18:42:48Z","title":"Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04682","snapshot_observed_at":"2026-08-07T15:42:41.245910Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.245910Z"},"links":{"cited_paper":"/paper/2501.04682","citing_paper":"/paper/2505.14212"},"observation_digest":"sha256:6b7601a555731ab9c9980eaa602243f9ff05de082e00a9113b744f897ab26d55","observation_id":"1189bdc3-20cf-4933-abe3-eb27f0a95585","resolution":{"observed_at":"2026-08-07T15:42:41.245910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14212","last_updated":"2025-05-20T11:16:29Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T13:48:21.422298Z","submitted_at":"2025-05-20T11:16:29Z","title":"Automatic Dataset Generation for Knowledge Intensive Question Answering Tasks"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":3,"verified_fuzzy":17},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 3 inbound Pith citation observations for arXiv:2505.14212."}