{"as_of":"2026-08-08T13:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c776a1ce44e2a589ef93394ccf7958ce6f1a3da00fd46159dec9513e481f6046","coverage":[{"denominator":102,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T00:03:31.683006Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T23:56:44.979471Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T23:59:15.248753Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"cited_work":{"arxiv_id":"2602.11908","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.11908","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jiang, Z., Liu, A., and Durme, B","venue":null,"work_id":"c66398c1-ec88-419d-84f9-78d5fa416493","year":null},"citing_paper":{"arxiv_id":"2604.17487","last_updated":"2026-05-17T16:25:26Z","snapshot_observed_at":"2026-08-03T11:30:07.142586Z","submitted_at":"2026-04-19T15:20:02Z","title":"Answer Only as Precisely as Justified: Calibrated Claim-Level Specificity Control for Agentic Systems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T05:31:11.718051Z"},"links":{"cited_paper":"/paper/2602.11908","citing_paper":"/paper/2604.17487"},"observation_digest":"sha256:c187d7ae2ae639dce862885816337360ecf0970269acf8b5047dea98c8625e39","observation_id":"4b431fc0-3dcf-47d9-93e3-d84b90fc62ca","resolution":{"observed_at":"2026-06-03T02:05:13.522389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"cited_work":{"arxiv_id":"2602.11908","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.11908","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jiang, Z., Liu, A., and Durme, B","venue":null,"work_id":"c66398c1-ec88-419d-84f9-78d5fa416493","year":null},"citing_paper":{"arxiv_id":"2604.17487","last_updated":"2026-05-17T16:25:26Z","snapshot_observed_at":"2026-08-03T11:30:07.142586Z","submitted_at":"2026-04-19T15:20:02Z","title":"Answer Only as Precisely as Justified: Calibrated Claim-Level Specificity Control for Agentic Systems","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T23:56:44.979471Z"},"links":{"cited_paper":"/paper/2602.11908","citing_paper":"/paper/2604.17487"},"observation_digest":"sha256:cda1bddd4da457ca5f7e56b1bece30a297dad6559f7ac169395ff1ec8a0c5c49","observation_id":"d3826a06-f7a8-4ad7-8f30-30abd89d9f14","resolution":{"observed_at":"2026-06-03T02:05:13.522389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.11908/citation-record","integrity":"/paper/2602.11908/integrity","json":"/paper/2602.11908/citation-record.json","paper":"/paper/2602.11908"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2001.09977","last_updated":"2020-02-27T07:36:47Z","snapshot_observed_at":"2026-08-04T13:03:06.820772Z","submitted_at":"2020-01-27T18:53:15Z","title":"Towards a Human-like Open-Domain Chatbot","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.09977","snapshot_observed_at":"2026-08-03T00:03:18.159203Z","title":"So, Jamie Hall, Noah Fiedel, Romal Thoppilan, Zi Yang, Apoorv Kulshreshtha, Gaurav Nemade, Yifeng Lu, and Quoc V","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:18.159203Z"},"links":{"cited_paper":"/paper/2001.09977","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:ef9066e080d8adffc71ae877e3c361e9be493e91a218bab411eccfd0031618f0","observation_id":"1bf1bff5-6fc0-441d-8fc5-b655e24efdae","resolution":{"observed_at":"2026-08-03T00:03:18.159203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07511","last_updated":"2022-12-07T05:08:01Z","snapshot_observed_at":"2026-07-06T11:29:34.579530Z","submitted_at":"2021-07-15T17:59:50Z","title":"A Gentle Introduction to Conformal Prediction and Distribution-Free Uncertainty Quantification","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.07511","snapshot_observed_at":"2026-08-03T00:03:18.276169Z","title":"Angelopoulos and Stephen Bates","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:18.276169Z"},"links":{"cited_paper":"/paper/2107.07511","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:1b0c286e3e3023dc4530c7dcdb9e216767ce15f1109a68de7928958d1a0f7a55","observation_id":"d42595d8-6316-4003-a61f-f0e44f1310fc","resolution":{"observed_at":"2026-08-03T00:03:18.276169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:18.391062Z","title":"Introducing the claude 3 model family","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:18.391062Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:e050ea26e9056bd6a9d08b07d363f834f6164412708cf4fa5fe854014333675a","observation_id":"2be8f48b-ec61-42f6-accb-df1f2ee1da36","resolution":{"observed_at":"2026-08-03T00:03:18.391062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/bjps/iv","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:37.104158Z","title":"Semantic information.British Journal for the Philosophy of Science, 4(14):147–157, 1953","venue":null,"work_id":"1e24c6e7-4e66-469e-bd76-151e0b0988fb","year":1953},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:18.460268Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:56fb5ed298f26d5c7e89baae3c7ae67dcf254642fc8e8742fa3b19b7d66f4599","observation_id":"63fb5a86-0296-4ccd-aded-94fa500e3f10","resolution":{"observed_at":"2026-08-03T00:03:37.212558Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:18.551481Z","title":"Synthese Library","venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:18.551481Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:3cc562df32c314a0b2eaaa041bf0c27f0c1c9eb435cda587b526b0fd1270787f","observation_id":"0cfb03ed-6361-4934-8fb3-2aa4055473cc","resolution":{"observed_at":"2026-08-03T00:03:18.551481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-03T00:03:18.642129Z","title":"Deepseek-v3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:18.642129Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:3e004c5b0871ace286f86fdbd7d25d6d11a619e9cab806b3aa1636755d3df245","observation_id":"648a5623-6eca-40cc-a92f-ff7a0eecd95b","resolution":{"observed_at":"2026-08-03T00:03:18.642129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:18.731927Z","title":"On the founda- tions of noise-free selective classification.J","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:18.731927Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:1d294ac76c57a40f38af77532a5423afc1d80fdaeeae2f5c8af2a21c308ac0b0","observation_id":"fdbe0663-d3a9-4b7b-9375-4dd9c5a6fff7","resolution":{"observed_at":"2026-08-03T00:03:18.731927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:18.855499Z","title":"Lm-polygraph: Un- certainty estimation for language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:18.855499Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:4cfc5d8d57be6472280d3d6a50da2ce1e299a3947b3d42923530fa4c858cfa3a","observation_id":"9b897719-37c9-497f-8cd3-9322676b34df","resolution":{"observed_at":"2026-08-03T00:03:18.855499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:18.986476Z","title":"Fact-checking the out- put of large language models via token-level uncer- tainty quantification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:18.986476Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:e4c5235ceeebe74be76f5c8cf679d57afb675ba883f43f6d3c3a0688a26eaf7a","observation_id":"8e32955a-5b45-49a8-9c8a-e8ec615464d0","resolution":{"observed_at":"2026-08-03T00:03:18.986476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:19.138224Z","title":"Don’t hallucinate, abstain: Identifying LLM knowl- edge gaps via multi-llm collaboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:19.138224Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:b695b6cdef6b0f5f13d974be4884b23c2e8576bf78c8c176ee1060e963288e65","observation_id":"c901e001-d035-4f74-97fd-4575528a5066","resolution":{"observed_at":"2026-08-03T00:03:19.138224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:19.347950Z","title":"What can we learn from the selective prediction and uncertainty estimation performance of 523 imagenet classifiers? InICLR, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:19.347950Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:ddfda7f26cc6539538684d7f00f117c66ea5309898b0d7ff6787d0b5051d937f","observation_id":"08176e05-1956-4d95-8ac6-e7aff94de8c2","resolution":{"observed_at":"2026-08-03T00:03:19.347950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08206","last_updated":"2019-04-24T13:00:42Z","snapshot_observed_at":"2026-07-06T06:40:22.436755Z","submitted_at":"2018-05-21T17:59:59Z","title":"Bias-Reduced Uncertainty Estimation for Deep Neural Classifiers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.08206","snapshot_observed_at":"2026-08-03T00:03:19.431099Z","title":"Bias-reduced uncertainty estimation for deep neu- ral classifiers, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:19.431099Z"},"links":{"cited_paper":"/paper/1805.08206","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:905f61f6640a73f710281c628f1dabc2185a508d7fe7f9a434170ce32b1e2118","observation_id":"6507984f-46f0-4cb9-aafe-c113e62fcd7d","resolution":{"observed_at":"2026-08-03T00:03:19.431099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-03T00:03:19.585626Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodality, long context, and next generation agentic capabilities, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:19.585626Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:e9d1dd3d9a8bde37c3eb86ca5e8655fe44c53bc46a0bed7c4f5686caac3df205","observation_id":"7568562c-ffc8-489a-be3b-2de0f6cf89a2","resolution":{"observed_at":"2026-08-03T00:03:19.585626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11533","last_updated":"2025-01-06T06:39:22Z","snapshot_observed_at":"2026-08-02T07:57:38.896308Z","submitted_at":"2024-05-19T12:24:30Z","title":"Hierarchical Selective Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11533","snapshot_observed_at":"2026-08-03T00:03:19.782803Z","title":"Hierar- chical selective classification, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:19.782803Z"},"links":{"cited_paper":"/paper/2405.11533","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:99771d82985d66b64ab4970cdbbd7cb3d6df217a948c75fa636900c6748d2b0d","observation_id":"81a30f28-91e1-4efd-8a3c-1018db7a7458","resolution":{"observed_at":"2026-08-03T00:03:19.782803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05159","last_updated":"2023-05-26T08:12:06Z","snapshot_observed_at":"2026-07-06T14:03:25.739373Z","submitted_at":"2022-10-11T05:38:27Z","title":"Can Language Models Be Specific? How?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05159","snapshot_observed_at":"2026-08-03T00:03:19.935671Z","title":"Can language models be spe- cific? how?, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:19.935671Z"},"links":{"cited_paper":"/paper/2210.05159","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:c71936aea90d65b79810ce77abf0f5eca1b047ea45a3321a6471f1dca44ac743","observation_id":"af7c2ef5-176c-4ee1-80cf-57cf1e7f3097","resolution":{"observed_at":"2026-08-03T00:03:19.935671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:20.096207Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions.ACM Trans","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:20.096207Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:b7760c1f638827438ee90f87b26acb756b6aedcff46ad8ce1f1eb670578f1d1a","observation_id":"058bfcd8-b6d4-4665-a0fa-f94da2da1d9f","resolution":{"observed_at":"2026-08-03T00:03:20.096207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:20.245277Z","title":"Optimized batch prompt- ing for cost-effective llms.Proceedings of the VLDB Endowment, 18(7):2172–2184, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:20.245277Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:da12545cec6821e187d21a5740c15e2de55999b290c21765e3c374ee3a7d8ca8","observation_id":"71ebe582-46e2-4bd6-ad07-253dc46b77ba","resolution":{"observed_at":"2026-08-03T00:03:20.245277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:20.390943Z","title":"Survey of hallucination in natural language generation.ACM Comput","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:20.390943Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:364a33e70ae0bf6b92718e5de37be6ceaccbac8937fdbbcb1c09679de68cfde8","observation_id":"8ff85f9b-29cd-4203-a847-9deb057d91b1","resolution":{"observed_at":"2026-08-03T00:03:20.390943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:20.523735Z","title":"Weld, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:20.523735Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:d4dbbb4f33543160530ac4bbb4e2000d90972445bcb88951c75d04068d3c5813","observation_id":"10c3a1af-80d0-4f53-95be-8462e8004b44","resolution":{"observed_at":"2026-08-03T00:03:20.523735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-03T00:03:20.693204Z","title":"Language models (mostly) know what they know, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:20.693204Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:ba2b4f15bd99a7c7efdaa6c0edd24cfa693b1d652879ea6e978c7a857b40a2e3","observation_id":"de57daed-0a24-4122-b6d4-6eab5d97592d","resolution":{"observed_at":"2026-08-03T00:03:20.693204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:20.820609Z","title":"LLMs cannot (yet) match the specificity and simplicity of online commu- nities in long form question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:20.820609Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:545977c44901805dce4532f5b01ec9cb0c6e583d1b24e2e0714d9f19009b1785","observation_id":"963c0683-82b9-41bb-8db6-69f75a324651","resolution":{"observed_at":"2026-08-03T00:03:20.820609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04664","last_updated":"2025-09-04T21:26:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-04T21:26:31Z","title":"Why Language Models Hallucinate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04664","snapshot_observed_at":"2026-08-03T00:03:21.277478Z","title":"Vem- pala, and Edwin Zhang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:21.277478Z"},"links":{"cited_paper":"/paper/2509.04664","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:df39558d6c5b5175634e8a3198ca5453823a78cebfc9a31ed50e90c79f26475e","observation_id":"63e738c7-908a-417f-a421-d3c84f0c127f","resolution":{"observed_at":"2026-08-03T00:03:21.277478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:21.679332Z","title":"Semantic uncertainty: Linguistic invariances for uncertainty estimation in natural language gen- eration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:21.679332Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:f9a617ef6f91d6578b0ee21f3a2693510a1194a970edafdec4a0ceea3b61dade","observation_id":"0c841976-6e62-4183-8c36-3727cf32f7de","resolution":{"observed_at":"2026-08-03T00:03:21.679332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:21.911034Z","title":"Generating with confidence: Uncertainty quantifi- cation for black-box large language models.Trans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:21.911034Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:20fed54f7d755bf69a5b970d5c21a6044eedc8d8e05410329a8ec365862d09d7","observation_id":"7a8263f8-a378-45b9-bfea-591b6775a3e8","resolution":{"observed_at":"2026-08-03T00:03:21.911034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:22.031035Z","title":"Semnani, Harold Tried- man, Jialiang Xu, Isaac Dan Zhao, and Monica S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:22.031035Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:18c9ae1b6259b454cd68b73dde1307fc119919bec2ea4b1439f99128c24dd0b9","observation_id":"525a0744-2b4f-47b7-8a32-59fe72544d64","resolution":{"observed_at":"2026-08-03T00:03:22.031035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07981","last_updated":"2023-06-06T07:45:27Z","snapshot_observed_at":"2026-07-06T14:31:03.189108Z","submitted_at":"2022-12-15T17:26:05Z","title":"Revisiting the Gold Standard: Grounding Summarization Evaluation with Robust Human Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07981","snapshot_observed_at":"2026-08-03T00:03:22.328378Z","title":"Fabbri, Pengfei Liu, Yilun Zhao, Linyong Nan, Ruilin Han, Simeng Han, Shafiq Joty, Chien-Sheng Wu, Caiming Xiong, and Dragomir Radev","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:22.328378Z"},"links":{"cited_paper":"/paper/2212.07981","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:f0b2c3c0666724a6b3e5c9df2f504b7a1ce5d455b30d902523e471ec85fd731b","observation_id":"e7aabc83-b375-45d3-9a29-657f56ad7393","resolution":{"observed_at":"2026-08-03T00:03:22.328378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:21.796514Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:21.796514Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:e8a6bfcaa390376c9c1ef300d485a719d85bb399b535ca7e4a5a31e09717a3e2","observation_id":"383cf905-c7e6-4515-92b3-77810f688f36","resolution":{"observed_at":"2026-08-03T00:03:21.796514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:22.620005Z","title":"Passonneau","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:22.620005Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:2218abdc72caa722eec702a7e3571be7c10ea6b0ecae989530ae1bc130b985e6","observation_id":"f3b29ae8-3491-4756-a2b7-53b9c5577c63","resolution":{"observed_at":"2026-08-03T00:03:22.620005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:22.911980Z","title":"gpt-oss-120b & gpt-oss-20b model card,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:22.911980Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:83b93cc6ca627ce12649ddd59699410329dba401883adfd353f1264d5c2000e1","observation_id":"cc693f82-2110-42ae-a8da-6e08d7982855","resolution":{"observed_at":"2026-08-03T00:03:22.911980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:22.182787Z","title":"findings-emnlp.938","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:22.182787Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:daec06d9454a8d61d0900fcfe2e0088356665d327114695f65037309ff361ec8","observation_id":"a0c1ac87-5f48-4af8-ae09-c00a38668115","resolution":{"observed_at":"2026-08-03T00:03:22.182787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T00:03:23.294886Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:23.294886Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:137cbfe23d56fa09ffc803f2b0fd37637b453e935fdb24f74096047fbbf0dfec","observation_id":"aae9824f-30ac-4f53-a5b2-264da2453a68","resolution":{"observed_at":"2026-08-03T00:03:23.294886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:22.474547Z","title":"Factscore: Fine-grained atomic evaluation of fac- tual precision in long form text generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:22.474547Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:509ebfbe6a6974c6a35361b97439bb5e36eb277b7686c941ead11d1f47a21307","observation_id":"dfd82b15-2ca8-41b1-b765-f5b78443a991","resolution":{"observed_at":"2026-08-03T00:03:22.474547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:23.553211Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:23.553211Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:fdd01e18b94da80602ec1fbb0832787f143ac6b96cc3c939d34973525dea50b1","observation_id":"bc696b07-ad95-4b12-81b3-c596166fe372","resolution":{"observed_at":"2026-08-03T00:03:23.553211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"cmp-lg/9511007","last_updated":"1995-11-29T19:32:04Z","snapshot_observed_at":"2026-07-07T01:33:45.075000Z","submitted_at":"1995-11-29T19:32:04Z","title":"Using Information Content to Evaluate Semantic Similarity in a Taxonomy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"cmp-lg/9511007","snapshot_observed_at":"2026-08-03T00:03:23.665589Z","title":"Using information content to eval- uate semantic similarity in a taxonomy.CoRR, abs/cmp-lg/9511007, 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:23.665589Z"},"links":{"cited_paper":"/paper/cmp-lg/9511007","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:fb0eec44779b83fced6a955a506ee214b5d3a72c7ad903e2c2e875fd23de2ce3","observation_id":"76dc8ab5-a7a2-4677-95d1-f8a7c5686630","resolution":{"observed_at":"2026-08-03T00:03:23.665589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:23.802656Z","title":"Crowdsourcing lightweight pyramids for manual summary evalua- tion","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:23.802656Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:2745717d082825f0779b1898d2159483271a4d9d17101876e3aa319952a5ed18","observation_id":"cc2de745-974b-4910-ac54-55fd8bd9fbde","resolution":{"observed_at":"2026-08-03T00:03:23.802656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08085","last_updated":"2025-05-22T06:20:51Z","snapshot_observed_at":"2026-08-04T16:06:19.556081Z","submitted_at":"2024-10-10T16:29:21Z","title":"Can Knowledge Graphs Make Large Language Models More Trustworthy? An Empirical Study Over Open-ended Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08085","snapshot_observed_at":"2026-08-03T00:03:23.943252Z","title":"Can knowledge graphs make large language models more trustworthy? an empirical study over open- ended question answering, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:23.943252Z"},"links":{"cited_paper":"/paper/2410.08085","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:a29f516ecb3eb801cef3ba4ea3763026491f02b35f807155a731996641db8b0e","observation_id":"30a88078-6e8e-4172-bdf6-b5a0051cf52a","resolution":{"observed_at":"2026-08-03T00:03:23.943252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:23.181804Z","title":"Fact-checking complex claims with program-guided reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:23.181804Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:679ec0b281cf2f4a724675341d475416bc5783d58bebe074b6a597d71497a6bd","observation_id":"f4c432c6-d43b-4782-817d-a94df6867edd","resolution":{"observed_at":"2026-08-03T00:03:23.181804Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-03T00:03:24.194076Z","title":"Lamda: Lan- guage models for dialog applications, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:24.194076Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:d7f8e00e5081ff9f5ba242f8606fe9c19839b3302364759f9b499e2c2608488e","observation_id":"a4bb4807-356a-48ae-ac20-5ca3309e174e","resolution":{"observed_at":"2026-08-03T00:03:24.194076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03987","last_updated":"2023-08-12T14:57:37Z","snapshot_observed_at":"2026-08-04T09:02:49.602701Z","submitted_at":"2023-07-08T14:25:57Z","title":"A Stitch in Time Saves Nine: Detecting and Mitigating Hallucinations of LLMs by Validating Low-Confidence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03987","snapshot_observed_at":"2026-08-03T00:03:24.512527Z","title":"A stitch in time saves nine: Detecting and mitigating hallucina- tions of llms by validating low-confidence gener- ation.CoRR, abs/2307.03987, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:24.512527Z"},"links":{"cited_paper":"/paper/2307.03987","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:83e4fa15dc8e6781bbbb0000b93c7cce2d6cf4681082e0affc1999f192907a48","observation_id":"0c56ae05-286a-476f-a8e9-d9f8cde308a5","resolution":{"observed_at":"2026-08-03T00:03:24.512527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:24.632412Z","title":"Benchmarking uncertainty quantification methods 11 for large language models with lm-polygraph.Trans","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:24.632412Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:2464260dfcd64f1317845711dc414de58deed35b68d57f014133bec54207e1d4","observation_id":"844412e3-cb99-43ab-bd4d-689e986fcb6a","resolution":{"observed_at":"2026-08-03T00:03:24.632412Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14427","last_updated":"2025-04-18T09:21:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T10:25:13Z","title":"Token-Level Density-Based Uncertainty Quantification Methods for Eliciting Truthfulness of Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.14427","doi":"10.48550/arxiv.2502.14427","metadata_source":"pith","pith_arxiv_id":"2502.14427","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Token-Level Density-Based Uncertainty Quantification Methods for Eliciting Truthfulness of Large Language Models","venue":"cs.CL","work_id":"a97a1c6f-58c4-4866-8aa7-94bb002765da","year":2025},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:24.728318Z"},"links":{"cited_paper":"/paper/2502.14427","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:38c98d7e03e24b617f2e5c8e7305968f0363429b3a1b62f086a0558506d967c7","observation_id":"dceb6651-06fb-4c06-84d8-20f2d4629987","resolution":{"observed_at":"2026-08-03T00:03:36.793586Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1209.2673","last_updated":"2012-09-24T18:28:44Z","snapshot_observed_at":"2026-08-08T02:36:46.408134Z","submitted_at":"2012-09-12T17:39:37Z","title":"Conditional validity of inductive conformal predictors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1209.2673","snapshot_observed_at":"2026-08-03T00:03:24.871070Z","title":"Conditional validity of inductive conformal predictors.CoRR, abs/1209.2673, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:24.871070Z"},"links":{"cited_paper":"/paper/1209.2673","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:6aea6524a7db3e14411d59357bc6c1ab2a6e7e7d16b86de4d776e7029b5b3226","observation_id":"73d555d5-83ce-4477-bbeb-e5850f33e588","resolution":{"observed_at":"2026-08-03T00:03:24.871070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-03T00:03:24.063266Z","title":"The llama 3 herd of models.CoRR, abs/2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:24.063266Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:faca04c1bb931d94f2cdce2fc55e765e8e925f14eabdc7189bd921e7b51d7de1","observation_id":"0172bb90-0bdb-440c-9cf0-72d816bb6c8d","resolution":{"observed_at":"2026-08-03T00:03:24.063266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:25.181608Z","title":"Wikidata: a free collaborative knowledgebase.Commun","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:25.181608Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:4dc0ec4033f868531e848b749015d856d8b0fa66834ee49ae0cbf20484258b4b","observation_id":"976b333c-5e08-4ef4-a864-e03f6d0d9211","resolution":{"observed_at":"2026-08-03T00:03:25.181608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01313","last_updated":"2024-01-08T16:19:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T17:56:30Z","title":"A Comprehensive Survey of Hallucination Mitigation Techniques in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01313","snapshot_observed_at":"2026-08-03T00:03:24.365784Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:24.365784Z"},"links":{"cited_paper":"/paper/2401.01313","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:9dc028d607d2678fef68f74260ad12775b6fddbdd163b3a3e30d72129da00802","observation_id":"e0ddef58-6d14-4d98-aaf5-1ecc70757836","resolution":{"observed_at":"2026-08-03T00:03:24.365784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:25.457827Z","title":"Wong, Emine Yilmaz, Shuming Shi, and Zhaopeng Tu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:25.457827Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:8fa1ba235d5e27dafa08e795c50ce4f63cd68b66fad321c8f06162cc42287ba7","observation_id":"fd551a3b-de19-4f68-84fa-5ab8168b07ef","resolution":{"observed_at":"2026-08-03T00:03:25.457827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04695","last_updated":"2024-08-01T06:23:58Z","snapshot_observed_at":"2026-08-05T02:51:58.483947Z","submitted_at":"2024-01-09T17:44:36Z","title":"Narrowing the Knowledge Evaluation Gap: Open-Domain Question Answering with Multi-Granularity Answers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04695","snapshot_observed_at":"2026-08-03T00:03:25.580309Z","title":"Nar- rowing the knowledge evaluation gap: Open- domain question answering with multi-granularity answers, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:25.580309Z"},"links":{"cited_paper":"/paper/2401.04695","citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:9ea2bc0c6fc71a7378109b15934a0ea10a398c762427fc7501b7e71dc88b6211","observation_id":"49cdaf19-d6bb-4791-a661-4b6a92fb683b","resolution":{"observed_at":"2026-08-03T00:03:25.580309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:25.725434Z","title":"LUQ: long-text uncertainty quan- tification for llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:25.725434Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:ed5528eb1840c41da418e1af2d94e5ab99d814a7810cee535f90d73ced1211ba","observation_id":"07165edd-cb18-47d5-a678-f6453b0d343f","resolution":{"observed_at":"2026-08-03T00:03:25.725434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:26.102745Z","title":"Finding a bal- anced degree of automation for summary evaluation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:26.102745Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:ee43454f752c4277ba799eec3e2d00f075f9c32d959e6d56e19af9556c793677","observation_id":"b10b1654-e102-4ea5-ac6c-7e7e756138bd","resolution":{"observed_at":"2026-08-03T00:03:26.102745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:25.045885Z","title":"Machine-learning applications of algo- rithmic randomness","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:25.045885Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:80f68b419a9ac55e032f830a7b9d02d4c9c68db260e53c8181776aa3baef8cf1","observation_id":"10e7bc47-e3c6-4f0d-a163-d56442932173","resolution":{"observed_at":"2026-08-03T00:03:25.045885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:25.298087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:25.298087Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:7c0727d5c2ecde42e765b52156f30820748585e50fcbd5a209ab9b969a413340","observation_id":"d250bc6d-9511-468c-abb8-1702ce2d2c91","resolution":{"observed_at":"2026-08-03T00:03:25.298087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:25.987020Z","title":"emnlp-main.299","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:25.987020Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:0b666ab7e043d97b29077b66717b9962481ce88eff4e9bfce9226459d84b4693","observation_id":"352d25cc-3164-4b03-9ea4-98cdaa44d424","resolution":{"observed_at":"2026-08-03T00:03:25.987020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:26.369273Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:26.369273Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:1385d901725a1bff98bcdb62be87f259e6699f6674113a166c2db5b0194cdc8d","observation_id":"1e52a40d-2c82-484b-bc08-fd103fcdf216","resolution":{"observed_at":"2026-08-03T00:03:26.369273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:26.541433Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:26.541433Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:1cc55533d64ed45c5b919c5472f7bf3db33f1868f77a8369b3cfc020d4e3ec5d","observation_id":"88442010-719a-47bb-9fd5-6440ce539bc7","resolution":{"observed_at":"2026-08-03T00:03:26.541433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:26.701898Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:26.701898Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:67ef42770d54508e2d2085036261ed26c8d6432e42f638767dd65efef9d6efaa","observation_id":"95a010c4-bfdd-455f-b444-36ce1c72e859","resolution":{"observed_at":"2026-08-03T00:03:26.701898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:26.842236Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:26.842236Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:abc11d3db4abee9429841e0c7bba0fc11511ad27f015c97b6cfa93938eae5b9f","observation_id":"fac7c6f2-1514-4e89-af4b-5089e12ada6a","resolution":{"observed_at":"2026-08-03T00:03:26.842236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:26.977413Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:26.977413Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:53c255650d6c0a1eac946d9dc074e761c16164fa3caec070f6f785b54ac242b4","observation_id":"4e6c2cfc-3487-4ef8-b1dc-57b36945df70","resolution":{"observed_at":"2026-08-03T00:03:26.977413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:27.132929Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:27.132929Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:a929bea9e1ce8ff8c29044dd50da892555c7dc6ebf29d493211f234b9e07bd20","observation_id":"453e2e5e-758e-46b8-aa40-1996bbc739e9","resolution":{"observed_at":"2026-08-03T00:03:27.132929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:27.228727Z","title":"## Example 2 Input Text:Albert Einstein was a German-born theoretical physicist who is best known for developing the theory of relativity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:27.228727Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:8b53bb366f525dd7546e61b7b45a2a2eaf44af72c0495ee220c2644d777f5883","observation_id":"f70d3435-8b13-47fb-8dac-b1dba3fc8b6e","resolution":{"observed_at":"2026-08-03T00:03:27.228727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:27.407060Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:27.407060Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:618803d40467e2a961a02741e2d0e87ea1af87900fd60517a28ec3c92daaf02d","observation_id":"c01e1cc7-a6f3-4fda-8c07-22cf824df1cc","resolution":{"observed_at":"2026-08-03T00:03:27.407060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:27.573954Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:27.573954Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:aeefbffcb59f691df625590851e3a5de5ce1689d674f13912333b06936d83833","observation_id":"1c88dcfd-6ee8-4a9f-8b79-efe12785cbc1","resolution":{"observed_at":"2026-08-03T00:03:27.573954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:27.672298Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:27.672298Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:9d943c56e4597bfebe5d02e5fd3fd49b8e84baa59b65a283df24d231ab2cd0f0","observation_id":"eaf7b5bd-82fb-461b-b9cc-861a1f4d1249","resolution":{"observed_at":"2026-08-03T00:03:27.672298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:27.772231Z","title":"## Example 3","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:27.772231Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:bae1d0af86a197292397c10529e17d13ad897e1fbc9800fa55ec16357ce3b4e2","observation_id":"32fdbda2-04f6-4e0b-abc9-b0a0bf5a81ec","resolution":{"observed_at":"2026-08-03T00:03:27.772231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:27.935678Z","title":"- The confidence score must be a number between 0 and 100","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:27.935678Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:de77132d2810c168d7ea72420ae92969423c8140ac92a7cced286411bb0ea2e3","observation_id":"dfa1fe89-9cd7-4c86-875d-384fdea5db8c","resolution":{"observed_at":"2026-08-03T00:03:27.935678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:28.567602Z","title":"# Review and Guidance Think step by step","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:28.567602Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:1a49aa2d04589d4483bb353e41b4976ec7335d44d6eb90ce68f97cee4277a5d3","observation_id":"4825bd59-8234-4153-bb61-dbc477cfb919","resolution":{"observed_at":"2026-08-03T00:03:28.567602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:28.640760Z","title":"Reasoning: (your reasoning here)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:28.640760Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:1e8a142d33ba1dd0c86ed0f1d45fcae514abc59119b646374f1e5d4d59512418","observation_id":"b9698749-f8ac-4f36-84d7-72091ccac249","resolution":{"observed_at":"2026-08-03T00:03:28.640760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:28.722005Z","title":"Reasoning: (your reasoning here)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:28.722005Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:3149c1f2ae5e90e0578c5749209d767621d124059c17ada52b955bfb691837b6","observation_id":"83275b95-6afa-4c30-99ed-3d61aa3d366e","resolution":{"observed_at":"2026-08-03T00:03:28.722005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:28.801719Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:28.801719Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:c44fd7b242b8237f855bae1834afa15cc396074656caa6369c4f773398182fa8","observation_id":"63367b78-08b3-4e9a-9e1d-04a858bda220","resolution":{"observed_at":"2026-08-03T00:03:28.801719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:28.853542Z","title":"Do not change the ENTITY","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:28.853542Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:0867b3a64258f40667e330232d3d1187d7ad608ff91afe4ac71148dd436840d7","observation_id":"912f5daa-6c6f-4117-a3fb-c170ce1c97b7","resolution":{"observed_at":"2026-08-03T00:03:28.853542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:28.967140Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:28.967140Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:392e5a3a750991387cb7b7e5c2c65c529a26456066104f5c747ab4d05f47f9f7","observation_id":"78ce6ac8-cf0a-4402-90f8-66a2b91278d5","resolution":{"observed_at":"2026-08-03T00:03:28.967140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.106743Z","title":"Make the smallest logical generalization at each step","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.106743Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:a12c7a38528f770ee5228782cb51bf20a0081fb50012feb5be84050cb0f49368","observation_id":"8afe0436-0af3-46a2-844c-6aa991178476","resolution":{"observed_at":"2026-08-03T00:03:29.106743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.222100Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.222100Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:d118eed77eb716119e0b391275b5e911519fa03dc15bf9801d44a76aa6e46272","observation_id":"2d2fb7f8-9385-429b-88ef-33cad12ec796","resolution":{"observed_at":"2026-08-03T00:03:29.222100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.336506Z","title":"The rest of the sentence must remain unchanged","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.336506Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:33924b8c911dd8d97e60fdaf4e13103cbce2b06048a43a35375c391ec52c28de","observation_id":"80231d5c-c67c-487a-ba32-7e669ca74ea6","resolution":{"observed_at":"2026-08-03T00:03:29.336506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.394540Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.394540Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:9b86638f066012be60abfa4fe0d3633710d3ba4d7395f3c5fcfacd1788f2f452","observation_id":"50092f4a-8f7e-4095-be27-dc6b73957c9e","resolution":{"observed_at":"2026-08-03T00:03:29.394540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.472539Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.472539Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:183269f25a613986aec32980337dc7328c7297579d14af44517830f8f2c66e47","observation_id":"987b8928-c385-457c-8514-b234aa8c98da","resolution":{"observed_at":"2026-08-03T00:03:29.472539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.553628Z","title":"In that case, output ‘STOP‘ and explain why","venue":null,"work_id":null,"year":1920},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.553628Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:98cada9c5254ef4c8cbeaac84349fc79fbb34d680b3daaa32e3dd8f0052cfe4c","observation_id":"0de129a9-9132-4615-b681-57c1a218160f","resolution":{"observed_at":"2026-08-03T00:03:29.553628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.638115Z","title":"Reasoning: I’m less confident about the exact city than the country","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.638115Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:8e366ce4a6b2bdc9250f20d063473c05ec69e0a101ae546f6ae938e55c4021ab","observation_id":"fab03f10-d41f-4c6e-903b-1e3625ae4947","resolution":{"observed_at":"2026-08-03T00:03:29.638115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.721562Z","title":"Reasoning: Warsaw is a city in Poland, so this is a valid generalization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.721562Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:e7395716130adf58f0d1159580c4bfb9d023b3dfb13b36dc43d80ead997a4f29","observation_id":"8180c1e4-acad-478c-b257-cdc8caa39f5c","resolution":{"observed_at":"2026-08-03T00:03:29.721562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.801905Z","title":"Reasoning: Poland is a European country","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.801905Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:e91c18db916846a89d2e8c83c9a1faef8b86e72b46cad2a3d6cf9c583bb2a1e4","observation_id":"8e43fc28-cc15-4512-9861-a055f128a87e","resolution":{"observed_at":"2026-08-03T00:03:29.801905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.879826Z","title":"Reasoning: Further generalization would be too vague to retain meaning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.879826Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:f703400539ade8b2663d1c939c8c1e48534a77f193288f708d012844b19f1fb2","observation_id":"810e7641-ef37-4d3c-846e-0fd906818f0c","resolution":{"observed_at":"2026-08-03T00:03:29.879826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.979747Z","title":"- The confidence score must be a number between 0 and 100","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.979747Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:9d1551a51b064f243ece3eac89821c55109457ae7d582786a510170072a6c318","observation_id":"e9142c29-37fb-4aa8-a4de-426a84f6fb9c","resolution":{"observed_at":"2026-08-03T00:03:29.979747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:29.982761Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:29.982761Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:c8087862294ace6f124b54570690588a891a1aa36df353a80b04fc3c3911f9bd","observation_id":"ee3bfab6-b3cd-4760-8535-869fbfbfbec7","resolution":{"observed_at":"2026-08-03T00:03:29.982761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:30.152180Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:30.152180Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:40974b1d097267df6aef8824aa95c3f7514dae9c8f8a4902a2f19e6df52c07d6","observation_id":"0dff476b-8cb3-425d-98cc-38f2377e7b7b","resolution":{"observed_at":"2026-08-03T00:03:30.152180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:30.257769Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:30.257769Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:03afb3b6160efcad980cfee079ccc04c8ee9e5ba4214902ce4a91e228e7b5f44","observation_id":"bf198785-bb7f-464a-8062-04318a961651","resolution":{"observed_at":"2026-08-03T00:03:30.257769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:30.366062Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:30.366062Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:5d0ec84bce5955b8216a66ecf6d24d9254e6291f0368867f9c119f531720cc90","observation_id":"6f2cf9d0-3f8a-494d-ad3c-48b93479b4a6","resolution":{"observed_at":"2026-08-03T00:03:30.366062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:30.516460Z","title":"# Review and Guidance Think step by step","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:30.516460Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:4e3ec363afeff04653b9c1cd04ee1fa66878924c67d5e9fc2f1865b7c0f2d26f","observation_id":"d19498ac-988b-43eb-be48-0ad17b4a6b3c","resolution":{"observed_at":"2026-08-03T00:03:30.516460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:30.676983Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:30.676983Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:a3bbd3e5f30197c0ab9e7e36394dd62de3058d010dc26baaea46f778d2c21958","observation_id":"ca3cf3f9-d889-4b35-97d2-35892a0b41b0","resolution":{"observed_at":"2026-08-03T00:03:30.676983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:30.792610Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:30.792610Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:5ed38e29b828690076a94954f1a67bff818eddf9392672703d1ccfe1ee53856a","observation_id":"0df5b095-4413-4b42-9a61-32646701f89b","resolution":{"observed_at":"2026-08-03T00:03:30.792610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:30.889393Z","title":"SUPPORTED","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:30.889393Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:6fe68170334f3bbb6b1a57b285a48f11f2185ad6d201b267237a9e8e1559202f","observation_id":"5c966921-fe4a-485b-9146-774c2024c823","resolution":{"observed_at":"2026-08-03T00:03:30.889393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:31.009654Z","title":"• This is always the subject of the sentence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:31.009654Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:e40dff5f047ce97053bee82bce9a60fc2b7992ab51abbdced9be2c8bf47ce837","observation_id":"56b7d67e-7548-45b1-a4cd-1dd4ead418d0","resolution":{"observed_at":"2026-08-03T00:03:31.009654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:31.141006Z","title":"people” • For places, use terms like “cities","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:31.141006Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:caa993cb333bda17dfaf88b40905823e717b38ed5cc4e8db205b78fcf53b0ed6","observation_id":"82ed6573-2390-477c-92c0-2a2754b3d505","resolution":{"observed_at":"2026-08-03T00:03:31.141006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:31.233529Z","title":"• Use the format: How many [pluralized broad category] are there?","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:31.233529Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:bfc8f610ecda4e81dbdb5a87519e5d432254c09a053c42bfda3c892919fe82bc","observation_id":"10e72bea-d794-48b3-9597-0247f2833d82","resolution":{"observed_at":"2026-08-03T00:03:31.233529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:31.369420Z","title":"• Keep the rest of the sentence as intact as possible","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:31.369420Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:780a3db2111d4227c6126f904bec435c41916dfb0a5b1193fe8df0ea5ce89f11","observation_id":"4f682ba9-e3d5-4603-9a50-b782f5419e1d","resolution":{"observed_at":"2026-08-03T00:03:31.369420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:31.485772Z","title":"French artists","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:31.485772Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:938179ae9381d2be077ad8dad62c38cd003cb8665e2eb6b7d4f5975071e1d874","observation_id":"ee659bea-5a9c-4501-a56c-6d24c9cac79a","resolution":{"observed_at":"2026-08-03T00:03:31.485772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:31.595536Z","title":"These include sequence-level aggregates such as log-likelihood and (inverse) perplexity, as well as more local measures such as the minimum token log-probability","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:31.595536Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:0097bfd9684b18fab7ec02cf1333c3f813505fae19b610b79ef7b86eb10d419e","observation_id":"0165a781-cc4d-4732-89f5-9914deab2af1","resolution":{"observed_at":"2026-08-03T00:03:31.595536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:31.683006Z","title":"atoms” evaluates ranking over the original atom set, whereas “all","venue":null,"work_id":null,"year":2035},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:31.683006Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:203f6a75df91b33f61561991034e336e7eb94eeb94281f61aa395c61200201ff","observation_id":"2a5dfc84-a44e-416b-8e47-0ffffcd4be52","resolution":{"observed_at":"2026-08-03T00:03:31.683006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:21.119154Z","title":"findings-emnlp.111/","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":111,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:21.119154Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:b0b1cfee11b5aac95cba9b32ffe2864ea4ed32b53b08e8729d19ac48ca348936","observation_id":"0f4a6fee-6b97-4666-bfbd-32d34f359cb8","resolution":{"observed_at":"2026-08-03T00:03:21.119154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:22.774498Z","title":"URL https://aclanthology.org/ N04-1019/","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":152,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:22.774498Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:260be0bcf496fa05f5c81792c4ec57b4efd99d03c363de414ce6bef4aca310f1","observation_id":"89f11618-63f6-4afb-82ba-cd14311009be","resolution":{"observed_at":"2026-08-03T00:03:22.774498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:26.231798Z","title":"Ice Bucket Challenge","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":531,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:26.231798Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:ffd460ea00f018a3a565912a7052b6652ad1f6b9537105db8466ed83a54229a1","observation_id":"ba56e52f-5f0e-47e8-824c-41ae244c2063","resolution":{"observed_at":"2026-08-03T00:03:26.231798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:03:20.942117Z","title":"doi: 10.18653/v1/2024.findings-emnlp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T00:03:20.942117Z"},"links":{"citing_paper":"/paper/2602.11908"},"observation_digest":"sha256:e65493921cf6ca2b6438c2a32bdfb8746877b04fe94590b2dc738d7ed35e78c1","observation_id":"4f4e32de-3428-4912-bf75-d692f744d3d8","resolution":{"observed_at":"2026-08-03T00:03:20.942117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.11908","last_updated":"2026-06-01T21:45:36Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T11:27:50.523501Z","submitted_at":"2026-02-12T13:06:14Z","title":"When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":96,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":102},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 102 outbound references and 2 inbound Pith citation observations for arXiv:2602.11908."}