{"as_of":"2026-08-08T04:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:184e6d90261ce79f7c1cabd25fd865c7559bebfb6fba706e89d8cb2ffc9ade22","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:48:18.762671Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T17:49:01.198956Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T17:52:43.078608Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.11110","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11110","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.11110 , year=","venue":null,"work_id":"ec5a8941-6b9f-45ec-b69a-8856aeeaeab1","year":null},"citing_paper":{"arxiv_id":"2605.15226","last_updated":"2026-05-13T14:14:54Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-13T14:14:54Z","title":"Is Agentic AI Ready for Real-World Hardware Engineering? A Deep Dive with Phoenix-bench","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-19T17:49:01.198956Z"},"links":{"cited_paper":"/paper/2506.11110","citing_paper":"/paper/2605.15226"},"observation_digest":"sha256:e183958d95855561c839e4c171777e97d1dd707f7e584d42101dd79d15077a1f","observation_id":"c96603d8-3ba7-4d44-86c3-920d4ea43f0a","resolution":{"observed_at":"2026-05-19T17:52:43.083675Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11110/citation-record","integrity":"/paper/2506.11110/integrity","json":"/paper/2506.11110/citation-record.json","paper":"/paper/2506.11110"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.142633Z","title":null,"venue":null,"work_id":"368fc1a2-ed8c-44e7-a750-2148e4d75ce8","year":2021},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.674740Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:cf13fd20811b5294452ef07d0ef7d0a42a49a14504a3e58bc53efc6d912a89cf","observation_id":"ca8b12ba-acf4-4680-97e9-4b44f66a4dde","resolution":{"observed_at":"2026-08-07T05:48:19.145616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T05:48:18.679496Z","title":"A., Adeli, E., Altman, R., Arora, S., von Arx, S.,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.679496Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:c3461ad71c6c31d99923f6be993e5478c8a0227c3beb94ab29d6333d320b8a1a","observation_id":"a8801b79-71de-4efb-8102-d2978f32e8e6","resolution":{"observed_at":"2026-08-07T05:48:18.679496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.133761Z","title":null,"venue":null,"work_id":"1732f007-016b-4dd7-98bc-103237fbd4dd","year":2014},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.683603Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:ee69174e8be1890dc7c72916cb4fde2580d9374d448c70ed455d0271787ba1f1","observation_id":"ecb9b38d-20a2-44e3-bcb3-9c35e283c271","resolution":{"observed_at":"2026-08-07T05:48:19.136887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15217","last_updated":"2023-09-11T17:25:24Z","snapshot_observed_at":"2026-08-03T19:11:09.671782Z","submitted_at":"2023-07-27T22:29:25Z","title":"Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15217","snapshot_observed_at":"2026-08-07T05:48:18.687477Z","title":"K., Scheurer, J., Rando, J.,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.687477Z"},"links":{"cited_paper":"/paper/2307.15217","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:ca870695d0e8602a1134a175b74d61c6611d5fe84d7a572024a1c5939b793691","observation_id":"22e083f8-5051-4f3b-aa9e-db05d3809bee","resolution":{"observed_at":"2026-08-07T05:48:18.687477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:18.691190Z","title":"N., Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.691190Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:ab79cc8b3715d108b623f8875241d6d38459fa6df94ffa69bb38e3d98a5923d1","observation_id":"6b2f8c53-b099-458e-a10e-bf6182cea7cb","resolution":{"observed_at":"2026-08-07T05:48:18.691190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.124997Z","title":"M., & Daw, N","venue":null,"work_id":"8e99565f-74a5-4edf-9c84-fb217e53e611","year":2017},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.694315Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:079ac1c9ef385bacc6112190f03683437e2cc4ec636b0bfae5c450b5549783bf","observation_id":"db6f8624-e4bd-4c88-9df9-582ee930b5ed","resolution":{"observed_at":"2026-08-07T05:48:19.127987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.116396Z","title":"(2025, April 30)","venue":null,"work_id":"7dad30f7-bb29-417b-83ba-630b28ac3945","year":2025},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.697755Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:59fc560af4832cccd99f200375dc1e7d85b8362ac502d08e524dc6d42f34c948","observation_id":"9ddfbf91-19f2-4714-bbdc-235b33366262","resolution":{"observed_at":"2026-08-07T05:48:19.119230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.107336Z","title":null,"venue":null,"work_id":"9a972f3b-911a-4105-befa-4a91a8be6200","year":2017},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.700779Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:cb309a1b87f977017e478b5f74d455036b0809d802103c8b8c54b0093f2d8037","observation_id":"b39862d8-ce43-47f7-844f-957846d06e8f","resolution":{"observed_at":"2026-08-07T05:48:19.110513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01820","last_updated":"2021-12-01T11:22:52Z","snapshot_observed_at":"2026-08-01T23:32:03.638122Z","submitted_at":"2019-06-05T04:43:25Z","title":"Risks from Learned Optimization in Advanced Machine Learning Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01820","snapshot_observed_at":"2026-08-07T05:48:18.703719Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.703719Z"},"links":{"cited_paper":"/paper/1906.01820","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:11e37c74b476990a28dd9f96a404774660caf7e008dc1ce6d580a9fdf724ffad","observation_id":"e730bfc6-e3a6-4a94-ab32-a95e4216e086","resolution":{"observed_at":"2026-08-07T05:48:18.703719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:18.707257Z","title":"J., Madotto, A., & Fung, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.707257Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:f3d1b15475001ef3491143e8d1bf767db01851b9672ffeafb7c1a2a9784f5b56","observation_id":"4a69ce99-64f9-4aea-8806-6bc031bb9582","resolution":{"observed_at":"2026-08-07T05:48:18.707257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-07T05:48:18.710373Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.710373Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:87d41c3eabded23ab2aa013b249972d702b4ab4601fe3a521d8e103e4d998aed","observation_id":"8f402b56-e2e0-4ef0-bfd4-d525c25fa11a","resolution":{"observed_at":"2026-08-07T05:48:18.710373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.097051Z","title":null,"venue":null,"work_id":"f0f68b7e-cdff-4f34-a799-b9a2a2040493","year":1999},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.713713Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:165594ea8cb5b322f67c67937490f42bc04ac8d64a04804519f677b8828d2ecb","observation_id":"b81764dd-ef14-4a02-be18-39d51fb5d48b","resolution":{"observed_at":"2026-08-07T05:48:19.100206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19203","last_updated":"2024-11-28T15:23:12Z","snapshot_observed_at":"2026-07-06T19:58:35.498502Z","submitted_at":"2024-11-28T15:23:12Z","title":"An Extensive Evaluation of Factual Consistency in Large Language Models for Data-to-Text Generation","version":1},"cited_work":{"arxiv_id":"2411.19203","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19203","snapshot_observed_at":"2026-08-07T05:48:18.949273Z","title":"An Extensive Evaluation of Factual Consistency in Large Language Models for Data-to-Text Generation","venue":"cs.CL","work_id":"cb8f387b-3084-4317-b39e-9888d6f657e8","year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.717088Z"},"links":{"cited_paper":"/paper/2411.19203","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:183154fe6874a6fbe248ed19e866f3607916e448076625af52cb940f3f913321","observation_id":"2e5dd03d-1075-4823-9f36-5942d21527f2","resolution":{"observed_at":"2026-08-07T05:48:18.954423Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-08-07T05:48:18.720267Z","title":"& Clark, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.720267Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:8004bd9ce63a24af55dfc1916450e1b062cc9fcef1ef9bb34e77dd628462be82","observation_id":"3c3a3762-9a4b-42d2-b847-2a4f0e3c7fa0","resolution":{"observed_at":"2026-08-07T05:48:18.720267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.088000Z","title":"(2025, January 28)","venue":null,"work_id":"2e71ab2e-eb10-4673-9a45-2fe9f011db9a","year":2025},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.723677Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:231789d364b9f2f4dc76a78fbc1befd8a88e4ddfa78010f29905b63b85141ac0","observation_id":"3f14e3bd-1841-425e-87f1-78a2aecff5c8","resolution":{"observed_at":"2026-08-07T05:48:19.091152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.078975Z","title":null,"venue":null,"work_id":"368345fa-8c46-4960-b634-e31c9c3cf915","year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.726713Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:6bce59598b10ebf6e54ea70438e9df4cfd11b8ef9e01d49cf5172d60b3ffc5c8","observation_id":"0f12f923-b83b-4644-85fa-769ee9358583","resolution":{"observed_at":"2026-08-07T05:48:19.082051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T05:48:18.729834Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.729834Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:5f748475dbf2c9d6551ee89cf5530a61e679a124eb1d70b4e9b785c74a0cada1","observation_id":"909b254f-98bd-4f5a-aee7-6d0d9ecd945d","resolution":{"observed_at":"2026-08-07T05:48:18.729834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.069623Z","title":"& Lowe, R","venue":null,"work_id":"67292a0a-344c-47a3-8d0e-80286fdd13fc","year":2022},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.733751Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:202f077c058fcdbc66016b218a315607bf1abbacfe8c6fb0117b83bfd464c642","observation_id":"993b0081-e2ce-4874-8b9c-27e3287e84e8","resolution":{"observed_at":"2026-08-07T05:48:19.072558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17753","last_updated":"2025-02-20T19:54:03Z","snapshot_observed_at":"2026-07-06T18:36:51.761148Z","submitted_at":"2024-06-25T17:40:47Z","title":"Measuring and Benchmarking Large Language Models' Capabilities to Generate Persuasive Language","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17753","snapshot_observed_at":"2026-08-07T05:48:18.736717Z","title":"B., Augenstein, I., & Assent, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.736717Z"},"links":{"cited_paper":"/paper/2406.17753","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:1a286e97a656ac1fe7e72c098e2bfaedff769e7bb57a45a6a35cc29c7c9b01f2","observation_id":"319f121d-f7be-4b3d-bb7c-32c8f7e5aaca","resolution":{"observed_at":"2026-08-07T05:48:18.736717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09251","last_updated":"2022-12-19T05:13:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-19T05:13:52Z","title":"Discovering Language Model Behaviors with Model-Written Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09251","snapshot_observed_at":"2026-08-07T05:48:18.740179Z","title":"(2022).Discovering Language Model Behaviors with Model-Written Evaluations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.740179Z"},"links":{"cited_paper":"/paper/2212.09251","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:2017b04ea4e92ab063d7dab569c03cb7a8aedfa6c5dabac3b027607a95dffc18","observation_id":"2cdaf0f9-fac2-48fa-a533-58f61e1a17aa","resolution":{"observed_at":"2026-08-07T05:48:18.740179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13548","last_updated":"2025-05-10T07:10:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-20T14:46:48Z","title":"Towards Understanding Sycophancy in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13548","snapshot_observed_at":"2026-08-07T05:48:18.743441Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.743441Z"},"links":{"cited_paper":"/paper/2310.13548","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:53cd52d12e2f128b13433ff2296eecc4475cdbc11cf6f58865469b04c4c4142a","observation_id":"f80abd4b-c4ec-4e6a-a5db-cc57c0a0b564","resolution":{"observed_at":"2026-08-07T05:48:18.743441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02420","last_updated":"2024-10-31T04:50:59Z","snapshot_observed_at":"2026-08-04T02:19:09.419143Z","submitted_at":"2024-02-04T09:36:31Z","title":"Factuality of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02420","snapshot_observed_at":"2026-08-07T05:48:18.746771Z","title":"M., Zaman, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.746771Z"},"links":{"cited_paper":"/paper/2402.02420","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:4d5203d7d5e07c213bcfd9d0d09ad7a2f2f10b67b21caf45313181c8374e98e7","observation_id":"f65fc0bd-1523-4229-a7ee-f6471302f18a","resolution":{"observed_at":"2026-08-07T05:48:18.746771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.060431Z","title":null,"venue":null,"work_id":"e6432c3d-98e0-49d7-b504-9bb5e263c4c3","year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.749955Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:3e7e4cc56b9ebe84ebd821a927aa18a6ee975abe44d5bd18cae1424a146c0fa1","observation_id":"2d5ce6e7-4f3b-4b59-be71-657dc31564ee","resolution":{"observed_at":"2026-08-07T05:48:19.063567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:18.752928Z","title":"(2024).OpenFactCheck: A Unified Framework for Factuality Evaluation of LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.752928Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:1578b5d472dc7fe1c2dde7bdbc182c0861959167997a65860b6c598b8196407d","observation_id":"b0ec885d-1048-4ee7-9218-0abf556dda90","resolution":{"observed_at":"2026-08-07T05:48:18.752928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04368","last_updated":"2024-11-07T01:58:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-07T01:58:42Z","title":"Measuring short-form factuality in large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04368","snapshot_observed_at":"2026-08-07T05:48:18.755967Z","title":"W., Jiao, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.755967Z"},"links":{"cited_paper":"/paper/2411.04368","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:3814b0c84bac74e9d7078cafde7d136004eb107e47e8f3db0cf8c80fd623dcbd","observation_id":"a67319c4-9aba-48ee-a765-8ba08e47cab0","resolution":{"observed_at":"2026-08-07T05:48:18.755967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19764","last_updated":"2024-10-17T05:28:24Z","snapshot_observed_at":"2026-07-06T18:38:21.977142Z","submitted_at":"2024-06-28T09:09:36Z","title":"Belief Revision: The Adaptability of Large Language Models Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19764","snapshot_observed_at":"2026-08-07T05:48:18.759340Z","title":"C., Winata, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.759340Z"},"links":{"cited_paper":"/paper/2406.19764","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:b1e7cfc0fb62883940495425c1fb662e3529bb12f663138189d1aae0fc1339c3","observation_id":"db70f714-40be-4af9-9c46-4c8fdccd6114","resolution":{"observed_at":"2026-08-07T05:48:18.759340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T05:48:18.762671Z","title":"p must be ’1 ’ , ’2 ’ , or ’ infty ’","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.762671Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:d53804cde3d7b257b77f84d03f58a3e4aef5e7a932f931a92f0927179c7767f2","observation_id":"a177b9fb-1376-40c8-be69-b7d7ad8c4bb9","resolution":{"observed_at":"2026-08-07T05:48:18.762671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T05:38:21.402950Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2506.11110."}