{"as_of":"2026-08-09T02:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bcae69c1a751dbb7482fcac7cf9b9b9ff339d36607c56bbd6666ec640dcb05f6","coverage":[{"denominator":7,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T12:10:43.791548Z","state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.28010/citation-record","integrity":"/paper/2605.28010/integrity","json":"/paper/2605.28010/citation-record.json","paper":"/paper/2605.28010"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.28010","last_updated":"2026-05-27T06:07:10Z","snapshot_observed_at":"2026-08-08T11:46:52.618262Z","submitted_at":"2026-05-27T06:07:10Z","title":"Confidence-Orchestrated Self-Evolution against Uncertain LLM Feedback","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T12:10:43.791548Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.28010"},"observation_digest":"sha256:67a1daa14f63cc0ce1335afa0a6278cde70a8081e7c49a268b5f23abe18aa6f3","observation_id":"303557f4-bbf9-4ae9-822e-0213d69acacc","resolution":{"observed_at":"2026-06-29T12:13:26.642494Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.28010","last_updated":"2026-05-27T06:07:10Z","snapshot_observed_at":"2026-08-08T11:46:52.618262Z","submitted_at":"2026-05-27T06:07:10Z","title":"Confidence-Orchestrated Self-Evolution against Uncertain LLM Feedback","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T12:10:43.791548Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.28010"},"observation_digest":"sha256:9e75284a3b977d72430133e4f3ea0cfecc5a89299ac5852678c41ffed2a93fd4","observation_id":"f1a743ca-44a0-4527-8789-57adf9d71484","resolution":{"observed_at":"2026-06-29T12:13:26.644921Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2605.28010","last_updated":"2026-05-27T06:07:10Z","snapshot_observed_at":"2026-08-08T11:46:52.618262Z","submitted_at":"2026-05-27T06:07:10Z","title":"Confidence-Orchestrated Self-Evolution against Uncertain LLM Feedback","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T12:10:43.791548Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2605.28010"},"observation_digest":"sha256:726f6d5c9ef8a36435836fd3e722634b09f837d1f3b9b8d11b0331c35a3725fa","observation_id":"820926d8-3a0d-43c6-aef3-1709b9d356fa","resolution":{"observed_at":"2026-06-29T12:13:26.635435Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.24684","doi":"10.48550/arxiv.2510.24684","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Spice: Self-play in corpus environments improves reasoning","venue":"arXiv (Cornell University)","work_id":"7bf84ba5-f40a-459f-b34c-8a73545856b4","year":2025},"citing_paper":{"arxiv_id":"2605.28010","last_updated":"2026-05-27T06:07:10Z","snapshot_observed_at":"2026-08-08T11:46:52.618262Z","submitted_at":"2026-05-27T06:07:10Z","title":"Confidence-Orchestrated Self-Evolution against Uncertain LLM Feedback","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T12:10:43.791548Z"},"links":{"citing_paper":"/paper/2605.28010"},"observation_digest":"sha256:55d9ec3aa2a06ee260df945923f263c085a84f86126aa47d4f0ca6712415b744","observation_id":"b5645702-7a32-41bb-8a32-7793d0360542","resolution":{"observed_at":"2026-06-29T12:13:26.640194Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:00.867858+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:00.867858+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:10:43.791548Z","title":"InAdvances in Neural Information Processing Systems (NeurIPS), volume 37","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.28010","last_updated":"2026-05-27T06:07:10Z","snapshot_observed_at":"2026-08-08T11:46:52.618262Z","submitted_at":"2026-05-27T06:07:10Z","title":"Confidence-Orchestrated Self-Evolution against Uncertain LLM Feedback","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T12:10:43.791548Z"},"links":{"citing_paper":"/paper/2605.28010"},"observation_digest":"sha256:e5b1e38b062b70bf51e1e6eb5690f5b7ffed7aab0779b01a926ddbc3e46c30f2","observation_id":"7af0f012-17b3-4b2e-af7e-23559914b313","resolution":{"observed_at":"2026-06-29T12:10:43.791548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.28010","last_updated":"2026-05-27T06:07:10Z","snapshot_observed_at":"2026-08-08T11:46:52.618262Z","submitted_at":"2026-05-27T06:07:10Z","title":"Confidence-Orchestrated Self-Evolution against Uncertain LLM Feedback","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T12:10:43.791548Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.28010"},"observation_digest":"sha256:87c1fcafac987fcb05f9b57a26a673a9db09b9ff4c8c8178da7728a54d066091","observation_id":"f94c1dde-40e0-4185-8ee6-f222e5c86b01","resolution":{"observed_at":"2026-06-29T12:13:26.647159Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11436","last_updated":"2024-06-18T04:41:07Z","snapshot_observed_at":"2026-07-06T17:31:41.687799Z","submitted_at":"2024-02-18T03:10:39Z","title":"Pride and Prejudice: LLM Amplifies Self-Bias in Self-Refinement","version":2},"cited_work":{"arxiv_id":"2402.11436","doi":"10.48550/arxiv.2402.11436","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11436","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rickard Stureborg, Dimitris Alikaniotis, and Yoshi Suhara","venue":"arXiv (Cornell University)","work_id":"ae09097d-58a5-40bc-8f92-14d333fc4a2d","year":2024},"citing_paper":{"arxiv_id":"2605.28010","last_updated":"2026-05-27T06:07:10Z","snapshot_observed_at":"2026-08-08T11:46:52.618262Z","submitted_at":"2026-05-27T06:07:10Z","title":"Confidence-Orchestrated Self-Evolution against Uncertain LLM Feedback","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T12:10:43.791548Z"},"links":{"cited_paper":"/paper/2402.11436","citing_paper":"/paper/2605.28010"},"observation_digest":"sha256:a835f657dac32c43c0f2619485b92c6c5c867c5aab69e5a593504e0849ca11f6","observation_id":"63f226a2-7a55-4e16-b448-2faf98a44964","resolution":{"observed_at":"2026-06-29T12:13:26.637785Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.28010","last_updated":"2026-05-27T06:07:10Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T11:46:52.618262Z","submitted_at":"2026-05-27T06:07:10Z","title":"Confidence-Orchestrated Self-Evolution against Uncertain LLM Feedback"},"reference_resolution":{"displayed":7,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":1,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":7},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 7 of 7 outbound references and 0 inbound Pith citation observations for arXiv:2605.28010."}