{"as_of":"2026-08-15T18:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aca5b7f04a3fd54e44cec759003b74516e3ef25850c1200b336dab025ebf3380","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:02:27.304144Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T20:57:23.916786Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":"2305.08844","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-07-02T20:57:23.916786Z","title":"u rek, E. Aky \\","venue":null,"work_id":"f3a3dfae-1c31-4afc-b8c6-8af914a8fd24","year":2023},"citing_paper":{"arxiv_id":"2409.12917","last_updated":"2024-10-04T17:28:45Z","snapshot_observed_at":"2026-08-14T09:52:03.795785Z","submitted_at":"2024-09-19T17:16:21Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-17T12:04:10.210508Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2409.12917"},"observation_digest":"sha256:d7243ebc19eb867a4279e27e47eb673c71e9c8cdfeecbf31ba47cde9228619f6","observation_id":"1c01ad14-062f-45ea-84c3-d22bc840301e","resolution":{"observed_at":"2026-05-17T12:04:10.429842Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-11T20:02:27.304144Z","title":"u rek, A. F., Aky \\","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06176","last_updated":"2024-12-09T03:22:35Z","snapshot_observed_at":"2026-08-14T19:48:54.120444Z","submitted_at":"2024-12-09T03:22:35Z","title":"AlphaVerus: Bootstrapping Formally Verified Code Generation through Self-Improving Translation and Treefinement","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T20:02:27.304144Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2412.06176"},"observation_digest":"sha256:9dfe1dee41c62046038dd3c18491ad05e9768b51e3379a5e650e469123043a6e","observation_id":"2ffd8493-2a16-4758-99c7-854ef7f7e73c","resolution":{"observed_at":"2026-08-11T20:02:27.304144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-11T13:20:59.543487Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13292","last_updated":"2025-04-10T02:11:49Z","snapshot_observed_at":"2026-08-15T12:15:44.730694Z","submitted_at":"2024-12-17T19:45:53Z","title":"Refining Answer Distributions for Improved Large Language Model Reasoning","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T13:20:59.543487Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2412.13292"},"observation_digest":"sha256:babde265e2b0c631bbc399abd84112edcd72e46756cbf7155f25109559f20317","observation_id":"fb22d84d-125e-49fe-a389-7002506c671a","resolution":{"observed_at":"2026-08-11T13:20:59.543487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-11T11:50:54.957083Z","title":"u rek, Ekin Aky \\","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14959","last_updated":"2025-07-15T07:07:14Z","snapshot_observed_at":"2026-08-15T14:21:12.327085Z","submitted_at":"2024-12-19T15:39:31Z","title":"Understanding the Dark Side of LLMs' Intrinsic Self-Correction","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T11:50:54.957083Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2412.14959"},"observation_digest":"sha256:efc50444726e64e61c2a09fbabb018805c9c7f2db5b543f684553aaaba8f5832","observation_id":"c1d2656c-05a8-4140-983c-75f78cff1f32","resolution":{"observed_at":"2026-08-11T11:50:54.957083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-11T11:18:29.690792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-15T00:21:16.868442Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:29.690792Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:5ca64928f2d748c100cd24652bca5bd6adaf55841c92df50815b527f4e0b9a7a","observation_id":"502c660b-9abc-472c-9b00-c8827d543e98","resolution":{"observed_at":"2026-08-11T11:18:29.690792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-11T05:32:05.021572Z","title":"u rek, A. F.; Aky \\","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17397","last_updated":"2024-12-23T08:51:48Z","snapshot_observed_at":"2026-08-14T09:21:24.188671Z","submitted_at":"2024-12-23T08:51:48Z","title":"Towards Intrinsic Self-Correction Enhancement in Monte Carlo Tree Search Boosted Reasoning via Iterative Preference Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T05:32:05.021572Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2412.17397"},"observation_digest":"sha256:3844238484109663dce2cd38ded1ac3f66033b7c3a6b7a77f89714a772a9e6c6","observation_id":"716b68ea-4806-4bab-b082-434262358aff","resolution":{"observed_at":"2026-08-11T05:32:05.021572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-08T15:38:17.323020Z","title":"Rl4f: Generating natural language feed- back with reinforcement learning for repairing model outputs,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06390","last_updated":"2025-02-11T04:42:24Z","snapshot_observed_at":"2026-08-14T03:01:11.443134Z","submitted_at":"2025-02-10T12:20:08Z","title":"When Data Manipulation Meets Attack Goals: An In-depth Survey of Attacks for VLMs","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T15:38:17.323020Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2502.06390"},"observation_digest":"sha256:48e4efc114a426f9b0d66f2a71572b65f45bf532321c00b3575409f1e30d5b41","observation_id":"aca12052-b038-4c5e-ac9e-45d7fa2bc64b","resolution":{"observed_at":"2026-08-08T15:38:17.323020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-07T05:51:30.651067Z","title":"Rl4f: Generating natural language feedback with reinforcement learning for repairing model outputs.arXiv preprint arXiv:2305.08844,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06923","last_updated":"2025-06-07T21:23:00Z","snapshot_observed_at":"2026-08-13T17:25:11.492849Z","submitted_at":"2025-06-07T21:23:00Z","title":"Boosting LLM Reasoning via Spontaneous Self-Correction","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:51:30.651067Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2506.06923"},"observation_digest":"sha256:a9112d554acfc6cf87e5f377eb9793ec30eccd879a1cf45de865f0db86731cb3","observation_id":"d5a81be3-6384-4657-9ab5-a0f67f876325","resolution":{"observed_at":"2026-08-07T05:51:30.651067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-07T04:39:16.405987Z","title":"Rl4f: Generating natural language feedback with reinforcement learning for repairing model outputs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10341","last_updated":"2026-06-06T22:57:41Z","snapshot_observed_at":"2026-08-14T05:28:48.137050Z","submitted_at":"2025-06-12T04:35:02Z","title":"Formalizing Learning from Language Feedback with Provable Guarantees","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T04:39:16.405987Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2506.10341"},"observation_digest":"sha256:11f52bd016e77c2a67a2edccdbe28372a766d723c0bdff1cff1ff0d3826af995","observation_id":"dce8310b-6091-4582-b261-78014fd6a7fb","resolution":{"observed_at":"2026-08-07T04:39:16.405987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-06T23:52:41.468043Z","title":"u rek, Ekin Aky \\","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16172","last_updated":"2025-06-19T09:45:13Z","snapshot_observed_at":"2026-08-14T20:58:57.422379Z","submitted_at":"2025-06-19T09:45:13Z","title":"SGIC: A Self-Guided Iterative Calibration Framework for RAG","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:52:41.468043Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2506.16172"},"observation_digest":"sha256:0bee3188ef63d8c55b3f47135fc0baeea807a0ce0d4b9ba274c4fbed81157eb9","observation_id":"d058e917-99fb-4147-a0fb-f5940a049c4d","resolution":{"observed_at":"2026-08-06T23:52:41.468043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-06T05:11:12.980594Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02243","last_updated":"2025-08-04T09:43:54Z","snapshot_observed_at":"2026-08-12T07:35:12.746734Z","submitted_at":"2025-08-04T09:43:54Z","title":"I2CR: Intra- and Inter-modal Collaborative Reflections for Multimodal Entity Linking","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T05:11:12.980594Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2508.02243"},"observation_digest":"sha256:031ec92a26633a22df7170391f7452e6ab741afe37da2b8fba225ca291ee571d","observation_id":"58597724-9d59-4848-82a8-41f668bbafe8","resolution":{"observed_at":"2026-08-06T05:11:12.980594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":"2305.08844","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-07-02T20:57:23.916786Z","title":"u rek, E. Aky \\","venue":null,"work_id":"f3a3dfae-1c31-4afc-b8c6-8af914a8fd24","year":2023},"citing_paper":{"arxiv_id":"2604.21268","last_updated":"2026-04-23T04:23:31Z","snapshot_observed_at":"2026-08-13T08:49:02.121853Z","submitted_at":"2026-04-23T04:23:31Z","title":"Measure Twice, Click Once: Co-evolving Proposer and Visual Critic via Reinforcement Learning for GUI Grounding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-09T23:05:05.251150Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2604.21268"},"observation_digest":"sha256:4a0c513e44bac6445e3873f3f128169ff07b8754a4ede4abc2dab263967dabeb","observation_id":"d0eeae88-b57d-4f47-a746-03c3ec01fc2d","resolution":{"observed_at":"2026-05-11T14:16:06.088229Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":"2305.08844","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-07-02T20:57:23.916786Z","title":"u rek, E. Aky \\","venue":null,"work_id":"f3a3dfae-1c31-4afc-b8c6-8af914a8fd24","year":2023},"citing_paper":{"arxiv_id":"2606.08068","last_updated":"2026-07-08T15:21:39Z","snapshot_observed_at":"2026-07-12T14:47:31.355938Z","submitted_at":"2026-06-06T09:33:32Z","title":"DICE: Entropy-Regularized Equilibrium Selection for Stable Multi-Agent LLM Coordination","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-06-27T19:58:32.016341Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2606.08068"},"observation_digest":"sha256:cd0e0d257380330a8ab260b66df74eb07ad95ee7e48be5839d8ef3078a1089c2","observation_id":"6a39c6f5-0200-496d-8ec4-931d615ea600","resolution":{"observed_at":"2026-07-02T20:57:23.918236Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2305.08844/citation-record","integrity":"/paper/2305.08844/integrity","json":"/paper/2305.08844/citation-record.json","paper":"/paper/2305.08844"},"outbound":[],"paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T05:43:31.861540Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2305.08844."}