{"as_of":"2026-08-05T20:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fb1c00c6742d9f1368b73ebabcac4a0ac7418ebc7b1e3e15af052c58a3165062","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T11:11:12.780313Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T05:17:40.141555Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"cited_work":{"arxiv_id":"2411.16579","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16579","snapshot_observed_at":"2026-07-03T05:17:40.141555Z","title":"Enhancing llm reasoning via critique models with test-time and training-time supervision","venue":null,"work_id":"1b5197ac-a9d1-4e9b-ade1-a8470acd1ab9","year":2024},"citing_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"reference_index":171,"source":"arxiv_source","source_observed_at":"2026-05-14T22:23:14.621091Z"},"links":{"cited_paper":"/paper/2411.16579","citing_paper":"/paper/2507.21046"},"observation_digest":"sha256:c04e5c35f0802c6c329ee21df8f9b1666b820a925898172221c00a7925eee7d7","observation_id":"7aacda37-b046-471e-be59-73e724a8bec2","resolution":{"observed_at":"2026-05-14T22:23:14.944730Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"cited_work":{"arxiv_id":"2411.16579","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16579","snapshot_observed_at":"2026-07-03T05:17:40.141555Z","title":"Enhancing llm reasoning via critique models with test-time and training-time supervision","venue":null,"work_id":"1b5197ac-a9d1-4e9b-ade1-a8470acd1ab9","year":2024},"citing_paper":{"arxiv_id":"2508.10695","last_updated":"2026-04-24T15:29:16Z","snapshot_observed_at":"2026-07-06T22:13:00.029560Z","submitted_at":"2025-08-14T14:36:53Z","title":"Learning from Natural Language Feedback for Personalized Question Answering","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T22:55:16.228037Z"},"links":{"cited_paper":"/paper/2411.16579","citing_paper":"/paper/2508.10695"},"observation_digest":"sha256:30d430d4db1100a2df868bbb8d7986cabdde0db478413748daa91a066cc48fa4","observation_id":"3396766a-ad2a-4185-b315-f00feb8a3e76","resolution":{"observed_at":"2026-05-18T22:56:53.045875Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16579","snapshot_observed_at":"2026-08-04T11:11:12.780313Z","title":"Enhancing llm reasoning via critique models with test-time and training-time supervision.arXiv preprint arXiv:2411.16579,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.06672","last_updated":"2026-05-25T01:59:00Z","snapshot_observed_at":"2026-08-04T11:11:09.166918Z","submitted_at":"2025-10-08T05:53:56Z","title":"XRPO: Pushing the limits of GRPO with Targeted Exploration and Exploitation","version":3},"reference_index":1992,"source":"pdf_text","source_observed_at":"2026-08-04T11:11:12.780313Z"},"links":{"cited_paper":"/paper/2411.16579","citing_paper":"/paper/2510.06672"},"observation_digest":"sha256:8c6383fd8e32f02e3e2f3226f63c0c18ad4e948bb7134df41d69ac61f3686672","observation_id":"6eafc153-32dd-404d-9036-6b9ae1198fbe","resolution":{"observed_at":"2026-08-04T11:11:12.780313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"cited_work":{"arxiv_id":"2411.16579","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16579","snapshot_observed_at":"2026-07-03T05:17:40.141555Z","title":"Enhancing llm reasoning via critique models with test-time and training-time supervision","venue":null,"work_id":"1b5197ac-a9d1-4e9b-ade1-a8470acd1ab9","year":2024},"citing_paper":{"arxiv_id":"2601.06794","last_updated":"2026-04-14T15:14:10Z","snapshot_observed_at":"2026-08-02T16:11:51.558737Z","submitted_at":"2026-01-11T07:29:08Z","title":"No More Stale Feedback: Co-Evolving Critics for Open-World Agent Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T16:01:48.789986Z"},"links":{"cited_paper":"/paper/2411.16579","citing_paper":"/paper/2601.06794"},"observation_digest":"sha256:7125bc8628eff2abc4e735250d74795788eaa500187472dcb305b4dcccaf5ade","observation_id":"f5360fa2-2d32-4f45-aa09-c34df55eb6aa","resolution":{"observed_at":"2026-05-16T16:03:04.330035Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"cited_work":{"arxiv_id":"2411.16579","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16579","snapshot_observed_at":"2026-07-03T05:17:40.141555Z","title":"Enhancing llm reasoning via critique models with test-time and training-time supervision","venue":null,"work_id":"1b5197ac-a9d1-4e9b-ade1-a8470acd1ab9","year":2024},"citing_paper":{"arxiv_id":"2605.18851","last_updated":"2026-05-13T11:04:31Z","snapshot_observed_at":"2026-07-06T23:29:38.069295Z","submitted_at":"2026-05-13T11:04:31Z","title":"STRIDE: Learnable Stepwise Language Feedback for LLM Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T20:47:16.236629Z"},"links":{"cited_paper":"/paper/2411.16579","citing_paper":"/paper/2605.18851"},"observation_digest":"sha256:ba0285abea26fd4c71e0f87ba8aeae0d19d8de91de6f106b7d5878c3f8c12028","observation_id":"6207f2ce-2e63-428e-8042-23e0caf6e0ae","resolution":{"observed_at":"2026-05-20T20:49:00.673885Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"cited_work":{"arxiv_id":"2411.16579","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16579","snapshot_observed_at":"2026-07-03T05:17:40.141555Z","title":"Enhancing llm reasoning via critique models with test-time and training-time supervision","venue":null,"work_id":"1b5197ac-a9d1-4e9b-ade1-a8470acd1ab9","year":2024},"citing_paper":{"arxiv_id":"2606.11078","last_updated":"2026-06-09T16:39:10Z","snapshot_observed_at":"2026-07-06T23:50:11.160843Z","submitted_at":"2026-06-09T16:39:10Z","title":"A History-Aware Visually Grounded Critic for Computer Use Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-27T13:20:32.432002Z"},"links":{"cited_paper":"/paper/2411.16579","citing_paper":"/paper/2606.11078"},"observation_digest":"sha256:34ea54032bf102ef7190ef27dce1494709c15649c9129ffd656e22e325488003","observation_id":"39681fe5-9020-4b3e-8b23-27317878f03d","resolution":{"observed_at":"2026-07-03T05:17:40.143173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.16579/citation-record","integrity":"/paper/2411.16579/integrity","json":"/paper/2411.16579/citation-record.json","paper":"/paper/2411.16579"},"outbound":[],"paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2411.16579."}