{"as_of":"2026-08-07T09:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ec6562f994fa256bb4d15526ab31696f1bc6189445110d27135b6afdb9ce7d57","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T10:56:34.307355Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:47:26.547119Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.20083","snapshot_observed_at":"2026-07-30T18:33:28.626422Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26873","last_updated":"2026-07-31T13:09:25Z","snapshot_observed_at":"2026-08-05T23:14:46.499586Z","submitted_at":"2026-07-29T13:03:07Z","title":"SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-07-30T18:33:28.626422Z"},"links":{"cited_paper":"/paper/2607.20083","citing_paper":"/paper/2607.26873"},"observation_digest":"sha256:c6e3b589286f5698d59979576d77649e30beafd86e7a7d1f437cf0d9977a709b","observation_id":"bb719a8c-8e89-4460-a15c-bea9083f22f8","resolution":{"observed_at":"2026-07-30T18:33:28.626422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.20083","snapshot_observed_at":"2026-08-03T01:47:26.547119Z","title":"Co-Evolving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26873","last_updated":"2026-07-31T13:09:25Z","snapshot_observed_at":"2026-08-05T23:14:46.499586Z","submitted_at":"2026-07-29T13:03:07Z","title":"SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-03T01:47:26.547119Z"},"links":{"cited_paper":"/paper/2607.20083","citing_paper":"/paper/2607.26873"},"observation_digest":"sha256:300553f070b9ad70ab82c1babdd4e3e05006399273b49c7e21e05a6bef05f659","observation_id":"21b821a3-3c7d-4358-a698-565c5e7288cf","resolution":{"observed_at":"2026-08-03T01:47:26.547119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.20083/citation-record","integrity":"/paper/2607.20083/integrity","json":"/paper/2607.20083/citation-record.json","paper":"/paper/2607.20083"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.480780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.480780Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:a73bd553f3ce9e2eba606a1ece0f0d21e6dbd6263e89e87060df512c55490d84","observation_id":"a8d8aa60-ec7b-4a30-90a0-67c7dbf52ec1","resolution":{"observed_at":"2026-08-01T10:56:32.480780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.495544Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.495544Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:75bcb93746693f5573b98edee862fa55ba46d349a5d25b1346ecb04faa404969","observation_id":"83031ad0-550d-4292-90b0-91811c8c9331","resolution":{"observed_at":"2026-08-01T10:56:32.495544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T10:56:32.449691Z","title":"John Schulman, Filip Wolski, Prafulla Dhariwal, Alec Radford, and Oleg Klimov","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.449691Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:20fb46a64baebe716a67be25702e7f4bc38a0486fe037de393fcfbdedfac3de5","observation_id":"ae116cd6-260a-4f46-8f02-8817fccfe02a","resolution":{"observed_at":"2026-08-01T10:56:32.449691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.463461Z","title":"For pairwise benchmarks, the evaluator is asked to select the preferred response from a candidate pair","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.463461Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:ad971773af5ebe77b734cd7088ca071610eddace6f9245b9ac30056d326a43a3","observation_id":"61eaae05-5774-4b82-ac19-b24a9dc0d220","resolution":{"observed_at":"2026-08-01T10:56:32.463461Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.651963Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.651963Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:77ea065fff942fd327c642f3838ab1ee43267e25dd4b7f9c58235d71eeed0870","observation_id":"40036f04-eca8-45ed-add8-8d47aab23cdc","resolution":{"observed_at":"2026-08-01T10:56:32.651963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.669201Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.669201Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:b7fd8c656002b4eb30756255d5135bdc7b0e78f262915708eedbd8d2900e0a85","observation_id":"674cf09a-42fa-424a-ad98-25da2a65ec4c","resolution":{"observed_at":"2026-08-01T10:56:32.669201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.509963Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.509963Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:8f24eca861090a395a97c584bfbb49f82ba390690d68e6afe4eac4211f37ce4b","observation_id":"5d94e628-bcbe-4022-b4d0-ca8b2578f463","resolution":{"observed_at":"2026-08-01T10:56:32.509963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.533564Z","title":"Representative rubrics generated by DynamicRubric-trained generatorG 2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.533564Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:23cf0891467d30230430480d79c6139d1450ece7480c595ee117355f15a0f064","observation_id":"dd9e2be7-bdbe-4962-a01d-35e30abf19d4","resolution":{"observed_at":"2026-08-01T10:56:32.533564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.556442Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.556442Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:1a7b6ad3b94ae49d6f20356a591e516c0ea4d421e8a378ac352bda5d1e2713e7","observation_id":"b3ae5c26-333c-4119-b86a-ce0522346c70","resolution":{"observed_at":"2026-08-01T10:56:32.556442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.587179Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.587179Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:c14d949ba98a132a8314ab25df6b206f185181210102f0145ba45fc96b20d144","observation_id":"0fab1beb-846b-47e2-8ae2-0e4e42fa3a44","resolution":{"observed_at":"2026-08-01T10:56:32.587179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.608816Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.608816Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:0905360d3b7f8c8b629875467f04282a46e54796f205f3eac6e3bd381c799f7b","observation_id":"9d9f0158-6c72-42a3-8706-a8149e94e5aa","resolution":{"observed_at":"2026-08-01T10:56:32.608816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.631990Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.631990Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:86fa29d773afadae71160a9adf3457df3d3db10fa27ecf2acf5b39cb737c3497","observation_id":"9d55c289-432f-4a00-bec4-8bc2c71699c2","resolution":{"observed_at":"2026-08-01T10:56:32.631990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.727366Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.727366Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:0154eee121005f0ae197c51cba94d5558d260f6d5b1aceb9593d4f13f9175452","observation_id":"685bb0ca-502a-467d-b454-51b375b0309a","resolution":{"observed_at":"2026-08-01T10:56:32.727366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.843933Z","title":"yes\"/\"no","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.843933Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:57f6b9664f02ee977194565e9df5f5bd01068b58c83e2c2fa148f2de7154c3cb","observation_id":"949342b7-fb2b-488d-9e04-2c6795c93d80","resolution":{"observed_at":"2026-08-01T10:56:32.843933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.010319Z","title":"- Use the response pool to notice which qualities help a response satisfy the user's request better","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.010319Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:52137f1f37ba88c533890e491f8b5cc56e781f497670df157fdc5d448cd437b8","observation_id":"ab1dc735-e1cd-461d-8b1a-54f7e47ee628","resolution":{"observed_at":"2026-08-01T10:56:33.010319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.126580Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.126580Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:440e207fd436eb29d3dbd578616d92e297f4dcf5139ec4fd838d3d1af26d1861","observation_id":"2443284f-81b2-46e5-8233-276912424e50","resolution":{"observed_at":"2026-08-01T10:56:33.126580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.314271Z","title":"partially correct","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.314271Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:40732dd1b36ee26f4ace823e5e3fbb79ef0428fb718e258ab5918c93b9961544","observation_id":"772eaccd-e7a7-4036-b6ae-5c7280cb4ff1","resolution":{"observed_at":"2026-08-01T10:56:33.314271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.577802Z","title":"yes\" or","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.577802Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:2e997b5091be8f84d6bcc8239eed4c71595478832dd721e9ebc84f84f792ea03","observation_id":"0c7e89db-10c5-4459-b76b-3261c493673f","resolution":{"observed_at":"2026-08-01T10:56:33.577802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.704644Z","title":"- If the user did not ask for a specific format, a format-based rubric should usually be omitted","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.704644Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:a350035f04e14bcfb289533a4ba785b9e4298663eb4955ceb4739f1b75edf96f","observation_id":"58b11219-2ee8-4038-b2b7-4ccd0ab5ab08","resolution":{"observed_at":"2026-08-01T10:56:33.704644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.808318Z","title":"yes\" = good): - Frame all rubrics so that a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.808318Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:f635e38a758fc022b198850fb267b950cfec2eb8931cc0c2ce14af916998c4ab","observation_id":"e26436d9-03ca-4eb3-9f5b-db49853942ee","resolution":{"observed_at":"2026-08-01T10:56:33.808318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.865783Z","title":"- Each rubric should be written as a general standard that can be applied to evaluate any response independently","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.865783Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:df4ce26caf8a1b089f797b6d61e0470f03a360756035880b078ede5a6898ed6c","observation_id":"df0c962c-33b5-4527-a162-d499272cdea7","resolution":{"observed_at":"2026-08-01T10:56:33.865783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.975390Z","title":"- Each rubric should contain all the information needed to evaluate a response","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.975390Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:6898481d6eb9e2050147070b29a512e2390560d05adc526361456fefb3313e4e","observation_id":"40dfd21c-bf44-4be6-a583-10703580b7a5","resolution":{"observed_at":"2026-08-01T10:56:33.975390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:34.056772Z","title":"- Essential (Weight 5): Core task requirements, critical user constraints, or safety-related requirements; if missing, the response is seriously flawed or invalid","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:34.056772Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:b81e64b4174a4212b1e91b10090a8c834adb28f54b755c0b6aac76f892e9a613","observation_id":"c0d5df32-fbbe-4e34-9364-b6d8314bd1b5","resolution":{"observed_at":"2026-08-01T10:56:34.056772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:34.112112Z","title":"rubric\":","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:34.112112Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:edb3ae20af4efe7b53535fd2a9b3b99099b11beb14105e42eda5b6989582c8f6","observation_id":"c9a5840d-97ee-4017-ab58-cdd6a6f06839","resolution":{"observed_at":"2026-08-01T10:56:34.112112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:34.196973Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:34.196973Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:c1f81e10e74763a3926376f79235022814e26c58951364e6cd43d849979baf43","observation_id":"b9d77d5e-85c9-4055-8dbf-3aa9f0873c86","resolution":{"observed_at":"2026-08-01T10:56:34.196973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:34.307355Z","title":"yes\" if the response clearly meets the rubric. - Answer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:34.307355Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:21031300ccdad25eaa924b505e9e99c288db6873c77a183a5d8dc86896ee055f","observation_id":"663b597e-bd1d-4333-a03d-73528e1b913d","resolution":{"observed_at":"2026-08-01T10:56:34.307355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-01T10:56:32.444211Z","title":"Chris Yuhao Liu, Liang Zeng, Jiacai Liu, Rui Yan, Ju- jie He, Chaojie Wang, Shuicheng Yan, Yang Liu, and Yahui Zhou","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.444211Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:ff8f522c1abea7e7ec6c26d435b46927e7ea1cf38b17254d4ee848c07893eda3","observation_id":"7b9870fc-4ef3-44fa-81d3-47ef19582268","resolution":{"observed_at":"2026-08-01T10:56:32.444211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17746","snapshot_observed_at":"2026-08-01T10:56:32.437394Z","title":"Daya Guo, Dejian Yang, Haowei Zhang, Junxiao Song, Peiyi Wang, Qihao Zhu, Runxin Xu, Ruoyu Zhang, Shirong Ma, Xiao Bi, Xiaokang Zhang, Xingkai Yu, Yu Wu, Z","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.437394Z"},"links":{"cited_paper":"/paper/2507.17746","citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:f4252e1c0189c4838c5906b4924e98a778f313560dfa2e035e36f0eb2e05cc78","observation_id":"79bdba91-3b95-43c4-b9c8-c2a14b03e56c","resolution":{"observed_at":"2026-08-01T10:56:32.437394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-01T10:56:31.196810Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 2 inbound Pith citation observations for arXiv:2607.20083."}