{"as_of":"2026-08-05T02:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:287455a61ff83875eb9237c412d3f812391528dea66539eef9b649e342c6a639","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T18:12:55.726473Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.07484/citation-record","integrity":"/paper/2604.07484/integrity","json":"/paper/2604.07484/citation-record.json","paper":"/paper/2604.07484"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.15260","last_updated":"2025-08-21T05:48:38Z","snapshot_observed_at":"2026-08-02T03:10:09.020351Z","submitted_at":"2025-08-21T05:48:38Z","title":"Deep Think with Confidence","version":1},"cited_work":{"arxiv_id":"2508.15260","doi":"10.48550/arxiv.2508.15260","metadata_source":"pith","pith_arxiv_id":"2508.15260","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Deep Think with Confidence","venue":"cs.LG","work_id":"39c40c74-9f55-406d-b67a-37d9b88aa6b3","year":2025},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"cited_paper":"/paper/2508.15260","citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:fbe4c158dbe48c027e42321125c52ca604fe67873a0decbbfb91116b07835f92","observation_id":"a2c5f952-0625-401f-b6ee-d5d35e16f2ef","resolution":{"observed_at":"2026-05-16T11:30:21.518780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03185","last_updated":"2025-03-13T17:35:13Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:22:15Z","title":"Correlated Proxies: A New Definition and Improved Mitigation for Reward Hacking","version":4},"cited_work":{"arxiv_id":"2403.03185","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.03185","snapshot_observed_at":"2026-07-01T10:05:40.200096Z","title":"Correlated proxies: A new definition and improved mitigation for reward hacking.arXiv preprint arXiv:2403.03185","venue":null,"work_id":"fa298c70-3b16-480b-a247-e58d893e1de3","year":2024},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"cited_paper":"/paper/2403.03185","citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:9986a106a9b3dfbd47e6efbd4d6b9f37e9e84c1080677f42e806f60440093778","observation_id":"06d2ddd8-1325-45e9-89bb-dc941196c020","resolution":{"observed_at":"2026-05-11T05:20:57.524394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12832","last_updated":"2024-10-02T17:58:39Z","snapshot_observed_at":"2026-08-03T10:06:52.418096Z","submitted_at":"2024-10-02T17:58:39Z","title":"Generative Reward Models","version":1},"cited_work":{"arxiv_id":"2410.12832","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.12832","snapshot_observed_at":"2026-07-08T17:55:20.847513Z","title":"Generative reward models","venue":"cs.LG","work_id":"23ed8cd6-2e8b-4d27-8d71-9e2c7e958e9b","year":2024},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"cited_paper":"/paper/2410.12832","citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:92c28725ecf26d7bd48259e3485456a7a6de8e5be7fcc36f2033798372f2ecd9","observation_id":"07d7b8a6-e0a2-4e6d-b4f6-98930e1cad61","resolution":{"observed_at":"2026-05-11T05:20:57.515709Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18099","last_updated":"2025-07-08T09:49:57Z","snapshot_observed_at":"2026-07-06T20:28:14.293619Z","submitted_at":"2025-01-30T02:21:59Z","title":"Learning to Plan & Reason for Evaluation with Thinking-LLM-as-a-Judge","version":2},"cited_work":{"arxiv_id":"2501.18099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18099","snapshot_observed_at":"2026-07-02T07:56:47.550212Z","title":"arXiv preprint arXiv:2501.18099 (2025)","venue":null,"work_id":"ba52a6fe-18a3-4255-a838-fe1823435cc3","year":2025},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"cited_paper":"/paper/2501.18099","citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:b695e7d550506a2a0cabe5ecae9422685c3043e0b0e20d526923e92a7088e45a","observation_id":"5f890e66-3a40-4204-a50f-f731830dcea3","resolution":{"observed_at":"2026-05-11T05:20:57.479472Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:e8e76dc0ad4fa73a702954537a33779b9d6fd58fd05fab0dde7b0f2b2ed99caa","observation_id":"370d0ac6-6f41-4d36-bca1-4fd51f43450a","resolution":{"observed_at":"2026-05-11T05:20:57.502619Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08745","last_updated":"2025-06-10T12:40:39Z","snapshot_observed_at":"2026-07-06T21:39:42.169262Z","submitted_at":"2025-06-10T12:40:39Z","title":"Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning","version":1},"cited_work":{"arxiv_id":"2506.08745","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08745","snapshot_observed_at":"2026-07-04T13:59:51.882252Z","title":"arXiv preprint arXiv:2506.08745 , year=","venue":null,"work_id":"61329d50-659f-42f1-a035-541f1f425e91","year":2025},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"cited_paper":"/paper/2506.08745","citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:e5574b4bc7a78c3ca49baef6989c9322df212842501a74fad7e5cc194423b6f9","observation_id":"5ecaf77b-8d39-4576-b78f-eca6fc09c686","resolution":{"observed_at":"2026-05-11T05:20:57.469347Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"626adbff-5974-44ca-b147-4c277a17b48a","year":null},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:3be0d4be5db5bc618be0efb81d27fb47e8f71995389e4f57eaf8342dbc080b71","observation_id":"c3c920da-d8a9-44c7-9d48-5b26fcb69339","resolution":{"observed_at":"2026-05-17T06:31:36.906704Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"997ecd18-cb4c-4808-af6c-cd3c9a6f6f5d","year":null},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:bbf83dbffecf02e39849b6883ebe01040caf933893a54b576e6b4c7e00b73b8b","observation_id":"54dd87a1-56bb-4821-a9cf-c777e9f2d5da","resolution":{"observed_at":"2026-05-17T06:31:36.887357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"950219ae-6784-4c26-b439-7377c5ddfed5","year":null},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:3ff5dcb77810951e6338c21dfd2568af7a0fb198a7d752bd055a4b20b695bca7","observation_id":"d4baa38a-00cf-4d09-ac61-44f62aa32209","resolution":{"observed_at":"2026-05-17T06:31:36.889538Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"</Criterion> <Analysis> Response 1: Response 1 provides a broad overview of NHI systems and correctly explains the concepts of both top-down and bottom-up approaches in healthcare","venue":null,"work_id":"53e67e41-0ff0-4d1c-8b63-da07d58c4926","year":null},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:26b14d9099f383f5f27ca2ad69ed0644ce476747d5e7c182fef906d54df9ecf1","observation_id":"5ff1ec89-606a-46b0-a8fb-680d7a218b7c","resolution":{"observed_at":"2026-05-17T06:31:36.897887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3b01bfd3-8ada-47b5-a74b-8a49e76ca293","year":null},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:13aa1d9b5acd70d4874a028cbba823ee97f662daf41e5877d6ff1c09f3c317c1","observation_id":"e0d1a515-5b34-46f1-b4ab-427baea06963","resolution":{"observed_at":"2026-05-17T06:31:36.903427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d1b17b01-963f-4992-a073-ccb4c6c214e4","year":null},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:a7a915ad22e4b7964e6f2170e314e6505d4bc1be19d21551e291a4851cac2997","observation_id":"0b054f66-50e0-4232-974a-5aacc5adf354","resolution":{"observed_at":"2026-05-17T06:31:36.891858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f3b74780-b387-4b19-92d0-1f551882e121","year":null},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:024c9c50ef02bafde95ac491fc568cae261c1e0462b598d6916a2eca6477d8f8","observation_id":"8687569f-0162-4e09-a581-2367bd9fcc4a","resolution":{"observed_at":"2026-05-17T06:31:36.894820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"</Criterion> <Analysis> Response 1: Response 1 provides a comprehensive overview of the NHI system and explains both top-down and bottom-up approaches in the context of healthcare","venue":null,"work_id":"f03e2057-8d25-48e1-ae4f-1088ae298322","year":null},"citing_paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:55.726473Z"},"links":{"citing_paper":"/paper/2604.07484"},"observation_digest":"sha256:be54b683eb9fd45c4e931f55c2116bb3b87a28a4034cdf56f027a7181994a6a4","observation_id":"1a0e2a63-45e1-4361-b2bd-dd5b142ed282","resolution":{"observed_at":"2026-05-17T06:31:36.884191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.07484","last_updated":"2026-04-20T15:02:36Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T22:55:41.978450Z","submitted_at":"2026-04-08T18:25:02Z","title":"ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2604.07484."}