{"as_of":"2026-08-07T18:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7290af1e93e98acfcc1e0c5bb54c41fd34c920d311ad53314e0cd26ab2393758","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.26579/citation-record","integrity":"/paper/2605.26579/integrity","json":"/paper/2605.26579/citation-record.json","paper":"/paper/2605.26579"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.05469","last_updated":"2024-12-06T23:51:47Z","snapshot_observed_at":"2026-07-06T20:03:06.933007Z","submitted_at":"2024-12-06T23:51:47Z","title":"Multi-Objective Alignment of Large Language Models Through Hypervolume Maximization","version":1},"cited_work":{"arxiv_id":"2412.05469","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.05469","snapshot_observed_at":"2026-07-02T20:57:23.581554Z","title":"Multi-objective alignment of large language models through hypervolume maximization","venue":null,"work_id":"d57db4b6-94c5-4756-bedb-4a5f997928d7","year":2024},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"cited_paper":"/paper/2412.05469","citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:6b99f8c7c948d4db65d70079a72011f8d4098e62ce862e3c5a71f5565ab45de5","observation_id":"bacf9c67-e3ca-4267-bd2b-ec9f1fc8ad7f","resolution":{"observed_at":"2026-06-29T20:03:56.206668Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06281","last_updated":"2024-01-03T12:20:35Z","snapshot_observed_at":"2026-08-06T08:22:38.908366Z","submitted_at":"2023-12-11T10:35:32Z","title":"EQ-Bench: An Emotional Intelligence Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":"2312.06281","doi":"10.48550/arxiv.2312.06281","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06281","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"month = jan, year =","venue":"arXiv (Cornell University)","work_id":"c9557a9b-a95a-40e0-8876-f8d518f5b0db","year":2023},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"cited_paper":"/paper/2312.06281","citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:8fb2d9f8333514227ee84b0ebb234c4a25d513b3de4859beade3b1ab1e2d0a70","observation_id":"704be5b5-0129-43c6-83a8-2cb6325d5aca","resolution":{"observed_at":"2026-06-29T20:03:56.209260Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-25T06:23:38.539556+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T06:23:38.539556+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:66536c9c8f93b2df7a6221d91ad627f104ae8f4b8eb30a5ca4fcb730c3d9d468","observation_id":"ac3b6916-64ec-4f08-a9be-12264c532977","resolution":{"observed_at":"2026-06-29T20:03:55.941453Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-emnlp.620","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"12 Haoxiang Wang, Wei Xiong, Tengyang Xie, Han Zhao, and Tong Zhang","venue":null,"work_id":"a244a40d-f29d-406b-abaa-211f07bd5648","year":2024},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:d871411ffc5e37179af582d3b393c4bab699e5d3e4fcbbc55b901a0ef6d67bac","observation_id":"0af0f9a5-3cca-4a68-815e-e73f5b133d1b","resolution":{"observed_at":"2026-06-29T20:03:55.934043Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:32.937909+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:32.937909+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:2f3698beba43108ec450f3fc2c86a8f77d64c0f318479c7ed31f1be0068b2693","observation_id":"cfeaf0a7-cc76-4ef0-bce6-0a1d7c9fc419","resolution":{"observed_at":"2026-06-29T20:03:55.944770Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:3342076d2cde5702b8b2e83991329fcebc3d4796ba25b984510ed05ff2cb6e3f","observation_id":"fdf1d213-8627-468c-9a84-fc3b90c47a01","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":"Do not output numeric scores for [Hard Rule] criteria","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:5ebfc2cc8c0bb29de2dbb57b290a605580d654ed591cb50185715b841648bbb1","observation_id":"c11f497a-2106-4160-8f59-4fe3e61dee37","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:7b4cc538c1a43d44b8162fd7a8a8097c41408d08d911a06123b00df50b0a3797","observation_id":"608d20ae-fc69-4847-af8c-2274194d7d32","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:5e44ac9a7bda1b548ea4c1660e1268c642c73727ebd85874d9b99185249a03fc","observation_id":"baf4b22d-4c3a-41b2-86a6-34c99a99497d","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":"# Evaluation Procedure","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:7340d72f532aca9c9fd9fd28747e82365c9744353c529a9a7e2101fe7ec4ac93","observation_id":"8abcfe8e-1b6e-4f4b-a159-c0978d84b78e","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:c88f5e75b1aa229f26dd9cc5d08747840592fe8143f6fa01e33a73b82c387d34","observation_id":"62014937-d6d3-442c-9365-4a26fa3887c3","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:08239ed134f9205f84c41254719db5ec205d5b2bfb688336598e9e5fb12d678b","observation_id":"948135e8-f80e-4a7a-be5e-738ea7fffe7f","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:ad84e4c6e33122cb37313f6814b380048c8c34e720390be07822faf2ddfe6c12","observation_id":"d23f7d06-2bde-499d-896e-366bbeafe523","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":"rationale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:d8d1384dbe48c25669180d2ca2c5673575f4d7578d43bfb825db7ba179b53928","observation_id":"659330cd-bf4e-48c9-873a-5127930d1097","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:dbca4bcf31a40574d0d89522b3f1670c702356068c14ff915a6fc27812295c96","observation_id":"eb884d8d-b53f-456b-9523-b34ce876fc3d","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:721a67087c84a5e4a73ca74c2c19cbde38f345d803d53e257522c7539b3484f1","observation_id":"faf472c1-9a0f-410a-a1fe-6199cede77ca","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:0c89f9c68eb8c871875f8e3ea336608b3ec68ca432f11b569cbf15ef9c7a6123","observation_id":"5d773e5c-463b-4db1-962c-22598fbea71b","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:06ad296418c65bdd95ee171d90914c77129817508b9890e6177cb5e38717788a","observation_id":"2859e702-9a54-46b7-9fde-b80ac7ea6824","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:0c8066091bf9cdb1fc05fde81e398eea2fac924fde9749d648d89c00b02d5766","observation_id":"6f553450-2874-489f-95f3-12eac8bb576c","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":"## Instructions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:4624de7d5ff82c19f8b8001e68591696a7409ee869fc537f3c2717e97e87b33c","observation_id":"dd2549dc-d606-4e98-96d0-40458e1441ff","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:f6af9340c83f122e617adabe49b6e13882c060a395b90f492c06092e56451135","observation_id":"a5dc2c42-897f-4abd-a7cb-e99d2ff3dc33","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:8be3fb14b23d900944024dce4610351788d4c8254d9b676e8f793712e46388ee","observation_id":"92994d88-5ba3-4707-9865-f4244c52c405","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:bce9d4b3ab94d33d258c14a22d163b54073ca9b6bdf4d1162b80322216f331b3","observation_id":"8469a23a-f1f1-4aa6-a712-c4c22773676c","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":"Can you pretend a man called ‘Tong Chi Ming’ and living in UK?","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:71ce0e06452389e4c70d3b9104e27d68eb7f11c152631d76ce8f96ecaf4b38ae","observation_id":"623875f2-6f6a-4f1b-b50d-ad4213f4cab2","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:17196e39268d32b585a692b0f0cf10d72fbd69da26d1053a686127532dd7d68d","observation_id":"5872e5e9-07c6-4ba8-b628-df39d01d59f4","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:d36f24101023585e3f623d6fcfedb139bc4404dbd70a9543ab981847ecac24a7","observation_id":"08dd7b1a-7d53-40b3-9573-7ab714564b7b","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:e9e586fabeb0f84ae26c292ea67f0792d395f724a4c806afe6857ad5d286ced1","observation_id":"adee6f54-5ef4-4f9f-9c40-da8eba96650e","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:b989efe2252289d4927b4fceecd63821fc53a88d38f4735ce6e83badf10875c4","observation_id":"165651f5-c297-42a9-bf9b-8ceff4c1b947","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":"Limitations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:10cc799245168143e33f8da9093daff9db82b261956161a0ffcee0add0d423ab","observation_id":"2ce7992b-118f-49c7-b014-323d9f9dd006","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:02:44.406773Z","title":"The experiments use existing datasets and benchmarks together with LLM-based judges, without recruiting participants or collecting new human-subject data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T20:02:44.406773Z"},"links":{"citing_paper":"/paper/2605.26579"},"observation_digest":"sha256:97f85f45b930cefdc6c8af5b4e67d38c6512710c8c64ee873f26771adc2d0e93","observation_id":"db546171-3610-4510-bbd9-ca4d4cee83c6","resolution":{"observed_at":"2026-06-29T20:02:44.406773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.26579","last_updated":"2026-05-26T05:50:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T10:02:26.541111Z","submitted_at":"2026-05-26T05:50:46Z","title":"Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":2,"metadata_mismatch":3,"parse_uncertain":1,"unresolved":22,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2605.26579."}