{"as_of":"2026-08-09T00:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:92ed5137fde6754d548e363362e640d58d81d838738d3df30c8251de0a37d51c","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:11:39.079082Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:07:11.998516Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T20:56:13.682832Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16022","snapshot_observed_at":"2026-08-05T23:07:11.998516Z","title":"Mialon, G.; Dessi, R.; Lomeli, M.; Nalmpantis, C.; Pa- sunuru, R.; Raileanu, R.; Roziere, B.; Schick, T.; Dwivedi- Yu, J.; Celikyilmaz, A.; Grave, E.; LeCun, Y .; and Scialom, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05913","last_updated":"2025-08-08T00:27:50Z","snapshot_observed_at":"2026-08-05T23:07:10.330560Z","submitted_at":"2025-08-08T00:27:50Z","title":"Do Ethical AI Principles Matter to Users? A Large-Scale Analysis of User Sentiment and Satisfaction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T23:07:11.998516Z"},"links":{"cited_paper":"/paper/2505.16022","citing_paper":"/paper/2508.05913"},"observation_digest":"sha256:8e4b6392235745c7e57aa755f0c4d6e52a0ec5b20680bd64b8bc047e1d7ea190","observation_id":"f6ec994d-fc65-44a1-98f4-65bdf44d49dc","resolution":{"observed_at":"2026-08-05T23:07:11.998516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.16022","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16022","snapshot_observed_at":"2026-07-01T20:56:13.682832Z","title":"Nover: Incentive training for language models via verifier-free reinforcement learning","venue":null,"work_id":"ef12a6c5-1799-41e7-979c-ab5771a54e06","year":2025},"citing_paper":{"arxiv_id":"2602.12579","last_updated":"2026-05-22T13:13:23Z","snapshot_observed_at":"2026-07-06T22:45:44.135338Z","submitted_at":"2026-02-13T03:40:52Z","title":"VI-CuRL: Stabilizing Verifier-Independent RL Reasoning via Confidence-Guided Variance Reduction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-25T07:26:35.767179Z"},"links":{"cited_paper":"/paper/2505.16022","citing_paper":"/paper/2602.12579"},"observation_digest":"sha256:4b8e4b861af45e0e5d485f250b7dfa25ec70b609aa26da41ed2ce890b8e08a2c","observation_id":"4469da8b-6e88-44a5-9adf-d0538b71c63f","resolution":{"observed_at":"2026-05-25T07:26:41.681208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.16022","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16022","snapshot_observed_at":"2026-07-01T20:56:13.682832Z","title":"Nover: Incentive training for language models via verifier-free reinforcement learning","venue":null,"work_id":"ef12a6c5-1799-41e7-979c-ab5771a54e06","year":2025},"citing_paper":{"arxiv_id":"2606.01249","last_updated":"2026-06-17T04:44:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-31T14:04:51Z","title":"Trust Region On-Policy Distillation","version":3},"reference_index":167,"source":"arxiv_source","source_observed_at":"2026-06-28T17:38:50.313305Z"},"links":{"cited_paper":"/paper/2505.16022","citing_paper":"/paper/2606.01249"},"observation_digest":"sha256:5545d8c02397026e119e79e9d20b0224a96ee03d02e2a48e9deb855bd688140f","observation_id":"6ffb21a2-1c49-4a22-8db3-3f318b929b7a","resolution":{"observed_at":"2026-07-01T20:56:13.684119Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16022/citation-record","integrity":"/paper/2505.16022/integrity","json":"/paper/2505.16022/citation-record.json","paper":"/paper/2505.16022"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.728577Z","title":null,"venue":null,"work_id":"c397a4a1-116d-4b85-b513-8a04b3c445a5","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.916655Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:72983facd4099d7524309e061f9a0e431baed0be01746861d6be0e1b571f9ed5","observation_id":"e38655e2-22ec-4dcc-bbf9-2bf991fae332","resolution":{"observed_at":"2026-08-07T15:11:39.734158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.711087Z","title":null,"venue":null,"work_id":"db0310e7-37cf-4981-aff8-77f94ba20f1f","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.923803Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:5aee102fb31ddf527b6c461b7615951a07e5bdd413ccd28897f57fd8ca20ca52","observation_id":"7363fb43-c1b8-4ae4-8e84-d32a07263637","resolution":{"observed_at":"2026-08-07T15:11:39.717008Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.694465Z","title":null,"venue":null,"work_id":"790da21f-e28b-4c18-941c-dd9f94fc72a3","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.930797Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:137917737c5e5b2a582b25ffc83a266559723058c483c47a7fdc9fc2f37db027","observation_id":"4503dbf5-7d1b-4a31-b2e0-305228f4a265","resolution":{"observed_at":"2026-08-07T15:11:39.700356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T15:11:38.863910Z","title":"arXiv preprint arXiv:2403.05530","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.863910Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:916c7eb0c5829d8472f023748c57d6c4d5224b3661a9ad8e90c7b7ba4bdb9118","observation_id":"f92c90c3-6cc8-42ec-b56c-cfffb030fcce","resolution":{"observed_at":"2026-08-07T15:11:38.863910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.393549Z","title":null,"venue":null,"work_id":"9d0f2473-4619-4498-adc3-27d099492840","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.034724Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:dd1ea83c2fb541ccefe8941fe7a5c2a625c3138deec4b83a37ff90cd03cd7b47","observation_id":"18c85eae-aea0-4baf-ae9a-2631d6fd5228","resolution":{"observed_at":"2026-08-07T15:11:39.399693Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:11:38.876065Z","title":"CoRR, abs/2501.12948","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.876065Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:523effee59576b35c38fae0d90f7c1d5d45fbb4c4c7b7a5692a803de113b4fe8","observation_id":"e6ab8871-9e4d-4091-9412-14b014c82a74","resolution":{"observed_at":"2026-08-07T15:11:38.876065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-07T15:11:38.888451Z","title":"In The Twelfth International Conference on Learning Representa- tions, ICLR 2024, Vienna, Austria, May 7-11, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.888451Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:f092ef4c856dc5551e7a09e9992a89ee87412e5d83b05421975b3f903901d9cb","observation_id":"6e800ae2-3680-4a3a-a4ea-a5e031d68bc5","resolution":{"observed_at":"2026-08-07T15:11:38.888451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T15:11:38.902088Z","title":"CoRR, abs/2503.14476","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.902088Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:d919381b5a846589c41c3b07bd00daffc2fa60be47c601de32f12e5f104e77d6","observation_id":"474c2c7b-1cc0-44be-99c4-f81dfbc43091","resolution":{"observed_at":"2026-08-07T15:11:38.902088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.744470Z","title":"Final Deci- sion: Yes","venue":null,"work_id":"c43fc87a-f6f1-4a44-8b5f-49213df77d95","year":2023},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.909033Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:f11f999f840a946d5c112cd61c024b2e4a233108ee4ce23a2fece6828f402742","observation_id":"6bdabf17-656e-4ce4-ba84-0151ccf6f802","resolution":{"observed_at":"2026-08-07T15:11:39.751468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.675849Z","title":"She\" ...... Step 2: Translate each component individually. Subject:","venue":null,"work_id":"3bbc209d-d907-430e-a9ab-edaf73a4c3dc","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.938402Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:35b6bc1f56f2c637c5c1a3e84e3b4744b47818c86a3ff047ece6daf5c51217ae","observation_id":"85b9d61a-596b-490d-9b92-d4eae2430890","resolution":{"observed_at":"2026-08-07T15:11:39.682197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.658408Z","title":null,"venue":null,"work_id":"ad0b2303-cc14-4bbb-89d6-1501dd3ea41a","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.946260Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:8fb0c6bdc76a6f4f2d54052229a3aaac3a2d26e80fb3b4f4477539baecd9f6c4","observation_id":"df2f5239-f871-4cc1-b004-ffb767967b66","resolution":{"observed_at":"2026-08-07T15:11:39.663841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.642705Z","title":null,"venue":null,"work_id":"3333a0e8-7715-4afa-8b65-9a301692a3be","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.951677Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:d91e096bf109d6b499d5b570d46f73496c06a9e4e8ea2f13d04d37b2e2f1de8e","observation_id":"e9be971b-6687-4911-81d9-e81a98818249","resolution":{"observed_at":"2026-08-07T15:11:39.647672Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.624923Z","title":null,"venue":null,"work_id":"9060f163-45c0-48d0-b6d7-5e5d26b322e5","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.957374Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:46431dfff06ddcb0314e9762bf71357c8c5ff3d0c28306f92b6fc6c9d043b1f0","observation_id":"398a2f4a-1df3-4ab1-a688-47199a1aa3ed","resolution":{"observed_at":"2026-08-07T15:11:39.629822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.607689Z","title":"Here’s the step-by-step translation process:","venue":null,"work_id":"2fe87679-2643-4d54-9ca0-329b0072791a","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.962807Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:139b369bca894f211a25ccb1a31f8949e9f9c749e7157c038b64ff1fd0b59c34","observation_id":"3614f761-ebd6-4031-833f-ab2e138f88e0","resolution":{"observed_at":"2026-08-07T15:11:39.613081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.591064Z","title":"she\" ...... - Additional descriptive elements:","venue":null,"work_id":"d1243e82-f9f6-4677-87eb-cb224efa1341","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.967448Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:2845ad7b518c4819fa6698af22d25912a66517e284753f330fb6cd66d1026742","observation_id":"1066f1eb-434c-40bc-a8b9-be62f6c81bdd","resolution":{"observed_at":"2026-08-07T15:11:39.596642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.573610Z","title":"she\" ->","venue":null,"work_id":"cc1770f8-2bee-4174-881a-172a9061b14a","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.972545Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:86536b78ecfd76fc7e68211ffccf4515fcb3d30587d5cbbfb63239c7981d1d57","observation_id":"2479437b-f0fc-478b-9be3-ec7613afe9d9","resolution":{"observed_at":"2026-08-07T15:11:39.579980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.557141Z","title":null,"venue":null,"work_id":"46212df1-a373-41d3-87f4-5602f88e0942","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.979418Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:2e17f7a00383fea07963e3046842586fb66021ca3874f1b02a139e97c3d65f8c","observation_id":"188533bb-a108-4798-af76-92e923884dc3","resolution":{"observed_at":"2026-08-07T15:11:39.562792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.538458Z","title":null,"venue":null,"work_id":"40840bf6-55e4-4825-b3bb-59e454c18566","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.984010Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:31fc7f0268881a9f0df7a336c1a636dc9a54b9d3cd193e27eb03f4712b1d2176","observation_id":"01f3cf25-4470-42d4-b5b1-5a54290af2a5","resolution":{"observed_at":"2026-08-07T15:11:39.545244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.522360Z","title":null,"venue":null,"work_id":"46dc5ad9-2f54-4bfd-abb1-d44e404661b4","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.989428Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:b902d14116d1a0f3cf44262eefa332dab3e106024c61ad60d848db0c5da717e8","observation_id":"64681c72-08ff-4dc7-a930-dee0e7243922","resolution":{"observed_at":"2026-08-07T15:11:39.527429Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.496223Z","title":null,"venue":null,"work_id":"b17d5562-a7c5-4dd5-bc05-7f0a112b492d","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.995323Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:9fb75a1391a77cb77a530398736513af1d143514261a5429815e8d697b1b0e6f","observation_id":"cb9bb14f-2b9c-4b60-b051-e408adee9371","resolution":{"observed_at":"2026-08-07T15:11:39.509707Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.478975Z","title":"B is unaware of","venue":null,"work_id":"1817fb53-7820-4192-a0d0-bb4830984aba","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.000657Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:ed41775d81461e13dea6174c6df35f30a968e706d4348c7c6ec6bbfa45c376d8","observation_id":"b0cc18c3-31cd-4d8b-a3ab-1cf8f5b27c09","resolution":{"observed_at":"2026-08-07T15:11:39.484719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.461363Z","title":null,"venue":null,"work_id":"387f3caf-1fec-4ed7-881e-a0b6d4831d08","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.008091Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:09324f0e68781f56c359962a0ed46348e755396eb2d8b7f6f2cc4d2fd223e059","observation_id":"9c2a3398-34fb-4dec-afbc-a17b1bc72f5b","resolution":{"observed_at":"2026-08-07T15:11:39.468422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.443259Z","title":null,"venue":null,"work_id":"0c4dd255-67e8-49f3-8630-f003de3d917f","year":2023},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.015081Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:dc112d9722c00c65de422e4741459632b9406dab108a7a7fe02bc0d12ca746cf","observation_id":"922df4c7-0479-43da-bdf8-d58cca003acd","resolution":{"observed_at":"2026-08-07T15:11:39.449748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.426041Z","title":"B): When describing negative behaviors, the Social Story should never employ the first- person perspective to safeguard the dignity and esteem of the audience","venue":null,"work_id":"83320da0-319b-4a01-83bc-29ed16236257","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.020438Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:83d57891d26574c5fa9d21883f2c4b43570527ce52ef7be700910de212b0321e","observation_id":"709c78c5-4951-4a44-8d94-4806cdf97381","resolution":{"observed_at":"2026-08-07T15:11:39.431452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.410092Z","title":null,"venue":null,"work_id":"45e02aab-cd78-4fcf-b888-09bc7d6ffd86","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.027388Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:3c08ce20f172e2bd44d94a8c3ca6d642d4b9050e6d9775a3ee056fd5502b2062","observation_id":"06efe856-2da4-4707-9f98-3ad12552af26","resolution":{"observed_at":"2026-08-07T15:11:39.415626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.376387Z","title":"shouldn’t","venue":null,"work_id":"1c8ed080-d4cc-42a3-a8d5-1ec96519a79f","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.039670Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:601eb8d862e19a74cfe045dfa2025f63c008a9d86b7b92f9773e4402b0fbc788","observation_id":"4c1d0899-4796-4e24-9ded-bc208de13d13","resolution":{"observed_at":"2026-08-07T15:11:39.382599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.355685Z","title":"This pattern involves stating information from memory as-is","venue":null,"work_id":"c181e2ac-8df1-462f-a02f-800ac986503d","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.045977Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:fc86693f630d4505c85677b86da2df9dc7fd925d44bd0eee3acee9c0ee29a5ce","observation_id":"c793ea06-90c4-4516-8e31-ab0f25a66408","resolution":{"observed_at":"2026-08-07T15:11:39.363830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.335029Z","title":"This pattern involves creating a structured approach to solving com- plex problems","venue":null,"work_id":"4ad80a8f-737b-4654-96b6-8d12c78f84b4","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.053748Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:ccc4b913ea4a136c330a2beabae23d661239730c1bab76a1a87b339c38bd1830","observation_id":"18867395-3e6c-4db0-87e1-9583912fde36","resolution":{"observed_at":"2026-08-07T15:11:39.341318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.316281Z","title":"This pattern involves comprehen- sively covering various aspects or potential scenarios","venue":null,"work_id":"be2c0b97-a50d-46f0-9e12-afad0df3a7f3","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.060729Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:65d7663fbbea0c60a661637c9d18caf8d8f15384a06b2f9f63e123f22bf9d3fe","observation_id":"0b3f6fbe-84fc-4d8c-b650-254ba82b22f2","resolution":{"observed_at":"2026-08-07T15:11:39.321981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.300649Z","title":"This pattern in- volves reflecting on one’s own reasoning and making adjustments based on further consid- eration","venue":null,"work_id":"702bfd41-01d9-4bf3-bea6-9fb119d4b641","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.066869Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:58c82f603cb8981f37b4386c91050dbf0a6cd987c88d4fcc707dc5d4412cb15d","observation_id":"83490bf5-e812-483a-8ec4-8f51e88c9b2c","resolution":{"observed_at":"2026-08-07T15:11:39.306510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.284692Z","title":"This pat- tern involves making conditional statements to explore potential scenarios or outcomes","venue":null,"work_id":"41b772f4-88df-4a0b-99f5-2f60a1b72254","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.074253Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:7fe3e3771427c5b1050c106b9a03d66da9041a853594d99090191ddf47386241","observation_id":"11d5c80e-a868-4546-b1ea-09e81183e6c9","resolution":{"observed_at":"2026-08-07T15:11:39.289591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.225209Z","title":"This pattern involves explaining how one factor leads to or influences another","venue":null,"work_id":"f78157a9-d97e-4cf2-8ffe-fb0dd7123072","year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:39.079082Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:aad37dd5cdf0741607fbd2746d76f91e813ba15c234695be1712261f9f964fe0","observation_id":"02578f35-6bb9-47e0-84a8-2e28189cc994","resolution":{"observed_at":"2026-08-07T15:11:39.259225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-07T15:11:38.842207Z","title":"CoRR, abs/1606.06565","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.842207Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:0eab172aa81bb12392176eaac13742d38a000c6bf165afe9e652f38047931f0c","observation_id":"10c68ddc-efde-4d5c-9278-21415404f4f0","resolution":{"observed_at":"2026-08-07T15:11:38.842207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T15:11:38.857258Z","title":"CoRR, abs/2110.14168","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.857258Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:882fa2ef3259b8e2b39942226f31da6c5e85952e17ce2794ab192b13e3e66dea","observation_id":"457d0f23-d4d2-48ae-a0c4-3e99f7a1d3a5","resolution":{"observed_at":"2026-08-07T15:11:38.857258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.761942Z","title":"In Proceed- ings of the 2023 Conference on Empirical Methods in Natural Language Processing, EMNLP 2023, Sin- gapore, December 6-10, 2023, pages 14397–14413","venue":null,"work_id":"ed5ecbcc-e784-47ad-bf86-6a3e7952b5ce","year":2023},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.881872Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:ed9a1ef9e5867e1669cd472b78016d7a003bae69392b325f9b2ffce1007ae674","observation_id":"520afe94-1318-48e1-bbd3-57f840ce1af8","resolution":{"observed_at":"2026-08-07T15:11:39.769140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17161","last_updated":"2025-05-26T17:16:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-28T18:59:44Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17161","snapshot_observed_at":"2026-08-07T15:11:38.851629Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.851629Z"},"links":{"cited_paper":"/paper/2501.17161","citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:eb7938ddc13b89e476ef27a83e3366e319dab223a47b4d6d28c5b6488ba82446","observation_id":"8f0eb2ec-d169-4b86-b4fa-e434a3be0dab","resolution":{"observed_at":"2026-08-07T15:11:38.851629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:11:39.780320Z","title":"In The Thirteenth International Con- ference on Learning Representations, ICLR 2025, Singapore, April 24-28, 2025","venue":null,"work_id":"14cc7c99-492f-4967-933b-935174f74fb4","year":2025},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.870524Z"},"links":{"citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:73bd37ec93e3ff2bc78508689c45e7652e83a111e5c5f3b856bcd8abf2b083b1","observation_id":"90067c4b-4a14-4235-801b-33d924d99e97","resolution":{"observed_at":"2026-08-07T15:11:39.787142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T15:11:38.895169Z","title":"Siya Qi, Yulan He, and Zheng Yuan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning","version":2},"reference_index":3824,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:38.895169Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.16022"},"observation_digest":"sha256:489b47cd7b3f3314d50f09fa10602b5dc8bd2632efb764175d8fb630b2a95157","observation_id":"b9c282d7-bfff-49f3-8a96-bee8c219855f","resolution":{"observed_at":"2026-08-07T15:11:38.895169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.16022","last_updated":"2025-09-02T20:28:53Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:06:08.884956Z","submitted_at":"2025-05-21T21:12:35Z","title":"NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 3 inbound Pith citation observations for arXiv:2505.16022."}