{"as_of":"2026-08-11T01:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:723a5b734e75f6c8e6307f7efdf7ca9fe33a8c7dad13baec6defcac66214bc54","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T19:43:11.384787Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.05341/citation-record","integrity":"/paper/2604.05341/integrity","json":"/paper/2604.05341/citation-record.json","paper":"/paper/2604.05341"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the web conference 2021","venue":null,"work_id":"8898242d-fa96-4ad7-868b-8d0acd6e241d","year":2021},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:a21f6e87adc0f31c95a2e9915313881ed9bb74bfcbb12fad86f8bcdd6dfef75d","observation_id":"7bc2572b-19cd-4e3b-9d75-a81b898dc769","resolution":{"observed_at":"2026-05-16T04:10:36.326847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07065","last_updated":"2025-03-10T08:48:50Z","snapshot_observed_at":"2026-08-07T17:17:34.989308Z","submitted_at":"2025-03-10T08:48:50Z","title":"Boosting the Generalization and Reasoning of Vision Language Models with Curriculum Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2503.07065","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.07065","snapshot_observed_at":"2026-07-04T15:09:54.970421Z","title":"arXiv preprint arXiv:2503.07065 , year=","venue":null,"work_id":"45c3a58c-d62f-4f0b-84d6-98d7c29563e4","year":2025},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/2503.07065","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:a58e5a9fe76041ae483611d6cf5b907998ca1f7e9facb0cd86561dc0de22f9c4","observation_id":"b4429a10-cffb-411e-9217-1b9d4f2b86c7","resolution":{"observed_at":"2026-05-10T22:35:49.933305Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":"2304.06767","doi":"10.48550/arxiv.2304.06767","metadata_source":"pith","pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","venue":"cs.LG","work_id":"aeaccc45-69c1-4642-b5f9-72343ebbf9fc","year":2023},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:65c21138bb8397d59ff63e2f847d2f20af37055105999059ccac711b7add61b3","observation_id":"43f19f50-c218-4cce-b013-ff3c2ab3ec09","resolution":{"observed_at":"2026-05-18T00:46:57.049485Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07863","last_updated":"2024-11-12T11:18:43Z","snapshot_observed_at":"2026-08-07T08:32:00.916309Z","submitted_at":"2024-05-13T15:50:39Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","version":3},"cited_work":{"arxiv_id":"2405.07863","doi":"10.48550/arxiv.2405.07863","metadata_source":"pith","pith_arxiv_id":"2405.07863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","venue":"cs.LG","work_id":"c7ff0d97-6f12-4146-bf55-c37c42517893","year":2024},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/2405.07863","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:298cbd34cde8269b2013065f6d602c1f441be53e7858c49ad74b24b624cb45bc","observation_id":"d62274a1-a918-45c8-bab5-830d720f1533","resolution":{"observed_at":"2026-05-17T16:57:04.894966Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: 15th EACL 2017 Software Demonstrations","venue":null,"work_id":"0d7ffe1b-a260-499b-ad82-1e2926bcc39b","year":2017},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:ea85d770b9344d428e4f471c3f09b25bd833fad48b56dda28b03589ffb9c75af","observation_id":"e9f2cd82-64c3-4840-9e03-c2a77abffb7e","resolution":{"observed_at":"2026-05-16T04:10:36.316235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:ccf4046131de5f4777a4c0cff7f457413c60a95443f3a98898ee4dc7abd84a35","observation_id":"fa89d494-280d-4943-a660-e72e9fc3ef67","resolution":{"observed_at":"2026-05-10T22:35:49.887372Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18629","last_updated":"2024-06-26T17:43:06Z","snapshot_observed_at":"2026-08-06T00:24:52.274888Z","submitted_at":"2024-06-26T17:43:06Z","title":"Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs","version":1},"cited_work":{"arxiv_id":"2406.18629","doi":"10.48550/arxiv.2406.18629","metadata_source":"pith","pith_arxiv_id":"2406.18629","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs","venue":"cs.LG","work_id":"c36a9ddb-5e98-40df-a3c4-ec831be19023","year":2024},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/2406.18629","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:f482b8e37c8a51244244757834b44ccd9a43fdcae6c2e44716e2ec8cabb5926d","observation_id":"a7b9b8bd-b4c5-4748-82ce-a4918d724865","resolution":{"observed_at":"2026-05-18T23:58:29.262663Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Journal of Intelligent Information Systems 57(1), 147–170 (2021)","venue":null,"work_id":"6b784073-6b15-4cef-abde-b28c9d83868b","year":2021},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:01baf1dfeb9949e62a4a68c279e1459ace3c41551917e221ce9a3dd28b058bff","observation_id":"620615f1-a5f0-4acc-99b4-1fdac10d21a5","resolution":{"observed_at":"2026-05-16T04:10:36.319842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.11601","last_updated":"2021-06-05T01:19:31Z","snapshot_observed_at":"2026-08-09T20:17:49.493527Z","submitted_at":"2021-05-25T01:42:47Z","title":"Personalized Transformer for Explainable Recommendation","version":2},"cited_work":{"arxiv_id":"2105.11601","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.11601","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2105.11601","venue":null,"work_id":"48460c1a-1570-49e4-9a69-7dc5b6d03410","year":2021},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/2105.11601","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:7b3c1c9483d7a11e0a145a31de71a243ee584dc1cc4318791df93920f90cab67","observation_id":"afe36e7a-9403-4b79-b193-587f4ac58fa5","resolution":{"observed_at":"2026-05-10T22:35:49.911157Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 40th International ACM SIGIR conference on Research and Development in Information Retrieval","venue":null,"work_id":"73dafffd-9606-4e76-8398-a2ed7714af5e","year":2017},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:987f502c6e9fc118f684e9a46cf44c3dbdae4c3548039ce3fadf45ba045db1f0","observation_id":"25456483-709f-4e48-a126-912370abe6b2","resolution":{"observed_at":"2026-05-16T04:10:36.312703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the ACM on Web Conference 2025","venue":null,"work_id":"bb779f83-3855-409d-9861-ed9a8c21d46b","year":2025},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:016052d4b49a314ecfe2fe57ca4845e44bf7367414e97ab01afee018b082934d","observation_id":"cf5071c3-65d7-407c-bcdf-d914f86aa23b","resolution":{"observed_at":"2026-05-16T04:10:36.135892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T23:26:37.769285Z","title":"In: Text sum- marization branches out","venue":null,"work_id":"6a7d322e-115c-4fc4-aade-0e8f42766cde","year":2004},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:b1741a0445e87abeaa3e766839f5daf1af3a025e3e89442ffd1eecc09fef6881","observation_id":"28caded2-27ac-40ba-a502-817c533b36ca","resolution":{"observed_at":"2026-05-16T04:10:36.123453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:02:46.456041Z","title":null,"venue":null,"work_id":"94ec2b93-6e25-460d-bd49-1375423b2697","year":2024},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:e0f70c3e6e19daf0a297a656f0fb7841c60a05c11659c348841b6a7fb589acc2","observation_id":"3822aa4f-684f-4cd7-9bdc-de238e7f9838","resolution":{"observed_at":"2026-05-16T04:10:36.323337Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02377","last_updated":"2024-09-22T14:50:52Z","snapshot_observed_at":"2026-08-10T10:16:53.297556Z","submitted_at":"2024-06-04T14:55:14Z","title":"XRec: Large Language Models for Explainable Recommendation","version":2},"cited_work":{"arxiv_id":"2406.02377","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02377","snapshot_observed_at":"2026-06-28T18:42:29.245101Z","title":"arXiv preprint arXiv:2406.02377 (2024)","venue":null,"work_id":"eaeb6ad9-200a-4a47-b452-410470a594f1","year":2024},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/2406.02377","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:bd18e1372848b3f8c1f12e51170e665b6d3226c03de301682f861710eb0cc9e5","observation_id":"e654b4ac-c65c-4b39-bca0-85711697b685","resolution":{"observed_at":"2026-05-10T22:35:49.867266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T15:13:54.263480Z","title":"Advances in neural information processing sys- tems35, 27730–27744 (2022)","venue":null,"work_id":"c53ae433-6f41-4e8b-ac2a-615f9caf8568","year":2022},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:7d2bec1f69805fe25ad7128fcda2629e84e1c60ade60c0b07c20fab5fe3f048c","observation_id":"8321f09b-99e8-4493-9079-faf2b5b5d939","resolution":{"observed_at":"2026-05-16T04:12:16.853622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T23:26:37.727573Z","title":"In: Proceedings of the 40th annual meeting of the Association for Computational Linguistics","venue":null,"work_id":"34cddaca-0c49-451c-a205-3beaa9ccab65","year":2002},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:3c3be69f5cdf72484e1612f3036998c1dd7bd119f5601f818e47b514f315a352","observation_id":"4da0d7a1-70af-4232-a148-20da46cd5964","resolution":{"observed_at":"2026-05-16T04:10:36.127991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.14459","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T18:42:29.310688Z","title":"arXiv preprint arXiv:2411.14459 (2024)","venue":null,"work_id":"b4c7017e-d412-4259-8455-f9656bae2caa","year":2024},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:0b36a42c85ddcc5112d20b50678b084e1240f19908ae9fe0d31654e3ec776932","observation_id":"2a96711b-61a1-44e4-8ada-fb4cb89e06dc","resolution":{"observed_at":"2026-05-10T22:35:49.947625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ECAI 2023, pp","venue":null,"work_id":"99e30f9f-7484-481b-bd1d-5f5840d3381a","year":2023},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:1d791f81218fb4deb2257ca3f8acab8862917e6dad1e9a285fd94408081bce73","observation_id":"e584717a-6e37-4267-a7b5-2b1012a0e03d","resolution":{"observed_at":"2026-05-16T04:10:36.309005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:9763fc11e838f1818837470b425dfde96ca42d2c1dc5005ad408f45d25fdf98b","observation_id":"1b5bd6eb-8abf-4a0b-abee-87a1eadf18ad","resolution":{"observed_at":"2026-05-10T22:35:49.917531Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 29th ACM International Conference on Information & Knowledge Management","venue":null,"work_id":"d5262541-8ed7-40a7-9502-fa8b53d26459","year":2020},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:e7b2b1de1469a6fa45b7df2ce463f028b25c35d177bfd8a08934c083c7f0db24","observation_id":"29d26555-ae24-4073-af78-5dc3ff9bf89c","resolution":{"observed_at":"2026-05-16T04:10:36.301729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05749","last_updated":"2024-05-28T23:25:15Z","snapshot_observed_at":"2026-08-10T05:17:53.947932Z","submitted_at":"2024-02-08T15:33:09Z","title":"Generalized Preference Optimization: A Unified Approach to Offline Alignment","version":2},"cited_work":{"arxiv_id":"2402.05749","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05749","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"D., Zheng, Z., Calandriello, D., Munos, R., Rowland, M., Richemond, P","venue":null,"work_id":"06aa59f7-1662-4884-a7e5-971d50ed9fa1","year":2024},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/2402.05749","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:5b387fbbe94939b004c4c0d0251a30d341c66fce131e1b99176edd44652a8f24","observation_id":"5f28af2f-0126-4227-86bd-402bdf9fda61","resolution":{"observed_at":"2026-05-10T22:35:49.941183Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GitHub repository (2023)","venue":null,"work_id":"89951eb2-e957-479d-9955-540f85914c1c","year":2023},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:f77277797e037ef27b8a0b39d1a133e4c7938a517d72d92c37018344f236d554","observation_id":"9e31c1e7-4c88-4443-92d2-7b7194d03ac3","resolution":{"observed_at":"2026-05-16T04:10:36.298125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18449","last_updated":"2025-12-01T00:16:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-25T18:45:04Z","title":"SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution","version":2},"cited_work":{"arxiv_id":"2502.18449","doi":"10.48550/arxiv.2502.18449","metadata_source":"pith","pith_arxiv_id":"2502.18449","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution","venue":"cs.SE","work_id":"4b93fb93-87c9-40fe-84d0-d7ecb4e11bed","year":2025},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/2502.18449","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:67d8315edf7fd44a10d20a8e3c5f7e8c450e5843e95d7913c1709f88dd8aa868","observation_id":"e80d4470-ac55-427d-8ae5-df1f688e5349","resolution":{"observed_at":"2026-05-15T10:27:56.991478Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-04T12:32:53.090165Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.14768","doi":"10.48550/arxiv.2502.14768","metadata_source":"pith","pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","venue":"cs.CL","work_id":"b1f42628-30b7-4593-80ff-813523035c23","year":2025},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:9c130ccdf0118694aac9a07f47978c16008c9064afad264d74fb4892700d150c","observation_id":"1aab8855-5c8b-4f72-8c53-7fe18732c33b","resolution":{"observed_at":"2026-05-16T20:57:51.136140Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T02:41:50.406214Z","title":"Advances in neural information processing systems36, 11809–11822 (2023)","venue":null,"work_id":"434e6b89-73c3-4e65-8178-3ab929fe2cc1","year":2023},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:bcce2ebbc0dd260b87b37fee4335639fc102f3b58ba005c9238c59424c2f64fb","observation_id":"7eeaa9aa-cfff-4351-adb3-f86b28bcf26c","resolution":{"observed_at":"2026-05-16T04:10:36.294760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceed- ings of the 37th international ACM SIGIR conference on Research & development in information retrieval","venue":null,"work_id":"f772e66c-1200-4202-8696-4a1580be9026","year":2014},"citing_paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T19:43:11.384787Z"},"links":{"citing_paper":"/paper/2604.05341"},"observation_digest":"sha256:18ccbd935d16b2f0a724997c9e8486094981366c7ad4731cce28d2c89696ed1c","observation_id":"fef02a89-68e7-4225-b27f-dd461f5446af","resolution":{"observed_at":"2026-05-16T04:10:36.305379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.05341","last_updated":"2026-04-07T02:25:36Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T02:25:36Z","title":"Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":8,"parse_uncertain":0,"unresolved":1,"verified_exact":4,"verified_fuzzy":13},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2604.05341."}