{"as_of":"2026-08-14T01:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3ae60a551a179aff5c2f5794e4ece8e3fe36e7b10210199bddff67bd035184f","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T15:11:27.420642Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.17458/citation-record","integrity":"/paper/2605.17458/integrity","json":"/paper/2605.17458/citation-record.json","paper":"/paper/2605.17458"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ACM Transactions on Intelligent Systems and Technology (TIST) , volume=","venue":null,"work_id":"915042ea-828c-4222-a36c-42940b0235db","year":2022},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:6bef39e28b8e9fcdc0d1b011fcf4648d4cc0668e5a3f500085ae0de01bb19d7e","observation_id":"a9fedcd5-885f-4b89-9401-fb3949f8fc33","resolution":{"observed_at":"2026-05-20T15:13:25.587288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08377","last_updated":"2023-10-09T15:52:30Z","snapshot_observed_at":"2026-08-13T11:42:49.705757Z","submitted_at":"2023-05-15T06:24:45Z","title":"Text Classification via Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.08377","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.08377","snapshot_observed_at":"2026-06-29T15:43:32.875577Z","title":"InAdvances in Information Retrieval: 42nd European Conference on IR Research, ECIR 2020, Lisbon, Portugal, April 14–17, 2020, Proceedings, Part II 42, pages 359–366","venue":null,"work_id":"d2160776-055f-47fa-93d8-f18826f706a3","year":2023},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2305.08377","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:289173bcceec57dd8a5dd471144372d94f1964cfde5e0e90ae88139199df5cec","observation_id":"5c22b0ff-da08-49cf-ba32-4440e293b21b","resolution":{"observed_at":"2026-05-20T15:13:24.951372Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"fa032de2-6682-4b20-b2b3-6ed8a1905242","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:df74c772cc2f989a6ff66315129eb60edfb010206a11148daf185d24adee43d8","observation_id":"1ec1cfed-debd-4058-9314-ec0097dafa5f","resolution":{"observed_at":"2026-05-20T15:13:25.589496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"b693dba3-ae66-4620-ab4d-21786f7e904e","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:cfcd45490ad7be3e340459cbf4b778feb656c0e5925c85c286dff472c729826c","observation_id":"c24bfd67-cff3-4acc-ada6-3799022325d8","resolution":{"observed_at":"2026-05-20T15:13:25.685015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:47:56.151399Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"f69d9f4f-b804-4c65-835e-f340310c7748","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:b834874d206db245700c05e9773b52d2539214384467ecfcf4aea498f1bed362","observation_id":"80637b89-26ae-434c-8530-9107c17bd162","resolution":{"observed_at":"2026-05-20T15:13:25.680903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:26.096579Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"c25e8154-fab2-455c-8a26-56e40aed5d2b","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:610683c3a4fbb91d393ea0a7570561ba6a5a7c5239a362daf134d09a30fa0ad6","observation_id":"a02fdab5-897a-4da5-ac31-337df667b012","resolution":{"observed_at":"2026-05-20T15:13:25.682953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07863","last_updated":"2024-11-12T11:18:43Z","snapshot_observed_at":"2026-08-13T14:44:02.569922Z","submitted_at":"2024-05-13T15:50:39Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","version":3},"cited_work":{"arxiv_id":"2405.07863","doi":"10.48550/arxiv.2405.07863","metadata_source":"pith","pith_arxiv_id":"2405.07863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","venue":"cs.LG","work_id":"c7ff0d97-6f12-4146-bf55-c37c42517893","year":2024},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2405.07863","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:30ec9d21a54be6e6bf42eea7546d4f991359b2bb28146a00e9830eed96e2be1b","observation_id":"9b13c925-b33e-4547-870a-7ac46b865433","resolution":{"observed_at":"2026-05-20T15:13:24.960452Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.23349","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.23349 , year=","venue":null,"work_id":"dac89795-b7ab-480d-8baf-d70db0475fb1","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:4820d1017b008dfb75226ea79f6b8d34cb2da4ef5c3bd9acf153188f00493a57","observation_id":"d7288a0e-8e87-45c6-9e52-3a4533071513","resolution":{"observed_at":"2026-05-20T15:13:25.003198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":"2204.05862","doi":"10.1016/j.respol.2005.01.014","metadata_source":"pith","pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","venue":"cs.CL","work_id":"a1f2574b-a899-4713-be60-c87ba332656c","year":2022},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:45928fd0e2c3d56e6616b50312252f2221977570a8f6e7328a29956cc1b73dc1","observation_id":"10ea430b-06fd-4acc-bec5-679ffd246169","resolution":{"observed_at":"2026-05-20T15:13:25.006116Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":"1907.11692","doi":"10.1007/s10489-02203627-9","metadata_source":"pith","pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","venue":"cs.CL","work_id":"41fe12c4-e538-4890-a244-480650ed3078","year":2019},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:f1a473d458d992b16038724b84ae76e51a97d16fc1a4ab74e3ffaff7ffdf93a8","observation_id":"012cbd38-7fc4-4258-b46a-b3141717f4c1","resolution":{"observed_at":"2026-05-20T15:13:25.000060Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:ffb519bacca6b489e0c854e85ac220beda7e111fd97f98338ed6d7e23d8a5ab5","observation_id":"9d765d9c-add7-4e97-aa74-572e5aa3775e","resolution":{"observed_at":"2026-05-20T15:13:24.969131Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T04:53:19.614635Z","title":"Proceedings of the IEEE international conference on computer vision , pages=","venue":null,"work_id":"de7578a6-7260-4c6a-a4ec-9223057be452","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:f905e78a9e1f75bf276e2cd00ab3c6eafc802a3a852f30dc0ff8df862fefe759","observation_id":"d10e3172-8a52-4dfc-a9f6-d7ec72f70bca","resolution":{"observed_at":"2026-05-20T15:13:25.671948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"3a8e07fe-43fe-491e-937d-9a4cfab2bf02","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:78499187751dabb0c6fe7e83d509b94462525352035e51c85b25697a213023f3","observation_id":"624bd122-18b4-4191-accd-761bd2a20e88","resolution":{"observed_at":"2026-05-20T15:13:25.674054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T15:16:18.971970Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"4a77e424-cf16-4c16-8d94-2ee44db893d1","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:12ced9c0b1ad7f8482ab8276e8c749f9bc8085d3248eff096dfdaa8180d986c3","observation_id":"f895def9-9d77-415d-80ac-53c514cd8ebe","resolution":{"observed_at":"2026-05-20T15:13:25.664877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Transactions on Neural Networks and Learning Systems , volume=","venue":null,"work_id":"7ee00a46-7b8e-40b9-84b2-6bdd1cba4b7d","year":2022},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:a1d83a9654c8253c7bce867abc72b4e0d481e5af82dfe0712ded94c4a6e04a61","observation_id":"c365df9d-b4b1-4af0-8059-92d5f2883edd","resolution":{"observed_at":"2026-05-20T15:13:25.667050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conference on robot learning , pages=","venue":null,"work_id":"d5d0a7ea-1826-4a1f-bac2-22803cebc426","year":2022},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:85712c62f1974ce79e1fa4bab5cb5a0f4a0a498f36f6274699655cb09cb90c57","observation_id":"9402ece9-f7a3-4897-962c-1270472b8a92","resolution":{"observed_at":"2026-05-20T15:13:25.662408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T00:51:39.940531Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"079cd7df-6804-4aa8-860d-4ba9ec3350c6","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:7398c5b44795d7e8253b97a87553db5af6085f45bc94f329a990c7337c9c69e3","observation_id":"fa5a7ed4-633c-4ef9-b3b5-6aacde0ecc8f","resolution":{"observed_at":"2026-05-20T15:13:25.669556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"a2da3355-2cac-4933-b871-7ced5dbaea6b","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:d91c517be145d76f662553c4ed6de5805ef9848754a9fdc944363844bdeeecfb","observation_id":"d16bec14-85bc-43f0-b0c9-76cd313e0301","resolution":{"observed_at":"2026-05-20T15:13:25.676202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Transactions on Instrumentation and Measurement , year=","venue":null,"work_id":"8d7f2137-2d95-4224-baf0-499d19e972fb","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:886d886dd6d1982d595de82b65c9877496d6f57ce88bb3904a390002d4ed73f0","observation_id":"7971edb9-0539-41e6-901f-60b34b10ef65","resolution":{"observed_at":"2026-05-20T15:13:25.646925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-11T04:34:07.318549Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":"1909.08593","doi":"10.48550/arxiv.1909.08593","metadata_source":"pith","pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fine-Tuning Language Models from Human Preferences","venue":"cs.CL","work_id":"4f54aad1-f3b6-404f-b9c7-e21ba0a33b99","year":2019},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:13ea84178b8b39078d65b3f5930ee211fd7b1b4abefd8263ff9bf456ff3e33eb","observation_id":"31b96833-b075-4a68-bbbb-d445b86f4158","resolution":{"observed_at":"2026-05-20T15:13:24.978579Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-08T21:08:07.78032+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T21:08:07.78032+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 IEEE/ACM International Workshop on Deep Learning for Testing and Testing for Deep Learning (DeepTest) , pages=","venue":null,"work_id":"a4ed73b1-15e9-48b5-95ba-c9dc4bcfbb7b","year":2025},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:5eef280e002c3bef22dd54a0e4d51d8bbd4fef3b0c3c75b68bcda6526df1f833","observation_id":"bc06323c-f7c4-4934-8bd5-ded631f70959","resolution":{"observed_at":"2026-05-20T15:13:25.649461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preference learning , pages=","venue":null,"work_id":"981b85a7-9272-4cbd-9679-7e19ce45bbaa","year":2010},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:60b2e322c66759d45a9295b001b1997bc8c5cce7464b7ab444f636d6d3812f69","observation_id":"fe6cba06-e4ff-4dc1-8acc-ad59bddcf975","resolution":{"observed_at":"2026-05-20T15:13:25.642691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 IEEE International Conference on Big Data (Big Data) , pages=","venue":null,"work_id":"7814f5e6-cde1-42ce-a53d-f151bacd7b11","year":2021},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:61c0d687d39ca17cebb571538d438e132b7bb2acc0bb9470f9164a298a8eb4d4","observation_id":"90b08339-ce5d-4041-b8c6-325a449b5aa5","resolution":{"observed_at":"2026-05-20T15:13:25.640446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"cc91d1a6-b0f0-4565-a7fe-2eec8a6f3ca0","year":2023},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:049c7707a679a263281062c1bde2e22fa09a345963e2d78f12d848b5cb4a934a","observation_id":"64a83656-d067-46e3-b9ac-56a5d0edae43","resolution":{"observed_at":"2026-05-20T15:13:25.644666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2013 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":"1fa75c7c-fb00-4284-bca7-d57bef84d275","year":2013},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:b5ac35b5ce8297f92581ad466432c56853f11d1fd556589de5ea0992a9b8f294","observation_id":"bf36eb17-74c9-4736-a62f-643be0d2bfd3","resolution":{"observed_at":"2026-05-20T15:13:25.652023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02666","last_updated":"2025-08-29T15:47:44Z","snapshot_observed_at":"2026-08-07T15:56:21.317990Z","submitted_at":"2025-05-05T14:15:02Z","title":"A Survey on Progress in LLM Alignment from the Perspective of Reward Design","version":2},"cited_work":{"arxiv_id":"2505.02666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02666","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.02666 , year=","venue":null,"work_id":"3b8db2d1-37b0-4908-95fe-d34dee67ae60","year":2025},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2505.02666","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:c26e6a5c5cb8f01ef3c54e013982f707b4788175cd91c7e44e23b9c3c647b910","observation_id":"a4536758-faa6-4355-8e41-137def431398","resolution":{"observed_at":"2026-05-20T15:13:24.997088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Meta-radiology , volume=","venue":null,"work_id":"f430c5ab-d56a-4154-a2ba-8b738515a584","year":2023},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:0699eaa271eb507970f6be7c63a400f7967b432cd78406679127c4b79f9e3589","observation_id":"093818c7-712a-4e6c-b676-5150f60c4e46","resolution":{"observed_at":"2026-05-20T15:13:25.633663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T12:12:25.183413Z","title":"Transactions of the Association for Computational Linguistics , volume=","venue":null,"work_id":"01d04f92-7a33-4b30-a653-300bd9707737","year":2019},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:82cd9380d31eaff4841e25d398184e911706027c3bab7c1e14119ec6345d4271","observation_id":"7f6d0971-12b5-448b-882a-d9e4bac8ea56","resolution":{"observed_at":"2026-05-20T15:13:25.635906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the third international workshop on paraphrasing (IWP2005) , year=","venue":null,"work_id":"212456f6-99a6-42f6-abbd-26ccf8a24dfa","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:a569f53ee42ba0aed9903556e7462fd125a7a7648de99ad7bb884217330a7170","observation_id":"1d2de6e3-9ac4-4b9e-b162-ae723f6a3d70","resolution":{"observed_at":"2026-05-20T15:13:25.629419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T05:30:44.020246Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"849d03bd-61d3-4a76-a1fa-fa0b2656f046","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:89aac1af1d4643d188104d673199d4e7e7907c4746f783fb62f9fb120b380434","observation_id":"43fe05e4-725e-493c-bc31-52d9006a94e7","resolution":{"observed_at":"2026-05-20T15:13:25.627089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2018 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":"41d6b3a9-4717-4f75-b6cc-147dfc5ad0e6","year":2018},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:87e44b2416ea2b8d9c9ac5359ffdd7cc6db9d30a070eb70952c22724a434194d","observation_id":"8ae1e34f-41fa-47ca-a4a4-d277e250d077","resolution":{"observed_at":"2026-05-20T15:13:25.631613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"3a6d9773-5bb5-42ae-8a2a-81d5ed56da2e","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:b11dda5d1217063240d9f27a1375c471556df86f2010760c30aaf4e3b5892e91","observation_id":"65443843-4f7c-43ca-8f83-4642aadd71d3","resolution":{"observed_at":"2026-05-20T15:13:25.638324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2020 IEEE 27th International Conference on Software Analysis, Evolution and Reengineering (SANER) , pages=","venue":null,"work_id":"696ac1d4-c957-4973-943d-74cac89b94af","year":2020},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:e7166bafb8098d4637352cf7e51065c940d10e07efe1a7792b4ec8c487e3253d","observation_id":"5af75729-1ec7-4afb-9170-96e70514c5e3","resolution":{"observed_at":"2026-05-20T15:13:25.659691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:56:29.221994Z","title":null,"venue":null,"work_id":"8d56cd15-b543-4ffe-84e6-e4e3e88c7232","year":2019},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:375ce9b5da96cd25a92ed2a9f6e7f6e6d803167497ee785e522f30e7936fd5d8","observation_id":"1becff8f-9dd0-4366-bdd2-412d320427cb","resolution":{"observed_at":"2026-05-20T15:13:25.678577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":"2205.01068","doi":"10.48550/arxiv.2205.01068","metadata_source":"pith","pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-07-11T03:37:45.880117Z","title":"OPT: Open Pre-trained Transformer Language Models","venue":"cs.CL","work_id":"d7ff3b21-1fff-4cf4-952a-4714e3ef2307","year":2022},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:6c0bcf55bcdaf32922a1a952ef92740bfaef086c22bd435bd36bcdeded3ff0ea","observation_id":"09f4800a-8d6d-4d61-b5aa-ac4ac1bdcfee","resolution":{"observed_at":"2026-05-20T15:13:24.984212Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:26.165794Z","title":"Journal of machine learning research , volume=","venue":null,"work_id":"d1b76c93-2608-4f12-9b0e-1c71236cad23","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:36d04f5a61a947cd8fcaff751f6f4cd150d8b4b7c80a5e54d4977d3ce7eb6775","observation_id":"8552a3f6-10a2-4eba-9e8d-713e246efb5b","resolution":{"observed_at":"2026-05-20T15:13:25.622406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08155","last_updated":"2020-09-18T15:38:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-19T13:09:07Z","title":"CodeBERT: A Pre-Trained Model for Programming and Natural Languages","version":4},"cited_work":{"arxiv_id":"2002.08155","doi":"10.48550/arxiv.2002.08155","metadata_source":"pith","pith_arxiv_id":"2002.08155","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CodeBERT: A Pre-Trained Model for Programming and Natural Languages","venue":"cs.CL","work_id":"abd850e7-0a69-416d-b504-be33a55a8399","year":2020},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2002.08155","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:38aa997d5eeec430843006b65a34a42d5f5dbc7609db795df087d9cb8d613e1d","observation_id":"1b2b73dc-e2ef-40c1-b990-5f5e56378f59","resolution":{"observed_at":"2026-05-20T15:13:24.993587Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00859","last_updated":"2021-09-02T12:21:06Z","snapshot_observed_at":"2026-08-12T06:14:58.605732Z","submitted_at":"2021-09-02T12:21:06Z","title":"CodeT5: Identifier-aware Unified Pre-trained Encoder-Decoder Models for Code Understanding and Generation","version":1},"cited_work":{"arxiv_id":"2109.00859","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.00859","snapshot_observed_at":"2026-07-05T07:20:46.356842Z","title":"CodeT5: Identifier-aware Unified Pre-trained Encoder-Decoder Models for Code Understanding and Generation","venue":"cs.CL","work_id":"23c48a40-bc03-438f-b646-a6c8e3058782","year":2021},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2109.00859","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:9b10ee9037c2e09df9ce7601c0e648d5b31ea87baf75a61fc77d85c3d33435d0","observation_id":"cbcef752-5ebc-4f9a-bbf7-ceb32ddc8bc9","resolution":{"observed_at":"2026-05-20T15:13:24.987411Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2023 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":"318d286d-287b-4bda-98f5-af1f198ce062","year":2023},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:05927a96dd85fed3552deebebea0bff6eb41560095c14ccb61a7395bc4019636","observation_id":"d877232b-af3a-468a-97b2-e813e785673e","resolution":{"observed_at":"2026-05-20T15:13:25.619962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13474","last_updated":"2023-02-27T21:26:48Z","snapshot_observed_at":"2026-08-13T14:36:56.609471Z","submitted_at":"2022-03-25T06:55:15Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","version":5},"cited_work":{"arxiv_id":"2203.13474","doi":"10.48550/arxiv.2203.13474","metadata_source":"pith","pith_arxiv_id":"2203.13474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","venue":"cs.LG","work_id":"892a192d-205a-4079-a807-00d7874b392e","year":2022},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2203.13474","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:87228f10068c8af6ffc45a5f55dcd53023b02eaaf3404ef66bc902a9d4a47cf8","observation_id":"949f82bf-56e4-41c5-a6dd-3050f64bf2f3","resolution":{"observed_at":"2026-05-20T15:13:24.954832Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:52:49.813385Z","title":"Proceedings of the 2020 conference on empirical methods in natural language processing: system demonstrations , pages=","venue":null,"work_id":"0c0dde2c-7546-44b2-b24c-caa72fc64bff","year":2020},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:19f61cbe38b636e6f7a1e7cbdad4eda75915d9b425f3c17c4f567bd4a7510001","observation_id":"911035af-2bd1-44bb-a982-09a79cb2a1b2","resolution":{"observed_at":"2026-05-20T15:13:25.615597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ieee Access , volume=","venue":null,"work_id":"f037fac8-17b7-4765-b40d-3a4d33fd3a6d","year":2021},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:cc287a5ef98096ec2b66802211f3920c6e4e0a8ae2cbbe27182113075a57d39a","observation_id":"80146d0c-a01c-4b6b-8e2a-33ba52af6694","resolution":{"observed_at":"2026-05-20T15:13:25.613200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T15:33:53.729374Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"24ceb1df-3edd-4383-9b30-9927f035529a","year":2017},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:46f557b4b92672e690d8a34e149182a4a775c2b43f69e0992ba22bd310044681","observation_id":"edc67d5b-6660-483a-9e06-eb396f2cadb6","resolution":{"observed_at":"2026-05-20T15:13:25.617932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:22:42.130662Z","title":"Proceedings of the 2018 EMNLP workshop BlackboxNLP: Analyzing and interpreting neural networks for NLP , pages=","venue":null,"work_id":"241c5873-65be-4f6d-a1ac-555c08ad4f1f","year":2018},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:b28ab4d3547b9cb17fe88c0d1cc82f8c4f1bc8881aa8ce4fb473622fe2f310cd","observation_id":"ae3863ea-f21e-4080-99cf-78a60a083ad6","resolution":{"observed_at":"2026-05-20T15:13:25.610522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04664","last_updated":"2021-03-16T08:28:37Z","snapshot_observed_at":"2026-07-06T10:39:42.676631Z","submitted_at":"2021-02-09T06:16:25Z","title":"CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":"2102.04664","doi":"10.48550/arxiv.2102.04664","metadata_source":"pith","pith_arxiv_id":"2102.04664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation","venue":"cs.SE","work_id":"240a5e43-7f22-4634-b794-78d01e855b1d","year":2021},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2102.04664","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:6d55912cdfb8bbdbe7e218b3704693dbc4b22d60e00db3a78408044669addca6","observation_id":"086c5b8f-e20f-407d-bd4a-585640bbf872","resolution":{"observed_at":"2026-05-20T15:13:24.957683Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:b3fb598833d07e753bd56f04ddaeb93165934ec820ed88d6b97f8843b72276e9","observation_id":"14972fec-6d40-49f4-9dc5-469deeed9fd0","resolution":{"observed_at":"2026-05-20T15:13:24.990296Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17161","last_updated":"2025-05-26T17:16:45Z","snapshot_observed_at":"2026-08-09T18:26:12.869738Z","submitted_at":"2025-01-28T18:59:44Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","version":2},"cited_work":{"arxiv_id":"2501.17161","doi":"10.48550/arxiv.2501.17161","metadata_source":"pith","pith_arxiv_id":"2501.17161","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","venue":"cs.AI","work_id":"258dd934-025c-47f5-b4f6-5a0c1c338cc6","year":2025},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2501.17161","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:b2d954b0e16b4c05dd09f4265d634c36069a5cd358c61027afd2d97788436601","observation_id":"eb812d02-efee-4a3d-928b-54e85711dd3f","resolution":{"observed_at":"2026-05-20T15:13:24.972089Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:42.961784+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:42.961784+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":"b39a49bb-5026-409e-9acb-da7e81c27274","year":2025},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:67507f690c034d59f203e60995b5c3f4af01f6bd35e51691b4012c3d346b5e7c","observation_id":"439ca1c9-db11-4adb-a0b6-399285b01c57","resolution":{"observed_at":"2026-05-20T15:13:25.624573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ACM Transactions on Knowledge Discovery from Data (TKDD) , volume=","venue":null,"work_id":"450bc711-31c5-46c3-9020-1a30f9368162","year":2021},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:bd42efd7a4415b3c3a34048512f5d65fa4992b318f47246b5bfa1e33605bda52","observation_id":"226ff9cb-35bc-40a2-8ca3-e8184ca1845d","resolution":{"observed_at":"2026-05-20T15:13:25.605408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ACM Computing Surveys , issn =","venue":null,"work_id":"f897751a-8605-4f0a-940f-1b3b58f3d601","year":2025},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:c66e54ab9fd1d0a84aaef168b226931bf78fe21008cb62f91cbbd7509cc15919","observation_id":"a8a188e3-d691-4f47-8715-774229786dfd","resolution":{"observed_at":"2026-05-20T15:13:25.603135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.09820","last_updated":"2023-12-07T18:08:34Z","snapshot_observed_at":"2026-08-13T12:59:13.864599Z","submitted_at":"2023-01-24T05:11:17Z","title":"A Stability Analysis of Fine-Tuning a Pre-Trained Model","version":2},"cited_work":{"arxiv_id":"2301.09820","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.09820","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2301.09820 , year=","venue":null,"work_id":"9279dd18-b51d-4fea-beed-f6776a5b6129","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2301.09820","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:bd5694e919ee2e5559d2da21a2d1d4b59ebfae7a17088243a5b850728db374c1","observation_id":"48e48c96-9ed2-4443-8ce8-cb46c82a46ab","resolution":{"observed_at":"2026-05-20T15:13:24.963500Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15217","last_updated":"2023-09-11T17:25:24Z","snapshot_observed_at":"2026-08-03T19:11:09.671782Z","submitted_at":"2023-07-27T22:29:25Z","title":"Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":"2307.15217","doi":"10.48550/arxiv.2307.15217","metadata_source":"pith","pith_arxiv_id":"2307.15217","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback","venue":"cs.AI","work_id":"73fe40c4-d27f-4883-a2f1-52ea228f44fd","year":2023},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2307.15217","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:6fae0c3395e777bf22f92c81a846b393016c4ac142503b0d548dd81d537443ad","observation_id":"134094df-a128-4114-b62e-dc477c9eadb9","resolution":{"observed_at":"2026-05-20T15:13:24.966375Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:49:19.412323+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:49:19.412323+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18346","last_updated":"2024-06-26T13:42:13Z","snapshot_observed_at":"2026-08-12T23:34:28.580464Z","submitted_at":"2024-06-26T13:42:13Z","title":"AI Alignment through Reinforcement Learning from Human Feedback? Contradictions and Limitations","version":1},"cited_work":{"arxiv_id":"2406.18346","doi":"10.48550/arxiv.2406.18346","metadata_source":"pith","pith_arxiv_id":"2406.18346","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2406.18346 , year=","venue":"cs.AI","work_id":"951ffeb3-c355-4096-ac0d-eba84bccd06a","year":2024},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/2406.18346","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:d9751ca6184a90cf586c2d94857122898bdf13abc3a3639f52a75bc53e7cea14","observation_id":"e1955c49-22bf-4dad-b21b-a970a5d56f05","resolution":{"observed_at":"2026-05-20T15:13:24.975593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:f8eaae8ff79ab04ca34bb09514aa1fca1b33fc2a76e6c0120de86464b7c9e721","observation_id":"b619a5bc-a6e5-418b-9dd0-8f52e20e6a53","resolution":{"observed_at":"2026-05-20T15:13:24.981176Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:52.350337Z","title":"Aho and Jeffrey D","venue":null,"work_id":"b1f5cb43-a3c7-4ea0-85e7-9ccc9dfe1588","year":1972},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:6d6fabe421101f3ef01d3658b69bd3bea5705f2075c34a752e0f658e1a90c5de","observation_id":"0ba35602-f6db-424b-a9f4-63b7946581f0","resolution":{"observed_at":"2026-05-20T15:13:25.607999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:52.146752Z","title":null,"venue":null,"work_id":"aca2b566-99e0-4ebb-9c7a-a81219531259","year":1983},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:327b694e8b7d13efed1be8d60a70c93a1f9fbcbfd30ee1ab1755f6c5f2013419","observation_id":"39022c8a-ea3b-4154-a72b-caf0e52c7221","resolution":{"observed_at":"2026-05-20T15:13:25.598694Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2234.322243","doi":"10.1145/322234.322243","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chandra and Dexter C","venue":"Journal of the ACM","work_id":"c3270592-bd69-4213-95e1-4aaf8312be9b","year":1981},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:47b15a59bb027ccf5c573d626158a888d0672544de490f33ba39438f6943c1f8","observation_id":"37d126ce-6dd4-48f2-9816-4b45fe5571c3","resolution":{"observed_at":"2026-05-20T15:13:24.751418Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:12.175602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:12.175602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:52.206662Z","title":"Scalable training of","venue":null,"work_id":"aef70eae-f816-4598-84ec-429a2c09f5fc","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:707bfae07e5851e1af95eab6217f9eb4f44300ab26cafff031a7239bd969c3f3","observation_id":"04c7e943-35dc-4c70-ae39-6ea91f313273","resolution":{"observed_at":"2026-05-20T15:13:25.601090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:52.062642Z","title":null,"venue":null,"work_id":"852d89f5-1e7b-4296-b4f2-71e578b5e9f6","year":1997},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:4a2d1bb942615d0fac657be9aad8532f8b561dd7205675bc14f6a47f74f555c1","observation_id":"4eb78d1e-7e24-4906-b26d-99c9464038be","resolution":{"observed_at":"2026-05-20T15:13:25.593945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:52.089088Z","title":"Tetreault , title =","venue":null,"work_id":"75f57f43-cb6d-44a9-9cc5-9b8cfc702ea3","year":2015},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:2f286027d6f27e1621eec70642d8134fe93a0a2e3a3bd52dae8018598ca919b7","observation_id":"a6ce0d35-20f3-46d3-9883-703869d1f4e0","resolution":{"observed_at":"2026-05-20T15:13:25.591601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:52.117121Z","title":"A Framework for Learning Predictive Structures from Multiple Tasks and Unlabeled Data , Volume =","venue":null,"work_id":"6d196829-7173-4c45-aa5c-d0ee30947345","year":null},"citing_paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-20T15:11:27.420642Z"},"links":{"citing_paper":"/paper/2605.17458"},"observation_digest":"sha256:c0b4c9c60150fce13d81a5d512e7bdbcf421e9bdae717ccb9657da7a98d7d8cd","observation_id":"147ec98a-d4d5-49ea-b7ce-960332c5df45","resolution":{"observed_at":"2026-05-20T15:13:25.596444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.17458","last_updated":"2026-05-17T14:00:01Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:28:26.397778Z","submitted_at":"2026-05-17T14:00:01Z","title":"ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":15,"parse_uncertain":0,"unresolved":3,"verified_exact":5,"verified_fuzzy":38},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2605.17458."}