{"as_of":"2026-08-15T03:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2c80ba8af7a614af2e7d7e30f961e834167048f574d35943e1939955a0e05cba","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:20:54.562259Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09507/citation-record","integrity":"/paper/2608.09507/integrity","json":"/paper/2608.09507/citation-record.json","paper":"/paper/2608.09507"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.224787Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.224787Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:edc4d2f82f4da8139ed1d86e13596b03376240cfa57fc1e11d8c5b82f479c124","observation_id":"ae82675b-e238-4162-b92d-5cdf0a56ff94","resolution":{"observed_at":"2026-08-14T04:20:54.224787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.232418Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.232418Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:99776b7d0a08091f7213ab31144b3b3e9dcf57c19831dea31a070ce2db91e018","observation_id":"39f9f91b-623f-4a7c-a01e-e8a0273c1f07","resolution":{"observed_at":"2026-08-14T04:20:54.232418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.238370Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.238370Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:f0166e7b99d37ec530ffbaba6643d19941c2e21699d2f5de6324cb560a38102a","observation_id":"026823ba-e51a-43fc-bc84-62f34b641006","resolution":{"observed_at":"2026-08-14T04:20:54.238370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.12078","last_updated":"2026-04-22T03:09:46Z","snapshot_observed_at":"2026-08-07T16:51:35.491007Z","submitted_at":"2026-01-17T15:05:36Z","title":"Optimizing User Profiles via Contextual Bandits for Retrieval-Augmented LLM Personalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.12078","snapshot_observed_at":"2026-08-14T04:20:54.243621Z","title":"Optimizing User Profiles via Contextual Bandits for Retrieval-Augmented","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.243621Z"},"links":{"cited_paper":"/paper/2601.12078","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:32c33778d85fa5b5406abb103015b3dd8f37acef0e00e93c57f852abdc71bf6b","observation_id":"24d3e69d-80f8-4cd7-8ae0-8fb14b9cc38b","resolution":{"observed_at":"2026-08-14T04:20:54.243621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.250331Z","title":"Persona-","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.250331Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:cb37ec497bd952c2db76ea0b10a125fb972751a8f711bada7c31ccb0df56303a","observation_id":"18a3f310-a064-415e-868c-23eb8c2273d9","resolution":{"observed_at":"2026-08-14T04:20:54.250331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.255594Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.255594Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:bdeaeb34fc82cfb1e7577bbdc144f7a53630523fafa39f1eb397dc4b394b8a4d","observation_id":"9480197e-2490-41bd-a1f7-c3f7a39ca38a","resolution":{"observed_at":"2026-08-14T04:20:54.255594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05731","last_updated":"2025-04-08T07:03:36Z","snapshot_observed_at":"2026-08-07T16:07:39.728870Z","submitted_at":"2025-04-08T07:03:36Z","title":"Retrieval Augmented Generation with Collaborative Filtering for Personalized Text Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05731","snapshot_observed_at":"2026-08-14T04:20:54.260314Z","title":"arXiv preprint arXiv:2504.05731 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.260314Z"},"links":{"cited_paper":"/paper/2504.05731","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:07a2da02b34cbff5a94df124c74ceb8ccaa076958a8626ee887c27c793917c45","observation_id":"5b2ed914-b6c6-4578-97d6-3cbdb622b41f","resolution":{"observed_at":"2026-08-14T04:20:54.260314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04401","last_updated":"2025-02-08T20:01:56Z","snapshot_observed_at":"2026-08-13T04:24:47.213975Z","submitted_at":"2024-02-06T21:03:52Z","title":"Democratizing Large Language Models via Personalized Parameter-Efficient Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04401","snapshot_observed_at":"2026-08-14T04:20:54.265392Z","title":"arXiv preprint arXiv:2402.04401 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.265392Z"},"links":{"cited_paper":"/paper/2402.04401","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:1db1c8ef0db957efea6a1aa68fc62fb2bf5aeff5619e2f2403f213698ffec940","observation_id":"320b4752-14ac-4892-81c5-d47968e78b6d","resolution":{"observed_at":"2026-08-14T04:20:54.265392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.270445Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.270445Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:0946bdaa10fedea1d3d711073e7876c26f882066cfae059e5241379faa5f9e25","observation_id":"153e08dc-fac5-4ba5-8673-13989f4fa870","resolution":{"observed_at":"2026-08-14T04:20:54.270445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.276499Z","title":"ACM Transactions on Information Systems , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.276499Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:2fbf63191e706a6e643705fb215a46a8cf3449abb3b3ee8db5ac2e1f61370f15","observation_id":"be97fe2b-dc40-4a0b-8871-5d5920a27ef5","resolution":{"observed_at":"2026-08-14T04:20:54.276499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.281254Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.281254Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:5511daa6215354de37239698f2159c00d18214bb47278878f079fd24b06b7b60","observation_id":"f7d1e735-bc66-45f3-a473-bde7620b331c","resolution":{"observed_at":"2026-08-14T04:20:54.281254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11564","last_updated":"2023-10-17T20:22:13Z","snapshot_observed_at":"2026-08-14T09:42:02.630726Z","submitted_at":"2023-10-17T20:22:13Z","title":"Personalized Soups: Personalized Large Language Model Alignment via Post-hoc Parameter Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11564","snapshot_observed_at":"2026-08-14T04:20:54.286992Z","title":"arXiv preprint arXiv:2310.11564 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.286992Z"},"links":{"cited_paper":"/paper/2310.11564","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:45a68b849ccc4d1d51e23f0af1b9250a48467e8c867dd818de5853ad80f3c176","observation_id":"64625d7a-b7aa-4152-8c50-a10eeb4cb6f9","resolution":{"observed_at":"2026-08-14T04:20:54.286992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.292501Z","title":"2024 , note =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.292501Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:981c7aecd874a3532c4e4c9bd387feb8e9d7eb8bdc82f1cd89ca6ed14f4848bf","observation_id":"88f85b19-4c63-4c7b-924d-41198c3dc9b5","resolution":{"observed_at":"2026-08-14T04:20:54.292501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20081","last_updated":"2023-10-30T23:40:41Z","snapshot_observed_at":"2026-08-13T05:37:03.334954Z","submitted_at":"2023-10-30T23:40:41Z","title":"Integrating Summarization and Retrieval for Enhanced Personalization via Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20081","snapshot_observed_at":"2026-08-14T04:20:54.297753Z","title":"arXiv preprint arXiv:2310.20081 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.297753Z"},"links":{"cited_paper":"/paper/2310.20081","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:8e87d518ac4df01d102ff76c8c39ad8eed656aa9abcf35b7c29f160a4570bd62","observation_id":"62c67ef1-a70c-44ee-9e2c-99037d1620dd","resolution":{"observed_at":"2026-08-14T04:20:54.297753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.303176Z","title":"Proceedings of the 1st Workshop on Customizable NLP: Progress and Challenges in Customizing NLP for a Domain, Application, Group, or Individual (CustomNLP4U) , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.303176Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:93c1fe3824398b1fae2a09b51d76132af4d0153d4177928dfeba109795deae50","observation_id":"2debc7b9-0f3f-4960-8d30-e20482b33f80","resolution":{"observed_at":"2026-08-14T04:20:54.303176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.308080Z","title":"arXiv preprint arXiv:2601.04963 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.308080Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:77f4a2a5eae0eb736acdd50c78a5c30b664538f90c47c671beacc0f1fa4005fd","observation_id":"c1b9c427-574e-4bc3-8145-1b51167d1b64","resolution":{"observed_at":"2026-08-14T04:20:54.308080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.313613Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.313613Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:7c2549ec5c5187e7249ba35c1b3869c0dff9428c0b3095b6946d88c8f334c1da","observation_id":"003d1eae-dd1f-413e-a607-e01a16c5d69f","resolution":{"observed_at":"2026-08-14T04:20:54.313613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.319100Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.319100Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:2e70921f508f6939bb811f0131d83ed0a6ad0354920862bbdb3544154976fb0b","observation_id":"bca672d5-3904-42a6-a9c2-7ad5296deba1","resolution":{"observed_at":"2026-08-14T04:20:54.319100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.323577Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.323577Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:266c2d9c3a58d58aede40d221343bf8e86914045a4301a269c58adaf76158904","observation_id":"e8d4f5aa-5b6c-4986-84cc-b8a4e1a78b91","resolution":{"observed_at":"2026-08-14T04:20:54.323577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.327979Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.327979Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:29c2f816e90e6b1941459d971f38c7610452861210f291bdfafa9a248614785d","observation_id":"c99fa9db-4093-4c82-8a09-40d16ee88f6f","resolution":{"observed_at":"2026-08-14T04:20:54.327979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.332553Z","title":"and Stoica, Ion and Gonzalez, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.332553Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:c500902072aa8cc6c9e88a446e44c10469899e4a8a5c3e6fb22cb2b3d463f476","observation_id":"4836f9bb-6b98-4bae-9c22-988a7b7250b3","resolution":{"observed_at":"2026-08-14T04:20:54.332553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.337451Z","title":"2024 , doi =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.337451Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:9d889da9ffdb348c4629f33137497bfe00efec0f1e8f8154b9a845357b3e35a5","observation_id":"cae205b1-dfa2-4d1b-8977-66bca40fe932","resolution":{"observed_at":"2026-08-14T04:20:54.337451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.342651Z","title":"2025 , note =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.342651Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:ae9bdc40e4f5ec32afb7b03caeac24607c115ed4210b0c1671fb6e62513aaa52","observation_id":"817c7abc-8062-45bf-a596-1df3785895b5","resolution":{"observed_at":"2026-08-14T04:20:54.342651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.347138Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.347138Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:9bebb6ea850340b4fbd9711a25c2a9088030a6f4c2d6adb9d69489d741911a48","observation_id":"9f8056a1-8615-4807-8055-dd4402e6930e","resolution":{"observed_at":"2026-08-14T04:20:54.347138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.352017Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.352017Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:c26c1c8a90cc195543f1b51785357b18d73ea8dc2b753911127fa24ff9a46755","observation_id":"156dbdaf-87e3-4ece-a776-357c83a40e79","resolution":{"observed_at":"2026-08-14T04:20:54.352017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.358114Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.358114Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:ef7204f39d5c25fc97c35d0bed5dd6fdec6e0189d7e397c769ef38e4373f7eba","observation_id":"e34a18c8-23a8-416b-8efa-1d8c21feb82a","resolution":{"observed_at":"2026-08-14T04:20:54.358114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.364604Z","title":"International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.364604Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:0e0181f0de66625e650687ded9a8e405b05c099ed61691c9165eca57ea8e5748","observation_id":"f837fcaa-535e-4c40-a4c2-1fea889e2d1c","resolution":{"observed_at":"2026-08-14T04:20:54.364604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.369511Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.369511Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:9e25f3f546deeeef14654e3528112145840ee3cdd992ba34edc43ac4668a26e4","observation_id":"88c55ad9-3583-450f-b56a-e9a957a5ac58","resolution":{"observed_at":"2026-08-14T04:20:54.369511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.373808Z","title":"2026 , month = feb, howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.373808Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:2f6465ca60fd31693e16f879d1d48149a8c5eef841460b7945b745fe0a3955ef","observation_id":"4fac8e80-6c29-4383-8a68-2ff079a9582a","resolution":{"observed_at":"2026-08-14T04:20:54.373808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.378310Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.378310Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:9268f3dc3f27cd0d97ca31f05b508c15b60155b88d713bc93775e302fe71e94e","observation_id":"fd017266-f053-4a27-b598-2124c60ba001","resolution":{"observed_at":"2026-08-14T04:20:54.378310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-14T04:20:54.383505Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.383505Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:a8502873ab277bddcb74ca879326c7c52c2ce657ec313756b5f23df489a5da9a","observation_id":"002250e1-3403-40d5-a64f-1557d93ab6b3","resolution":{"observed_at":"2026-08-14T04:20:54.383505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.399636Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.399636Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:1e2f8d70ee47d9e17a2a0ef0315f5937abf295327abeb405103b8be18a0caad2","observation_id":"db907c52-e4f9-444f-8789-5f5c849feb01","resolution":{"observed_at":"2026-08-14T04:20:54.399636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.405937Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.405937Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:7418f3052bf515c44e859bdeddd295c158262abb65c9b13b58c4275a5ac96ee5","observation_id":"c97964e3-e829-4a56-90ed-246d48c2a753","resolution":{"observed_at":"2026-08-14T04:20:54.405937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.412309Z","title":"Findings of the Association for Computational Linguistics: ACL 2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.412309Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:0ad9b42fc6eee90954d9073ae6247d439cb54bac61f52366d0cca790b461ed01","observation_id":"5f08a450-3df1-4e1d-a64b-51a39d969642","resolution":{"observed_at":"2026-08-14T04:20:54.412309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.418138Z","title":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing (EMNLP) , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.418138Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:de260d38dc79856f2ec4730b28fb41ce138a358f59aeee488309a43753bd7c45","observation_id":"53911f4e-2d67-474d-bf9f-706751177e7a","resolution":{"observed_at":"2026-08-14T04:20:54.418138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.423506Z","title":"Transactions of the Association for Computational Linguistics , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.423506Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:78a816dd26089597029158b506f5ccd68f020b840317b8bad2af959812f6774b","observation_id":"460022c5-43af-4052-a44b-d60a3ebf5828","resolution":{"observed_at":"2026-08-14T04:20:54.423506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.428777Z","title":"Training language models to follow instructions with human feedback , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.428777Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:d1880b3ab7e0b5465392a6a07f23e0eec2435ad11b183e4d28d38b44028ec624","observation_id":"63fee2e0-b204-41fe-add0-0c285345669c","resolution":{"observed_at":"2026-08-14T04:20:54.428777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.433416Z","title":"2026 , url =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.433416Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:4191a566bbf70031812fdba25abc20842da85cddca6570a75709f02e978672b2","observation_id":"4edbd32c-8642-49a8-9d42-5d7a18f03594","resolution":{"observed_at":"2026-08-14T04:20:54.433416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.438783Z","title":"2026 , url =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.438783Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:d3d39784b6d574067a4d1ce970d6c6f6e34e7c9142901f88c0c50bf5e9ba95cb","observation_id":"c195d0b6-4e2d-42f6-8f8c-28652830f166","resolution":{"observed_at":"2026-08-14T04:20:54.438783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.443255Z","title":"Proceedings of the ACM Web Conference 2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.443255Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:e58b357335b6cd5465471cb4e11f0c4e6573c375ca51f929458188afa7f0942c","observation_id":"05a189b1-8b41-4f15-b58a-35ca5e0f119f","resolution":{"observed_at":"2026-08-14T04:20:54.443255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.447799Z","title":"Recommendation as Language Processing (","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.447799Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:fa79cf160a3b0697b7d986d81668f42be624a0d5253bd0e5ee494bd8cecf69be","observation_id":"bfc3c5bb-add7-4554-9e47-743807865343","resolution":{"observed_at":"2026-08-14T04:20:54.447799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.453108Z","title":"2023 , doi =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.453108Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:061c822e0ea2f904da4495d1b9f214f0f0897c820413214350e756fe5a2c7cb3","observation_id":"e96c8d95-5928-44e5-af39-e3458ab69c6a","resolution":{"observed_at":"2026-08-14T04:20:54.453108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.459138Z","title":"2024 , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.459138Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:af19627734cd0e9e2b0de2b6787fd12806b6ee01bd9402910949bf43fc2eb277","observation_id":"f301ccb2-91ac-492a-b361-7d08736e47eb","resolution":{"observed_at":"2026-08-14T04:20:54.459138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00887","last_updated":"2024-09-02T01:30:40Z","snapshot_observed_at":"2026-08-14T09:13:46.943121Z","submitted_at":"2024-09-02T01:30:40Z","title":"User-Specific Dialogue Generation with User Profile-Aware Pre-Training Model and Parameter-Efficient Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00887","snapshot_observed_at":"2026-08-14T04:20:54.465098Z","title":"arXiv preprint arXiv:2409.00887 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.465098Z"},"links":{"cited_paper":"/paper/2409.00887","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:99f70285dbd2d4a58932fe36b7f15290be85e9deb7e75642c0a316fe0bf16c65","observation_id":"82f0fc42-0dc4-47c6-97dd-88e6bf3d9d1c","resolution":{"observed_at":"2026-08-14T04:20:54.465098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.471041Z","title":"2025 , doi =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.471041Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:2ebf449e35d2b46806b79332a70ea2784ba215f90bec35aa25073b82d2b3fc05","observation_id":"5a19cf73-f598-4091-a234-74ed9fac0e8a","resolution":{"observed_at":"2026-08-14T04:20:54.471041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.477081Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.477081Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:b5993dfea8ef12d534ca56740a091c5855865adda36c86054d13a65458083e11","observation_id":"6f810578-554f-49ab-8670-1630a31e0c3a","resolution":{"observed_at":"2026-08-14T04:20:54.477081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05970","last_updated":"2024-04-09T02:58:05Z","snapshot_observed_at":"2026-08-13T00:34:32.954749Z","submitted_at":"2024-04-09T02:58:05Z","title":"Optimization Methods for Personalizing Large Language Models through Retrieval Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05970","snapshot_observed_at":"2026-08-14T04:20:54.482148Z","title":"arXiv preprint arXiv:2404.05970 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.482148Z"},"links":{"cited_paper":"/paper/2404.05970","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:0a146e1181e9d63f82773987738754e2617ecd66c4ab26a5bf40b9d1f7278e3a","observation_id":"a4211d96-7bf3-4b26-bb04-5c51ad00d0da","resolution":{"observed_at":"2026-08-14T04:20:54.482148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.487135Z","title":"arXiv preprint arXiv:2507.13579 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.487135Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:1ccb8386591d335782b85ea37839f891d789d4fb4285ebd58616daf8c9824fde","observation_id":"a909d038-0674-4f6b-a339-a60562909258","resolution":{"observed_at":"2026-08-14T04:20:54.487135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.491550Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.491550Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:02bf9cab755a799f6438f09a080e40e3e985910e3b4cc0f12ca89a6a0da7d949","observation_id":"fa996684-2315-4430-a87a-5d24ff0af2ce","resolution":{"observed_at":"2026-08-14T04:20:54.491550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.496529Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.496529Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:99a10481f26692b3cf58ec7b10991571269e17ccb09e78b87e441c223bed110e","observation_id":"ce8361b2-7509-4a4b-864f-a83d416df745","resolution":{"observed_at":"2026-08-14T04:20:54.496529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.501666Z","title":"Computer , volume =","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.501666Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:a3604669cc2a09846c8a86b573aa0e704fe324cc869efe163672a533e0dba8aa","observation_id":"1a3beb4d-455f-45ef-a9df-b8e9b6903d96","resolution":{"observed_at":"2026-08-14T04:20:54.501666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.506403Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.506403Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:7399ea868f57d4fa378395685f54c7dd91e9f43ed18a17ec24e7bf6ff972c48f","observation_id":"d642d4e2-91a8-430e-9f34-79f7304e2fb1","resolution":{"observed_at":"2026-08-14T04:20:54.506403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.514162Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.514162Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:90f93c08b7eb0e26d6eb67b97a6009bb88341bcaa965763b364b20eb13b11221","observation_id":"c09f0f08-5bae-4f2d-8468-5144845ee513","resolution":{"observed_at":"2026-08-14T04:20:54.514162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-14T23:23:31.683130Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-14T04:20:54.520361Z","title":"arXiv preprint arXiv:2504.19413 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.520361Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:330b9482585c6f6072dcc208875cec1a86d7eba44d9403ee63b3c63ae467426f","observation_id":"4991e912-469b-485f-b7ff-b930ebbc2cdf","resolution":{"observed_at":"2026-08-14T04:20:54.520361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02259","last_updated":"2026-07-29T12:55:39Z","snapshot_observed_at":"2026-08-13T13:14:28.835248Z","submitted_at":"2025-07-03T03:11:50Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02259","snapshot_observed_at":"2026-08-14T04:20:54.525842Z","title":"arXiv preprint arXiv:2507.02259 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.525842Z"},"links":{"cited_paper":"/paper/2507.02259","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:64d3ee977d3eba9610a8ffde91882725962fcc0490998b078be5491cef05d751","observation_id":"015d8e13-d63c-4f2c-a6fb-46c1b23a7f8d","resolution":{"observed_at":"2026-08-14T04:20:54.525842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.530953Z","title":"2023 , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.530953Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:f6893c8d710d77413b9d26b9cc8eb51062ac84533cee61fc06e22e822abc5005","observation_id":"94e6d47b-0d01-4fdc-9997-b350606b5fe2","resolution":{"observed_at":"2026-08-14T04:20:54.530953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.537265Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.537265Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:5e8cb0dafa2c2ff0bae2ff3a49b8bb42da900704aa44a5e13fd4a55856409165","observation_id":"f999b699-0ade-4e85-8b9a-975f49990e83","resolution":{"observed_at":"2026-08-14T04:20:54.537265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.542639Z","title":"``In-Dialogues We Learn'': Towards Personalized Dialogue Without Pre-defined Profiles through In-Dialogue Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.542639Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:32d55a4b1aeea416fb2e304abfeac84bcd0c40320ac4e91e2e29760f07af2fd9","observation_id":"8c6e6f33-0ad3-47a4-9854-6ce618d21324","resolution":{"observed_at":"2026-08-14T04:20:54.542639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.548139Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.548139Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:556ff337c4320cddb6c388e9ef4bcac566013ee7c6a9e1cff36723e1f0b5591f","observation_id":"124cd6a0-43bc-4d5b-a78d-19bb23873811","resolution":{"observed_at":"2026-08-14T04:20:54.548139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.552629Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.552629Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:587517c1c01c539bad4e7066ee9cd798a0badb1386dd3c76c65e200944946507","observation_id":"776b781b-648d-41c4-8465-fe3e8f4e16d8","resolution":{"observed_at":"2026-08-14T04:20:54.552629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.557234Z","title":"arXiv preprint arXiv:2603.25973 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.557234Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:0a77a3edaefd41c7ea80f91d6b4dce555f253895daa96cdc0507c5ba3a30ac0b","observation_id":"e1b129b9-814b-4ea4-97c8-112fa0f93a8f","resolution":{"observed_at":"2026-08-14T04:20:54.557234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.562259Z","title":"2009 , journal =","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.562259Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:543e2d158218cc1f857c6678840314198cb96c27369f00785948039672d2e24e","observation_id":"75e39b32-0311-4ce8-b631-3db3ffb090d5","resolution":{"observed_at":"2026-08-14T04:20:54.562259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T03:09:46.324025Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2608.09507."}