{"as_of":"2026-08-05T12:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e620eb413e0a3a04e653a49cefde1de339e2d907039fe7979ee139a65a7e3705","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T23:03:18.154426Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.25342/citation-record","integrity":"/paper/2605.25342/integrity","json":"/paper/2605.25342/citation-record.json","paper":"/paper/2605.25342"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":"2204.05862","doi":"10.1016/j.respol.2005.01.014","metadata_source":"pith","pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","venue":"cs.CL","work_id":"a1f2574b-a899-4713-be60-c87ba332656c","year":2022},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:5e28200d9a6c3ffbd557ac8e5a1ffd198c42a36af376cf8bde4de1ad8fefb4d7","observation_id":"23182391-a704-4761-91ef-055a57c9425b","resolution":{"observed_at":"2026-06-29T23:04:00.833449Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Multi- objective reinforcement learning with max-min criterion: A game-theoretic approach","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:ef277e290c0ce99a48259c4944369b79fd258ff9a032c5907a4bbd399e52667a","observation_id":"ea67aa5f-da9a-423d-8be9-63c02efcc2c8","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"When large language models meet personalization: Perspectives of challenges and opportunities.World wide web, 27(4):42, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:c9d7635c0c981afde8c19de37505afe103d0eae3b2afa450086e8371bf5c45b1","observation_id":"d8e505a9-36fb-490b-8153-0167465dd275","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Pad: Personalized alignment of llms at decoding-time","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:584063c6d7ce540b0a479c141fe74abab1446c79681b65a928f90752d365a568","observation_id":"77feb40c-c5db-43e5-9060-44d36a3e107a","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Towards next-generation intelligent assistants leveraging llm techniques","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:c2fa20fbc7fd0b24bfc4476d8c75ebf988861d133296dec8c57bdc54cad4474a","observation_id":"db5817e0-8d98-45e1-9510-93c79a83e9e1","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Linear alignment: A closed-form solution for aligning human preferences without tuning and feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:e584d71cd8be5509f54d82cd69b1d2837bb7fb1f575e4bc36be262d9590f4e51","observation_id":"6a0b1b2c-1cf3-4cff-bc08-aae032c3a8cb","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"A survey on personalized alignment—the missing piece for large language models in real-world applications","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:1c19a9215fc5ff8a76902816b3eb61024e4ebcca8d3f3ed8479c0e5ae6baf1e5","observation_id":"dd2b6e97-8f54-4160-a1f1-64677367f597","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Context steering: Controllable personalization at inference time","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:8584ae8a673e6af2fcea92f7b9dd984671c75e3764f8c424018367f6df6c4229","observation_id":"e436202b-7159-4c64-aac0-b601fce570b2","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"One-shot safety alignment for large language models via optimal dualization.Advances in Neural Information Processing Systems, 37:84350–84383, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:5ec30fb12e13d3206b7783120e0c4089840f6defe242f3110f7ba9b8ac595b43","observation_id":"b55515b9-bfbd-4e91-b71f-496438a29924","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Aligner: Efficient alignment by learning to correct.Advances in Neural Information Processing Systems, 37:90853–90890, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:2212988b90a523174f3094c475973ca600026f45d5952ab7f78a53193337537d","observation_id":"d4508041-0a2c-4509-939b-f1da60ed2874","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"A survey on large language models for code generation.ACM Transactions on Software Engineering and Methodology, 35 (2):1–72, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:4e629225c7426cecf06ea96496e142703c592b21a488ca0e726fa505f9850261","observation_id":"d5540920-01a9-4848-81e7-a082e6233157","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Aligning to thousands of preferences via system message generalization.Advances in Neural Information Processing Systems, 37:73783–73829, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:1a97e2ce40a66428e8d01f93b64a5329bfed9288feb83b0287c96ef26843353a","observation_id":"828fef3e-bb58-4e30-a87d-3d5c4014b3b0","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Deep reinforcement learning for multiobjective opti- mization.IEEE transactions on cybernetics, 51(6):3103–3114, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:9a5701392bd9821bdf4d36de4d2db7d736990f99b0b13a34d098030664b89127","observation_id":"1944f722-a13e-4a38-8595-a0a2afe55422","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05459","last_updated":"2024-05-08T06:16:23Z","snapshot_observed_at":"2026-08-02T13:57:57.119489Z","submitted_at":"2024-01-10T09:25:45Z","title":"Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security","version":2},"cited_work":{"arxiv_id":"2401.05459","doi":"10.18653/v1/2024.customnlp4u-1","metadata_source":"pith","pith_arxiv_id":"2401.05459","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security","venue":"cs.HC","work_id":"7692e42c-c83d-4527-ba16-9c4b69666d47","year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"cited_paper":"/paper/2401.05459","citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:b608d864b1329a8b31d0008d45df5cfa9c98814a8d642389158cf08f503c7655","observation_id":"e178646a-bce6-48c1-a2ad-3277b71bce80","resolution":{"observed_at":"2026-06-29T23:04:00.830728Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T23:25:42.923998+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T23:25:42.923998+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Parm: Multi- objective test-time alignment via preference-aware autoregressive reward model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:a8abbf0f1d4689af20d4bd3e00662d666ad70a93007d230b82fb21626ff2434a","observation_id":"999ad0a5-f3b3-4afa-a821-ddd8b35bc792","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"The unlocking spell on base llms: Rethinking alignment via in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:1585256b59d58e341d8515a2f19451e42b61eca8d44d8fdc786cc5c544e831d9","observation_id":"4e26782f-5dde-47f4-81d6-182f92d28c74","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Decoding-time realignment of language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:5a1c51c4a0907e884dd398d0d63e0670d28c5a099e2dd46d323d22e7c6f121c1","observation_id":"66c23b57-78c1-40be-990b-cfff3971e534","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Follow-the-regularized-leader and mirror descent: Equivalence theorems and l1 regularization","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:f016c8fdfbda62f319f66d9114289fdfbc64c153548ad44b8cbaee221eb3fa00","observation_id":"ed20863a-3cce-4399-b829-cb52318c2919","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Chatgpt and large language models in academia: opportunities and challenges.BioData mining, 16(1):20, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:67ec5c028d980f51570e5a719a0f31f479f085795914053de001e84f0f8da66a","observation_id":"ee59ce01-bc3b-4918-b4d1-9764dc6b101e","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:c93f0f3666a331823e2bb1eac5e9c2ac8cb2a00d04ed65bd4bc7954987ecd17a","observation_id":"85e2e05b-174e-4383-84ce-f2cc18686e5d","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"The max-min formulation of multi-objective reinforcement learning: from theory to a model-free algorithm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:cc4d559399fe70db6656032a70034327dd3d55f7b1232224929d0a388595d767","observation_id":"dfc45e31-3fbb-42fd-b322-f7d52c1588a6","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Personal- izing reinforcement learning from human feedback with variational preference learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:80084fe58139f7c016271563dc038ab906df91ffd613ae8fe93a8aa9c399dab6","observation_id":"c5f16fb2-7073-413c-92a2-03fca4a18a10","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:a1aba9b3137e41425e866eaa1968486bcb15525c070f421cf059877a53a5173b","observation_id":"4cb80587-033f-4763-9917-649535c7e1d3","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"From $r$ to $q^*$: Your language model is secretly a q-function","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:1efe8280efb465dc67d348efefcc42ce87af4bba6812c0367107e9c743093835","observation_id":"ebaf6a94-b507-47e5-b426-2605bd2919ff","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Rewarded soups: towards pareto-optimal alignment by interpolating weights fine-tuned on diverse rewards.Advances in Neural Information Processing Systems, 36:71095–71134, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:c621b757b4b60cecf84580060637cc192610f8aca8d703d51bbea342418879cd","observation_id":"372dd6fe-b3f3-4766-8289-532b3a2f75e5","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Decoding-time language model alignment with multiple objectives.Advances in Neural Information Processing Systems, 37:48875–48920, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:529fbe47e9f988c3fc54c632e1780001a8523b0b89ba3b15572ebd4a3156d3d9","observation_id":"66fbd311-ad2c-40e1-ba79-11ebb59b78fe","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Robust multi-objective controlled decoding of large language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:cdc4135c86d5a554cc1ee8ed75d2d011a5776dce1694eee0ee9f6d67ac4eb1c7","observation_id":"caa27965-761c-4ca3-976c-f0d0adc9cc18","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Llms as writing assistants: Exploring perspectives on sense of ownership and reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:af71f5ab9b34731e71c536cbdddaec97c3be29473582b97e8914be542bbaa8a4","observation_id":"14c6ecb8-101c-47b2-8566-c15de24cdb5f","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Genarm: Reward guided generation with autoregressive reward model for test-time alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:dfc769cd42f8775cc6a96c0a71269d02d1890a419f3e5056d6cc38431cc1d292","observation_id":"37ace087-fdf9-46cb-8adc-549e0af72f1d","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Metaaligner: Towards generalizable multi-objective alignment of language models.Advances in Neural Information Processing Systems, 37:34453–34486, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:95e60cc12faadb9719978154f6bc65b1ae58690244149f05e0f127c5bf6333fe","observation_id":"f81be5a8-ad75-4dde-b47a-533fd21c46e2","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Rewards-in-context: Multi-objective alignment of foundation models with dynamic preference adjustment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:f02b87e189f563908f706713a041ebd83d12fa580d8e7b3596f7140a071b670c","observation_id":"ea303828-1877-4bdb-bb87-83e4007a83c2","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Amulet: Realignment during test time for personalized preference adaptation of llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:df65d800d4ae3d889588faa8c82dabc50cf6ec732a49c80cd370975d5e2ef0ca","observation_id":"971ad244-8ea9-4013-afaf-2295f4e8598f","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Personalization of large language models: A survey.Transactions on Machine Learning Research, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:d86568f41d06b58e8e7eb1f82b30fd3246e1b2d06eb3848b642227f76a19afb0","observation_id":"95266e71-8b40-4dd7-9455-bd0885ae7de3","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Do llms recognize your preferences? evaluating personalized preference following in llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:a8a86f26e40c197b6b8e1f9807e01c5901a0031b2675da8cba264177cd5b6b25","observation_id":"219d9b57-9456-4687-a3a4-cba93bdf8c03","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Panacea: Pareto alignment via preference adaptation for llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:fba390ced03f12ff627b9b7467307e4f1242cd4587ec7bd46fd8d7907e8f98cb","observation_id":"c9dd7212-9ad5-4172-8ed3-e6e9f06f7901","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"Beyond one-preference-fits-all alignment: Multi-objective direct preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:fb934633d13512294dabea9004290d6b160356211e3a0c215a2356cc68b68c25","observation_id":"346a009a-e842-4206-933b-17a98ea72fb6","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"On-the-fly preference alignment via principle-guided decoding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:fd9a40b4a9ffb4be16bbe616f9ea2fb62fffa0894a091137386b3e7ff489edf3","observation_id":"53bdb7f3-a148-4621-8d86-121e23c57da1","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:c49640b835528f1b61e447a773e33e7cbe0e6c5757c32fe83bc75049df22f027","observation_id":"ff2969cc-a412-422c-a016-bfd4d796e21e","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":"The bench kid line ride sit","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:abeffbb09ada986e793d7b67c48b79894ec7a165a0f0e8699963f8bf128d7c95","observation_id":"6fb5ff97-c6d1-492e-83fd-ea8489a5709c","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:c7ec9c1efeb415ac6108e1336409c92cfa41fe9f851ac5b5a90f300535d6090e","observation_id":"f3655321-f5c7-46c0-8f39-a0c342909b12","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T23:03:18.154426Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-29T23:03:18.154426Z"},"links":{"citing_paper":"/paper/2605.25342"},"observation_digest":"sha256:86141dba351e56b0f942fca37ff0acd3c0acc04db83f6d848c319c692de898df","observation_id":"6a73762f-de76-4601-8f8f-35d0cebc37d8","resolution":{"observed_at":"2026-06-29T23:03:18.154426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.25342","last_updated":"2026-05-25T01:57:22Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T01:07:15.448415Z","submitted_at":"2026-05-25T01:57:22Z","title":"MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2605.25342."}