{"as_of":"2026-08-08T00:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f113e2dfc41ffdbe7433cc3bdffdeb2daf6b122d6f939f82b2037c46a871ca87","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T11:29:31.841667Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.22603/citation-record","integrity":"/paper/2607.22603/integrity","json":"/paper/2607.22603/citation-record.json","paper":"/paper/2607.22603"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:27.353508Z","title":"MyVLM: Personalizing VLMs for user-specific queries","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:27.353508Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:a63862e9e7f88e64bbfdfcb992176323cb3b05bd46c032df1f3efb3d470631e2","observation_id":"363e0488-88ba-4a9a-9cb9-cd71218e647d","resolution":{"observed_at":"2026-08-02T11:29:27.353508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:27.441909Z","title":"Flamingo: A visual language model for few-shot learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:27.441909Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:0ab8b2208bee97ba3023299ee11f2d21cf4dbca9b930a4d2fcb2434686efae72","observation_id":"43a134b4-7f1a-444b-b8fe-c7465263b9dd","resolution":{"observed_at":"2026-08-02T11:29:27.441909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:27.519353Z","title":"MC-LLaV A: Multi-concept personalized vision-language model.arXiv preprint arXiv:2411.11706, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:27.519353Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:218f8f6c077608c4aaeabcaa0a7344769ef4de5b93a5e79c5d1fa2c2c69087e5","observation_id":"78144ef0-a5b9-4694-a795-1c18bdc66773","resolution":{"observed_at":"2026-08-02T11:29:27.519353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:27.641190Z","title":"Lawrence Zitnick, and Devi Parikh","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:27.641190Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:a0671b09e242d5104b31154fb7d6f2769b3a64d29dfa446cb3058306e6b45dbd","observation_id":"0e98eb5a-903d-419d-97c7-3862225788a5","resolution":{"observed_at":"2026-08-02T11:29:27.641190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:27.699688Z","title":"Online-PVLM: Advancing personalized VLMs with online concept learning.arXiv preprint arXiv:2511.20056, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:27.699688Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:46579e83f6dc842348cedfe99a0af17509e95a86b5c12870b579713774c35eee","observation_id":"7863a6fb-82c8-4bba-ae80-86b4736818b8","resolution":{"observed_at":"2026-08-02T11:29:27.699688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T11:29:27.786564Z","title":"Qwen2.5-VL technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:27.786564Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:7d93101a69a93a7294cad756cfb6950cff377564a8f326fe923eb08f188900f4","observation_id":"29abe976-79dd-4676-afc9-8672c49a0ae6","resolution":{"observed_at":"2026-08-02T11:29:27.786564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-02T11:29:27.868074Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback.arXiv preprint arXiv:2204.05862, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:27.868074Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:13c6812aaf2d68bb5f7def7fd2d2914b9496a1b859061e6f13b088935b46598a","observation_id":"d56df7ed-2bc8-488c-86cf-91e247800efc","resolution":{"observed_at":"2026-08-02T11:29:27.868074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:27.953076Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:27.953076Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:87164c85c2a865db2f78a04447e0a002f51247b32f4315297c43c44cd764e9e9","observation_id":"5b0b8618-0761-4c4a-be80-df01c43443af","resolution":{"observed_at":"2026-08-02T11:29:27.953076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.016659Z","title":"Speaker role contextual modeling for language understanding and dialogue policy learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.016659Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:9ef5f69d9fdc61e602d0c84720aac18bc292d2d8eaa094cd6545f73dab4b4dc2","observation_id":"0a4116ea-0937-48f4-9762-b9754fcacc1d","resolution":{"observed_at":"2026-08-02T11:29:28.016659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.076588Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.076588Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:a04964a9270af67953f0ff5c91443e0a6cd06c66b4f021be44dbca2bccfc3ced","observation_id":"51ef6f20-71bb-4761-aa06-901e6cbb650f","resolution":{"observed_at":"2026-08-02T11:29:28.076588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.147776Z","title":"this is my unicorn, fluffy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.147776Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:65f9d22c233e17f1fc728ddbf8cb74e234600e12e16f3ecc30637b6017a0212d","observation_id":"8851a29c-cd67-4af0-bf4b-1c99e2e17d1e","resolution":{"observed_at":"2026-08-02T11:29:28.147776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.209573Z","title":"Class-balanced loss based on effective number of samples","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.209573Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:cf742084eae4017ce1fbb0c5c9deea4fd654534e722b11367f410ce689cad948","observation_id":"9629b677-6294-4262-aebc-7245076eef47","resolution":{"observed_at":"2026-08-02T11:29:28.209573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.274517Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.274517Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:d9f28d3a63cab11af95a36f20364c864f0eda15f56e28c02a037f6482151f024","observation_id":"930c72dd-678f-4a5c-9b66-223c6bc350e5","resolution":{"observed_at":"2026-08-02T11:29:28.274517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.314366Z","title":"KTO: Model alignment as prospect theoretic optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.314366Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:4d4209321a6e38aec5fbbfb91f8a344421d47398d8d42f5c2238b63357916f1e","observation_id":"0bcbc6ee-1648-4700-8def-09cfd2a47d8d","resolution":{"observed_at":"2026-08-02T11:29:28.314366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.397529Z","title":"Guided mllm reasoning: Enhancing mllm with knowledge and visual notes for visual question answering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.397529Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:33d36e78e3a9b3834c92d8cd5d75c9a39d9d7d1460a4e01326742f386ab77b72","observation_id":"833661c4-34e7-4c92-a322-91656644ceca","resolution":{"observed_at":"2026-08-02T11:29:28.397529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.469844Z","title":"Procaccia, Itai Shapira, Yevgeniy V orobeychik, and Junlin Wu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.469844Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:4723565c99ec79d1d953f4b1c09368d675db19cb457ae4a335011aea6b0d0758","observation_id":"ea7f695c-d585-4080-a93e-376b029f9da9","resolution":{"observed_at":"2026-08-02T11:29:28.469844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.578195Z","title":"Bradley Knox, and Dorsa Sadigh","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.578195Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:caed47a7898310334d5267cf45ab2bed49770c00ec2812acd8c90b8fd55281be","observation_id":"b8968fec-1dcb-4747-bdbd-4c915a244434","resolution":{"observed_at":"2026-08-02T11:29:28.578195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.671554Z","title":"Boosting mllm reasoning with text-debiased hint-grpo","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.671554Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:7125dc665a9359991072d3c22382fc7ca8d0a33831bc900e06ae643a1074756e","observation_id":"02a61bd7-3640-4527-9d4c-168c5a27bc7b","resolution":{"observed_at":"2026-08-02T11:29:28.671554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.783159Z","title":"MMPB: It’s time for multi-modal personalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.783159Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:d3465ea065ae58fe6760bdd0e26917ac10e4c3953a90aff94183c59bb9baf736","observation_id":"7b50b629-b8db-45a0-94a0-b994a0d1d5d3","resolution":{"observed_at":"2026-08-02T11:29:28.783159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.874961Z","title":"LLaV A-OneVision: Easy visual task transfer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.874961Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:f182c539004f2d3fb46fd2d4bfa29c0fe7847dbef45f0d352bc6efdbb579c692","observation_id":"77cea277-5c91-42d2-abf5-8a56d0f6d622","resolution":{"observed_at":"2026-08-02T11:29:28.874961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:28.958077Z","title":"Spithourakis, Jianfeng Gao, and Bill Dolan","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:28.958077Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:4e713454cc15b8f6fccc94cea62761184145d97b5d31539941b1c207f27aecc3","observation_id":"fa0cdbf3-5fce-4603-af8e-e725799605f8","resolution":{"observed_at":"2026-08-02T11:29:28.958077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:29.073379Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:29.073379Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:1df1032004d7a63cdf23867d9dd825b2819bf58773492dba8b2fab1df6f722a6","observation_id":"677e4935-7773-4d42-8048-0b739bc0a63d","resolution":{"observed_at":"2026-08-02T11:29:29.073379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19455","snapshot_observed_at":"2026-08-02T11:29:29.185783Z","title":"Mm-prompt: Cross-modal prompt tuning for continual visual question answering.arXiv preprint arXiv:2505.19455, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:29.185783Z"},"links":{"cited_paper":"/paper/2505.19455","citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:dfdfbd1c3a704516daa407d4bb12c3da1c8efdfc73ee58146f6f93be0a4ced02","observation_id":"2d7753f2-fd46-4f6c-a6d5-04b682a174bb","resolution":{"observed_at":"2026-08-02T11:29:29.185783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:29.274038Z","title":"Focal loss for dense object detection","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:29.274038Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:bf3ebed69f059d5708bf636bae18acf9df021381f78b3535e80aff9679d563fb","observation_id":"d22434fb-5c1a-4019-b7a2-451c29e6fff0","resolution":{"observed_at":"2026-08-02T11:29:29.274038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:29.395102Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:29.395102Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:069eab7ff6d69532623c93967eb198b9509ba588c4c5b939edc6ab57e4fa5dbf","observation_id":"6b5a2fd8-263d-4087-9c4d-058ea0f03ba0","resolution":{"observed_at":"2026-08-02T11:29:29.395102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:29.540632Z","title":"LLaV A-NeXT: Improved reasoning, OCR, and world knowledge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:29.540632Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:fed26950e33b1bef83e487f94926df943b7536ec7475cca8ff87e797cdb8a209","observation_id":"d9ef3d90-3050-4e3e-923a-8f5f3507dd7b","resolution":{"observed_at":"2026-08-02T11:29:29.540632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:29.688453Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:29.688453Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:76add974a6fd44ab60be2cf4d48eda76eb00bcd80387b2f7320128a0f7d8ebcb","observation_id":"3194a284-77f0-4a1a-bb43-6853e2f80fa1","resolution":{"observed_at":"2026-08-02T11:29:29.688453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:29.805566Z","title":"Yo’LLaV A: Your personalized language and vision assistant","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:29.805566Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:18f421d4ffd79f51a32ac486bac08c215bc22b23e51f3b76a0cd30b7015adcdd","observation_id":"2171b9af-de4f-49da-876a-accb3fa5fa32","resolution":{"observed_at":"2026-08-02T11:29:29.805566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:29.920049Z","title":"Yo’Chameleon: Personalized vision and language generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:29.920049Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:f3c5f33a2e4cf11fe86a6b9ba2ccc3383e97716af2339d62d45e70c3c61bcc27","observation_id":"1a00f296-aa4e-4f3f-9de8-5349f83b454b","resolution":{"observed_at":"2026-08-02T11:29:29.920049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:30.087271Z","title":"Christiano, Jan Leike, and Ryan Lowe","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:30.087271Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:6d8e840c9a6cad556068d9f8b73a363507af983eb938ed146034c2537e38fce2","observation_id":"3f5cfd40-4b7f-4ac8-aefb-31a92432182b","resolution":{"observed_at":"2026-08-02T11:29:30.087271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:30.185345Z","title":"PLVM: A tuning-free approach for personalized large vision-language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:30.185345Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:d5389734bdf63762bce6330f9522087b7ddebfd9613458224179e508bc3a4543","observation_id":"3e80df0f-b8b8-444e-a6da-77c5c8cc388c","resolution":{"observed_at":"2026-08-02T11:29:30.185345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:30.246992Z","title":"Personalized visual instruction tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:30.246992Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:94d8ffc5480aa9e84b2e03de08808c6997f64a28a772ac3a8d3d8fd4d0aaec4e","observation_id":"78509c1a-264a-4fac-a9bd-e39b72227eb7","resolution":{"observed_at":"2026-08-02T11:29:30.246992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:30.351233Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:30.351233Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:14c4ccb7302c770a469137ab21bbbf1da51f3850621c7c95b533899bd0b5515d","observation_id":"98c2e0fa-172d-4996-920d-5f13ff6a81d5","resolution":{"observed_at":"2026-08-02T11:29:30.351233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:30.478137Z","title":"BPR: Bayesian personalized ranking from implicit feedback","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:30.478137Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:fc7e3816d003773e00697e5bd9f9b38f1617e8d2c549aa8f01f564063abda46c","observation_id":"d96c0728-e52c-411b-ad47-6f5f0707fc4c","resolution":{"observed_at":"2026-08-02T11:29:30.478137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:30.606713Z","title":"Personalization toolkit: Training free personalization of large vision language models.TMLR, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:30.606713Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:32d0817b459e99d739b5af9926a89e126d1060146f948a338a45c1a68820bdfd","observation_id":"8ccddb4b-deaa-467d-bce7-7b6c017a452f","resolution":{"observed_at":"2026-08-02T11:29:30.606713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:30.727186Z","title":"Towards dynamic modality alignment in multimodal continual learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:30.727186Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:bac9bf8ba00a956922debe92724e585da3e2c894d06e1b06463fa8a92519f7ee","observation_id":"811055b7-4aae-476b-8045-dbe863f48d54","resolution":{"observed_at":"2026-08-02T11:29:30.727186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:30.850448Z","title":"Visual position prompt for MLLM based visual grounding.IEEE TMM, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:30.850448Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:7a9b49bbe1b094a911b42605e2720bb749d0d5bbd5a07ab7bb1a89acda43e752","observation_id":"a41217e9-da63-49e8-a298-9575774b35a2","resolution":{"observed_at":"2026-08-02T11:29:30.850448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:31.023823Z","title":"Partition-then-adapt: Combating prediction bias for reliable multi-modal test-time adaptation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:31.023823Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:22e9057399808897d80324bb2238e7c961100a6e79d0540e2757da59d80a9dce","observation_id":"686f50fd-f0aa-4ee9-a342-0b093bc58035","resolution":{"observed_at":"2026-08-02T11:29:31.023823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:31.131329Z","title":"Marten: Visual question answering with mask generation for multi-modal document understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:31.131329Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:3fb9aef5a6ce5a158def59a5ae24c4cedf84e0e502589dd3907b7dba9d9b1ad5","observation_id":"0132162d-3666-4ffa-96e8-0b041d7a0f86","resolution":{"observed_at":"2026-08-02T11:29:31.131329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-02T11:29:31.278555Z","title":"DeepSeek-VL2: Mixture-of-experts vision-language models for advanced multimodal understanding.arXiv preprint arXiv:2412.10302, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:31.278555Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:b4d35ecb1c5e95953ed136c5bc530fe358b086ccc1a59fcf26271e61e6e8649a","observation_id":"9809e8c4-2c23-4d3d-8d2f-2daad1efc998","resolution":{"observed_at":"2026-08-02T11:29:31.278555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:31.350954Z","title":"TG-LLaV A: Text guided LLaV A via learnable latent embeddings.Proceedings of the AAAI Conference on Artificial Intelligence, 39(9):9076–9084, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:31.350954Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:e9af563f05e16cebeea39d6b2af4525c6de76634aec6542b5766691d27a2cd8a","observation_id":"2eadb0ca-9e5c-4e28-aedf-a6ad56ba91df","resolution":{"observed_at":"2026-08-02T11:29:31.350954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:31.455526Z","title":"Meta- personalizing vision-language models to find named instances in video","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:31.455526Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:0b62279f1e6b5243c060b63b5b9448c00cab6b8055c804f2a4350d9034aad6f1","observation_id":"0ca8e6a6-e537-4203-bdc5-b626124dcde0","resolution":{"observed_at":"2026-08-02T11:29:31.455526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:31.530514Z","title":"Personalizing dialogue agents: I have a dog, do you have pets too? InACL, pages 2204–2213, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:31.530514Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:f4f1a486af89357e4af294355c30ecaebb281d3744f2bb16ff15f19f3b76478f","observation_id":"dcede9f4-2d0d-484c-8392-5dca61bcd509","resolution":{"observed_at":"2026-08-02T11:29:31.530514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:31.623035Z","title":"LOV A3: Learning to visual question answering, asking and assessment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:31.623035Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:0b505fa10184231f1ec38e001afe20d6f8a79fb55a0efad3a9ca7295aaf67296","observation_id":"bc6f8f27-b50b-4bdf-9e7f-d84082a97c5f","resolution":{"observed_at":"2026-08-02T11:29:31.623035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:29:31.754112Z","title":"MiniGPT-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:31.754112Z"},"links":{"citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:fadcfc998a69bc0801b296f987dde69569fe5eb6070fb0f1d0aa03123ab1a89f","observation_id":"e5e39ca2-5bdd-4e1e-8159-6dcc334e33db","resolution":{"observed_at":"2026-08-02T11:29:31.754112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-02T11:29:31.841667Z","title":"Ziegler, Nisan Stiennon, Jeffrey Wu, Tom B","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:31.841667Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:b6af3b502f7a69fbc97a8202b31ff42f9d6226e495ffc3205f1f1dc84988c95a","observation_id":"efaa057c-a97f-479a-8902-e032e6d6896a","resolution":{"observed_at":"2026-08-02T11:29:31.841667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2607.22603."}