{"as_of":"2026-08-08T07:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4be62c3b40a64547cac38a09916ac589af3916bc2b6d0cc194e13ef8ec04f9c7","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:28:53.072713Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.05260/citation-record","integrity":"/paper/2506.05260/integrity","json":"/paper/2506.05260/citation-record.json","paper":"/paper/2506.05260"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:56.676716Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"92e504a6-c1ed-40c2-a83e-6498b3f7254a","year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:45.381300Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:92d6f2ac962dc9c26f6ac596c5e97a02b1be3c187cbc1e08fb625fa2bd01d7c7","observation_id":"87599cec-a8c3-49a6-98fb-d1bb2e9aacb7","resolution":{"observed_at":"2026-08-07T10:28:56.790748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:56.463830Z","title":"Generative multimodal models are in-context learners","venue":null,"work_id":"735c3276-da52-4164-a5ca-ff87735b0a26","year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:45.460063Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:0c5fbaa72aa76c3384cbc367b4cd3f48da2c36c6821ad2039a70f7354cc6f2c3","observation_id":"c91fee19-a402-43d6-aa39-22017afc1f14","resolution":{"observed_at":"2026-08-07T10:28:56.569181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:45.550694Z","title":"Vila: On pre-training for visual language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:45.550694Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:eb83fb5512eb1da3b9e03e60e094cfd36788fd0fea6c658e6b3aee95f7b1697d","observation_id":"5c70d3fd-489c-4376-a198-173679d4ffed","resolution":{"observed_at":"2026-08-07T10:28:45.550694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:45.661244Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:45.661244Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:00c10e23f78cd25df8a8e03ac10e6399e89e02220372830f6f4b118f95c51a2e","observation_id":"c4ee9b8e-b97c-4647-b1b4-ce1639322efc","resolution":{"observed_at":"2026-08-07T10:28:45.661244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:45.761050Z","title":"Llava-next: Improved reasoning, ocr, and world knowledge, January 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:45.761050Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:e7770a9c009a887beaabc673d7239ebe9eba2dae06643f107d5f0fa7685abb6d","observation_id":"a366eb47-61fc-4a47-ac23-8144fe241e3d","resolution":{"observed_at":"2026-08-07T10:28:45.761050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:45.887667Z","title":"Llava-next: A strong zero-shot video understanding model, April 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:45.887667Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:778e45af513f7b0fa85c0692330c388e369946b27318d6d27fd42f04fc3a46ab","observation_id":"e67d2d0e-a974-45a8-ac93-dc7007a9bd20","resolution":{"observed_at":"2026-08-07T10:28:45.887667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T10:28:45.998856Z","title":"Llava-onevision: Easy visual task transfer.arXiv preprint arXiv:2408.03326, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:45.998856Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:eca0ea94151f873d67d71cca90f3882c4578c6bf409316c3bc71e4126e60ab78","observation_id":"967a0eea-1615-4424-ac6f-5c8e99da5241","resolution":{"observed_at":"2026-08-07T10:28:45.998856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-02T12:24:31.329178Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02713","snapshot_observed_at":"2026-08-07T10:28:46.132778Z","title":"Video instruction tuning with synthetic data.arXiv preprint arXiv:2410.02713, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:46.132778Z"},"links":{"cited_paper":"/paper/2410.02713","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:ea6109c5307f089f86ab9ccd941340f5754fb988722a188bea81df65dde1fb1d","observation_id":"e09aaaa5-b745-416b-afaa-963f8e4c80b2","resolution":{"observed_at":"2026-08-07T10:28:46.132778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:46.243169Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:46.243169Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:4d20f5bf761f085e39e9e9b60360c5f30d67f356bfaee3b9fa57fea9e9ef6f45","observation_id":"1d141351-52b8-4878-ae0c-406649785dd2","resolution":{"observed_at":"2026-08-07T10:28:46.243169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:56.205517Z","title":"Detecting and preventing hallucinations in large vision language models","venue":null,"work_id":"a0593bf3-78aa-453b-9dd7-319a9a6659dc","year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:46.336455Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:bd68d299323d2ccc2ab3ff1fe0aada0cb9d1865cc4200344ceac015fb357cff0","observation_id":"43ba7005-2f35-48eb-9b53-0d20f3e5b38c","resolution":{"observed_at":"2026-08-07T10:28:56.294640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:56.031441Z","title":"Tuning large multimodal models for videos using reinforcement learning from AI feedback","venue":null,"work_id":"7c724bda-23b2-4ba5-ba57-4c140305bbb5","year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:46.414954Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:2f3c97eaeba22b32a0a4bc7d6dfb5e59a9a868c5530ca85959d4d1093d80baae","observation_id":"0aec69c4-55a2-4614-a893-da89764a2ef1","resolution":{"observed_at":"2026-08-07T10:28:56.112709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11280","last_updated":"2025-01-08T03:18:23Z","snapshot_observed_at":"2026-07-06T18:32:02.206165Z","submitted_at":"2024-06-17T07:33:30Z","title":"ISR-DPO: Aligning Large Multimodal Models for Videos by Iterative Self-Retrospective DPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11280","snapshot_observed_at":"2026-08-07T10:28:46.520071Z","title":"i-srt: Aligning large multimodal models for videos by iterative self-retrospective judgment.arXiv preprint arXiv:2406.11280, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:46.520071Z"},"links":{"cited_paper":"/paper/2406.11280","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:97abec1d17aeb85f021f79c5e4ce2f32c49a8b188bfd923f1f598072139c72d3","observation_id":"133ef95f-1b8f-492a-a37f-8edfac11ae9d","resolution":{"observed_at":"2026-08-07T10:28:46.520071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01258","last_updated":"2024-04-02T12:47:49Z","snapshot_observed_at":"2026-08-08T06:22:53.769876Z","submitted_at":"2024-04-01T17:28:16Z","title":"Direct Preference Optimization of Video Large Multimodal Models from Language Model Reward","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01258","snapshot_observed_at":"2026-08-07T10:28:46.600253Z","title":"Direct preference optimization of video large multimodal models from language model reward.arXiv preprint arXiv:2404.01258, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:46.600253Z"},"links":{"cited_paper":"/paper/2404.01258","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:74b74c58419922b846af23dcc8eb74f29a3ecf4de6ab8df55e39def42bd290d6","observation_id":"62eede0d-e51d-42aa-8b72-ca8e342585ba","resolution":{"observed_at":"2026-08-07T10:28:46.600253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13919","last_updated":"2025-09-01T07:50:58Z","snapshot_observed_at":"2026-07-06T20:25:08.527025Z","submitted_at":"2025-01-23T18:58:03Z","title":"Temporal Preference Optimization for Long-Form Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13919","snapshot_observed_at":"2026-08-07T10:28:46.708160Z","title":"Temporal preference optimization for long-form video understanding.arXiv preprint arXiv:2501.13919, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:46.708160Z"},"links":{"cited_paper":"/paper/2501.13919","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:aaeaa9564000cb00a08292688d61aa55d6a505e1320966e77042c6e05a7aaf8a","observation_id":"94a971de-4074-476a-9cf7-63b5e04448ba","resolution":{"observed_at":"2026-08-07T10:28:46.708160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08847","last_updated":"2025-04-27T15:21:29Z","snapshot_observed_at":"2026-07-06T19:31:49.052556Z","submitted_at":"2024-10-11T14:22:44Z","title":"Unintentional Unalignment: Likelihood Displacement in Direct Preference Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08847","snapshot_observed_at":"2026-08-07T10:28:46.995120Z","title":"Unintentional unalignment: Likelihood displacement in direct preference optimization.arXiv preprint arXiv:2410.08847, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:46.995120Z"},"links":{"cited_paper":"/paper/2410.08847","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:5b2c13238a7af144fa25cf1a2b7ea88cc4cfd4cab4781dee8904a1a5e19fce5d","observation_id":"c508bcee-1390-4374-963a-a09fa2b00bcc","resolution":{"observed_at":"2026-08-07T10:28:46.995120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12358","last_updated":"2024-08-12T21:13:35Z","snapshot_observed_at":"2026-07-06T18:02:19.428801Z","submitted_at":"2024-04-18T17:37:02Z","title":"From $r$ to $Q^*$: Your Language Model is Secretly a Q-Function","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12358","snapshot_observed_at":"2026-08-07T10:28:47.055899Z","title":"From r to q∗: Your language model is secretly a q-function.arXiv preprint arXiv:2404.12358, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:47.055899Z"},"links":{"cited_paper":"/paper/2404.12358","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:ad48251acd8acc695786ea1456212fcda94b8d0d41cd9347d649ba75b5d8bf96","observation_id":"3d84090d-c768-4a67-be3f-dbbf84471ef6","resolution":{"observed_at":"2026-08-07T10:28:47.055899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13228","last_updated":"2024-07-03T13:46:33Z","snapshot_observed_at":"2026-07-31T05:05:41.080329Z","submitted_at":"2024-02-20T18:42:34Z","title":"Smaug: Fixing Failure Modes of Preference Optimisation with DPO-Positive","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13228","snapshot_observed_at":"2026-08-07T10:28:47.117231Z","title":"Smaug: Fixing failure modes of preference optimisation with dpo-positive.arXiv preprint arXiv:2402.13228, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:47.117231Z"},"links":{"cited_paper":"/paper/2402.13228","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:3d388e3df8f186e2db8f023ac2561c94d323c3639a610c21aa480bec201d90c4","observation_id":"11c3c272-c05d-49cc-abdd-ef5cafae400c","resolution":{"observed_at":"2026-08-07T10:28:47.117231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14367","last_updated":"2024-06-02T22:00:42Z","snapshot_observed_at":"2026-07-06T18:03:51.687441Z","submitted_at":"2024-04-22T17:20:18Z","title":"Preference Fine-Tuning of LLMs Should Leverage Suboptimal, On-Policy Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14367","snapshot_observed_at":"2026-08-07T10:28:47.187005Z","title":"Preference fine-tuning of llms should leverage suboptimal, on-policy data.arXiv preprint arXiv:2404.14367, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:47.187005Z"},"links":{"cited_paper":"/paper/2404.14367","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:bb97ae5a5ea87e44fc63f8c082c948eefed682046c3884e4810dc97ef40d58a3","observation_id":"f636b544-d400-46e2-9613-c3a0e5458869","resolution":{"observed_at":"2026-08-07T10:28:47.187005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07599","last_updated":"2025-06-06T11:18:28Z","snapshot_observed_at":"2026-08-08T06:58:38.738384Z","submitted_at":"2025-02-11T14:49:44Z","title":"DPO-Shift: Shifting the Distribution of Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":"2502.07599","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.07599","snapshot_observed_at":"2026-08-07T10:28:54.031274Z","title":"DPO-Shift: Shifting the Distribution of Direct Preference Optimization","venue":"cs.CL","work_id":"4b8dccb6-eb77-4c87-95bf-3d6e33b1c757","year":2025},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:47.271156Z"},"links":{"cited_paper":"/paper/2502.07599","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:dabc16910b2beadf3944d065ce1485313a1199dc8fd0624b0ad2704550cdab4b","observation_id":"9ec5bba3-48a6-487e-b041-1bc3367e23d9","resolution":{"observed_at":"2026-08-07T10:28:54.149778Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16436","last_updated":"2024-12-04T08:15:35Z","snapshot_observed_at":"2026-07-06T18:20:01.382394Z","submitted_at":"2024-05-26T05:38:50Z","title":"Provably Mitigating Overoptimization in RLHF: Your SFT Loss is Implicitly an Adversarial Regularizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16436","snapshot_observed_at":"2026-08-07T10:28:47.390690Z","title":"Provably mitigating overoptimization in rlhf: Your sft loss is implicitly an adversarial regularizer.arXiv preprint arXiv:2405.16436, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:47.390690Z"},"links":{"cited_paper":"/paper/2405.16436","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:6239e46bd6749c1bbdf9f7566eadb0bbc6139005f5af04be71eccc6a32d69849","observation_id":"551e7d34-90c3-4fd9-adf5-b9717b571467","resolution":{"observed_at":"2026-08-07T10:28:47.390690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:55.877122Z","title":"Introducing chatgpt.CoRR, 2022","venue":null,"work_id":"909347ff-5bf7-4b63-a446-6b0403a36c3f","year":2022},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:47.480018Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:f362d18cfa45da753aa864fe330a401604b4eb99513a0e0b6bbc775c64fab70a","observation_id":"c671aef6-8fcd-43e7-b4ee-7f5795c410e1","resolution":{"observed_at":"2026-08-07T10:28:55.929693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:47.602865Z","title":"GPT-4 technical report.CoRR, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:47.602865Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:ce15d1ca9d306786b3e5f57d4f04a167b4b9b96ec98d74452305ee0b88078bfc","observation_id":"eab90330-9598-42d5-bee6-5e593e4ab5a7","resolution":{"observed_at":"2026-08-07T10:28:47.602865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T10:28:47.725396Z","title":"LLaMA 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:47.725396Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:ed1632c61577eee1c37420d13c51058060ad475b4bc4fb759121341d35b0271e","observation_id":"fdc7ab15-ccc6-490e-9e1f-900c4fb4f293","resolution":{"observed_at":"2026-08-07T10:28:47.725396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T10:28:47.829591Z","title":"Qwen2 technical report.arXiv preprint arXiv:2407.10671, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:47.829591Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:abca5a160d17246a8a01bf29cefa81301f36fb4dbd89e5950e2e23b1b4ad16d0","observation_id":"1994fffd-2d34-401e-90fa-5bd7a6787b76","resolution":{"observed_at":"2026-08-07T10:28:47.829591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:47.913327Z","title":"Deep reinforcement learning from human preferences.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:47.913327Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:48b58b0415c956485584c9906d9cbb2bff6d72a45cbbb808151034b298c54f80","observation_id":"3596279b-d390-4ac8-8476-d3fc2816c3c1","resolution":{"observed_at":"2026-08-07T10:28:47.913327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T10:28:48.035884Z","title":"Constitutional ai: Harmlessness from ai feedback.arXiv preprint arXiv:2212.08073, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:48.035884Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:27d46c833d03c0d5b1856faeae7b1fd24334bfb58521cce073e013d747a8483d","observation_id":"ab522e8b-65f0-4613-8b55-db444a01e5c3","resolution":{"observed_at":"2026-08-07T10:28:48.035884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:48.096937Z","title":"Preference ranking optimization for human alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:48.096937Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:f70b2a2f37df2dd39b6d50c518cdb6f2dba12bf41d32e05b4d946e66d22b425c","observation_id":"4cd34a1f-f641-495b-8c86-e039e87f0a81","resolution":{"observed_at":"2026-08-07T10:28:48.096937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01878","last_updated":"2025-01-24T19:13:34Z","snapshot_observed_at":"2026-07-06T17:24:37.090243Z","submitted_at":"2024-02-02T20:08:10Z","title":"LiPO: Listwise Preference Optimization through Learning-to-Rank","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01878","snapshot_observed_at":"2026-08-07T10:28:48.212275Z","title":"Lipo: Listwise preference optimization through learning-to-rank.arXiv preprint arXiv:2402.01878, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:48.212275Z"},"links":{"cited_paper":"/paper/2402.01878","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:aad30fb5cf39dd219ecd825fa39b2eccd7ab3ecaff6a10833317237525e18616","observation_id":"98d5ad29-7c6a-41bb-900b-d36ab5f2d551","resolution":{"observed_at":"2026-08-07T10:28:48.212275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:48.339711Z","title":"Orpo: Monolithic preference optimization without reference model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:48.339711Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:512e95a7834d4866d84bfb1a8c87da9712eccf2dfefcd910f3dfbb358c1bc53e","observation_id":"2706551a-be43-4870-ba5b-aeb482090f73","resolution":{"observed_at":"2026-08-07T10:28:48.339711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14734","last_updated":"2024-11-01T20:05:19Z","snapshot_observed_at":"2026-08-03T02:02:15.325394Z","submitted_at":"2024-05-23T16:01:46Z","title":"SimPO: Simple Preference Optimization with a Reference-Free Reward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14734","snapshot_observed_at":"2026-08-07T10:28:48.465974Z","title":"Simpo: Simple preference optimization with a reference-free reward.arXiv preprint arXiv:2405.14734, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:48.465974Z"},"links":{"cited_paper":"/paper/2405.14734","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:9c0d4ca628e856e4b6f220eb17c33c3bfb56efb1b3f37d90f95b92d7a69ee178","observation_id":"7e9011be-a790-4f63-91ec-4a4a6320fcfe","resolution":{"observed_at":"2026-08-07T10:28:48.465974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-07T10:28:48.558901Z","title":"Kto: Model alignment as prospect theoretic optimization.arXiv preprint arXiv:2402.01306, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:48.558901Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:1f921b684c1e4ba838f45ba1fbbba06d81122357bb71502418ee470ca3fa1fe1","observation_id":"7406bc35-b70f-497b-b0f2-4f08220f4fd1","resolution":{"observed_at":"2026-08-07T10:28:48.558901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:55.594483Z","title":"β-dpo: Direct preference optimization with dynamic β.Advances in Neural Information Processing Systems, 37:129944–129966, 2024","venue":null,"work_id":"eb33bd43-89ce-4e6b-9c5e-ad6857d02021","year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:48.688666Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:b77e46e3b635ee9febc8395d878020aa43d6fc82e8e8c8449c147a181ad938b6","observation_id":"17fbe66b-8f0a-4173-81f6-023008380142","resolution":{"observed_at":"2026-08-07T10:28:55.714997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:55.430639Z","title":"Rlhf-v: Towards trustworthy mllms via behavior alignment from fine-grained correctional human feedback","venue":null,"work_id":"943092a7-f776-4a98-b02f-a1528c362853","year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:48.772450Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:11e81a4310835031b609720f9e574a1d7acad46a430ece4bf7880dd4f58f4a89","observation_id":"41dcf136-d98c-40d1-9cea-83db0000177c","resolution":{"observed_at":"2026-08-07T10:28:55.511918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:48.905011Z","title":"Rlaif-v: Aligning mllms through open-source ai feedback for super gpt-4v trustworthiness.arXiv preprint arXiv:2405.17220, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:48.905011Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:ee260dcf6e89bd595012b0a2ce5fdb8a709cd6cd8d21afaa0a07a417dceef611","observation_id":"853e42d9-1765-442f-9db5-228dbbe3669d","resolution":{"observed_at":"2026-08-07T10:28:48.905011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10665","last_updated":"2023-12-17T09:44:27Z","snapshot_observed_at":"2026-07-06T17:04:13.625458Z","submitted_at":"2023-12-17T09:44:27Z","title":"Silkie: Preference Distillation for Large Visual Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10665","snapshot_observed_at":"2026-08-07T10:28:49.027723Z","title":"Silkie: Preference distillation for large visual language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:49.027723Z"},"links":{"cited_paper":"/paper/2312.10665","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:e076185b3cbc1c66e4d435157baa8d7b0009fc1eb00bc281ef8ddcf201c604b7","observation_id":"96db0a19-af0d-4def-b013-5187b34ca691","resolution":{"observed_at":"2026-08-07T10:28:49.027723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14622","last_updated":"2024-11-02T02:51:51Z","snapshot_observed_at":"2026-07-30T21:22:18.339303Z","submitted_at":"2024-05-23T14:30:33Z","title":"Calibrated Self-Rewarding Vision Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14622","snapshot_observed_at":"2026-08-07T10:28:49.151530Z","title":"Calibrated self-rewarding vision language models.arXiv preprint arXiv:2405.14622, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:49.151530Z"},"links":{"cited_paper":"/paper/2405.14622","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:524ce3cbce75eb2138e0d15ac2c123c718779391c2c16908d5237c42bf24cd4c","observation_id":"689686d6-4939-47c3-a39c-cfdbe7056327","resolution":{"observed_at":"2026-08-07T10:28:49.151530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11411","last_updated":"2024-02-18T00:56:16Z","snapshot_observed_at":"2026-07-06T17:31:41.687799Z","submitted_at":"2024-02-18T00:56:16Z","title":"Aligning Modalities in Vision Large Language Models via Preference Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11411","snapshot_observed_at":"2026-08-07T10:28:49.316868Z","title":"Aligning modali- ties in vision large language models via preference fine-tuning.arXiv preprint arXiv:2402.11411, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:49.316868Z"},"links":{"cited_paper":"/paper/2402.11411","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:252bb913be068161c2d28087e824c595a7b3cee2c7055def3c2b25c7192adeb1","observation_id":"3f21cf8d-a24b-47be-a337-9c536218f6ed","resolution":{"observed_at":"2026-08-07T10:28:49.316868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:55.281442Z","title":"Strengthening multimodal large language model with bootstrapped preference optimization","venue":null,"work_id":"36e72aa8-04ba-4fb9-a065-f4a7f7c8f27b","year":2025},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:49.413288Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:1d4916fcff1b6cd408e006b861d0afd52cf7e70510eac079f210dd88265cbe7d","observation_id":"c6a66a8c-c5fb-4e99-9b94-f1979f5e9ac7","resolution":{"observed_at":"2026-08-07T10:28:55.332426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10501","last_updated":"2024-08-21T11:36:47Z","snapshot_observed_at":"2026-07-06T18:00:52.903522Z","submitted_at":"2024-04-16T12:19:54Z","title":"Self-Supervised Visual Preference Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10501","snapshot_observed_at":"2026-08-07T10:28:49.538730Z","title":"Self-supervised visual preference alignment.arXiv preprint arXiv:2404.10501, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:49.538730Z"},"links":{"cited_paper":"/paper/2404.10501","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:d17b6ec710e432c6d4f5358ec82aba3942bcacc19497d52c1d5fbca7ea7cf193","observation_id":"c1555e19-d7ec-4741-bafd-f014c10d7c53","resolution":{"observed_at":"2026-08-07T10:28:49.538730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19716","last_updated":"2024-11-24T03:47:38Z","snapshot_observed_at":"2026-08-04T15:18:22.654819Z","submitted_at":"2024-05-30T05:53:49Z","title":"Enhancing Large Vision Language Models with Self-Training on Image Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19716","snapshot_observed_at":"2026-08-07T10:28:49.630859Z","title":"Enhancing large vision language models with self-training on image comprehension","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:49.630859Z"},"links":{"cited_paper":"/paper/2405.19716","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:ea058a433f4df63fe5be77041498261b3bbf5d0deef91d03d7f34d7eecdfeb74","observation_id":"40649a4a-21ce-4624-8dde-4a990aab741a","resolution":{"observed_at":"2026-08-07T10:28:49.630859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02712","last_updated":"2024-11-05T01:24:37Z","snapshot_observed_at":"2026-07-06T19:45:17.343568Z","submitted_at":"2024-11-05T01:24:37Z","title":"V-DPO: Mitigating Hallucination in Large Vision Language Models via Vision-Guided Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02712","snapshot_observed_at":"2026-08-07T10:28:49.730599Z","title":"V-dpo: Mitigating hallucination in large vision language models via vision-guided direct preference optimization.arXiv preprint arXiv:2411.02712, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:49.730599Z"},"links":{"cited_paper":"/paper/2411.02712","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:6a6d162f5b211aac99d2b757ff3dfdb9213ef7e26ead8d33103de5bda148e7cd","observation_id":"f4faa711-20ac-454d-a55f-eed1ac93a9dc","resolution":{"observed_at":"2026-08-07T10:28:49.730599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02712","last_updated":"2025-03-04T00:49:07Z","snapshot_observed_at":"2026-08-06T04:32:16.849942Z","submitted_at":"2024-10-03T17:36:33Z","title":"LLaVA-Critic: Learning to Evaluate Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02712","snapshot_observed_at":"2026-08-07T10:28:49.885639Z","title":"Llava-critic: Learning to evaluate multimodal models.arXiv preprint arXiv:2410.02712, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:49.885639Z"},"links":{"cited_paper":"/paper/2410.02712","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:e204720cbf9728ca8cde3cf985b96777329d039846bd2099f47ad589153dbb7c","observation_id":"7219ed15-c1e1-48dd-91da-592f664f44aa","resolution":{"observed_at":"2026-08-07T10:28:49.885639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:50.011445Z","title":"Gpt-4v(ision) system card","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:50.011445Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:4d44a43d70e3edb781bf51e56cfdf2c782c8e4c1b6d3b7a9182c22f1c01772fb","observation_id":"a6333614-1407-4612-933e-b8d170676237","resolution":{"observed_at":"2026-08-07T10:28:50.011445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17637","last_updated":"2024-10-23T07:56:48Z","snapshot_observed_at":"2026-08-01T22:56:26.693527Z","submitted_at":"2024-10-23T07:56:48Z","title":"MIA-DPO: Multi-Image Augmented Direct Preference Optimization For Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17637","snapshot_observed_at":"2026-08-07T10:28:50.117579Z","title":"Mia-dpo: Multi-image augmented direct preference optimization for large vision-language models.arXiv preprint arXiv:2410.17637, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:50.117579Z"},"links":{"cited_paper":"/paper/2410.17637","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:32317c4a9a584f9683df93ee73a8d5814ff2d72c706b52901a197cb48addbe07","observation_id":"f1fe44d6-e2ed-434f-a21f-4265d75d4059","resolution":{"observed_at":"2026-08-07T10:28:50.117579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-07T10:28:50.207227Z","title":"Video-mme: The first-ever comprehensive evaluation benchmark of multi-modal llms in video analysis.arXiv preprint arXiv:2405.21075, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:50.207227Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:ff0ec9364d6396e3b041e6ac674efa35f18add1c82d12c2fb48e8bcafbfbfbdc","observation_id":"3270e2b8-a8ea-4c7b-b7af-cb578d67f968","resolution":{"observed_at":"2026-08-07T10:28:50.207227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:50.305434Z","title":"Longvideobench: A benchmark for long-context interleaved video-language understanding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:50.305434Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:3f3ad5ba59d713f009961f76b64f4fe9c40fea42438d30c8c2a2ca8940a74c95","observation_id":"77c20d65-4420-448d-8ece-1103be391e81","resolution":{"observed_at":"2026-08-07T10:28:50.305434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04264","last_updated":"2025-01-01T15:53:58Z","snapshot_observed_at":"2026-08-03T20:38:36.602554Z","submitted_at":"2024-06-06T17:09:32Z","title":"MLVU: Benchmarking Multi-task Long Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04264","snapshot_observed_at":"2026-08-07T10:28:50.404469Z","title":"Mlvu: A comprehensive benchmark for multi-task long video understanding.arXiv preprint arXiv:2406.04264, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:50.404469Z"},"links":{"cited_paper":"/paper/2406.04264","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:c3a5845fb85f18b34e9997cef0d461b3bd0fa15803c133be3a91556a0de3919e","observation_id":"9d08fe25-05d8-44b6-baff-994531e31581","resolution":{"observed_at":"2026-08-07T10:28:50.404469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:55.063811Z","title":"Next-qa: Next phase of question- answering to explaining temporal actions","venue":null,"work_id":"5c5230ff-9090-42bf-b5f3-c54785c3b602","year":2021},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:50.481389Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:a34f01ccf5b10f9b9c453cb32a819994508f7e43ce9bdb2e39f574a07527fb13","observation_id":"26833bff-6594-4913-b455-b17868a7c612","resolution":{"observed_at":"2026-08-07T10:28:55.165696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00634","last_updated":"2024-09-24T04:41:08Z","snapshot_observed_at":"2026-08-07T00:13:25.095002Z","submitted_at":"2024-06-30T09:21:01Z","title":"Tarsier: Recipes for Training and Evaluating Large Video Description Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00634","snapshot_observed_at":"2026-08-07T10:28:50.622545Z","title":"Tarsier: Recipes for training and evaluating large video description models.arXiv preprint arXiv:2407.00634, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:50.622545Z"},"links":{"cited_paper":"/paper/2407.00634","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:a4c744d1984163251b4e79597f0fc305b5206b5b37788d602450eecc9b58f170","observation_id":"543f8e17-0ffc-4fd6-aac0-f39935557265","resolution":{"observed_at":"2026-08-07T10:28:50.622545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-07T10:28:50.714518Z","title":"Video-chatgpt: Towards detailed video understanding via large vision and language models.arXiv preprint arXiv:2306.05424, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:50.714518Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:83b77eee82ee9aba5daeae58c189511e2a94a815881bec6bb5888b0006c814f9","observation_id":"e688c280-5d0b-486c-b6e6-65394988a969","resolution":{"observed_at":"2026-08-07T10:28:50.714518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10122","last_updated":"2024-10-01T12:07:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-16T10:59:44Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10122","snapshot_observed_at":"2026-08-07T10:28:50.810656Z","title":"Video-llava: Learning united visual representation by alignment before projection.arXiv preprint arXiv:2311.10122, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:50.810656Z"},"links":{"cited_paper":"/paper/2311.10122","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:2a6a1e0bc672795a719456ea7f5f205c7d0cbcf722fb19f433c99e09a55da7dd","observation_id":"f80aa099-eb9c-451d-9aa0-396919a9d63b","resolution":{"observed_at":"2026-08-07T10:28:50.810656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T10:28:50.920945Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond.arXiv preprint arXiv:2308.12966, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:50.920945Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:810475467440eaf91a4c2770704e8ad842e7fdbc04d037fcc41d433c521291db","observation_id":"96c989f9-ebcf-4710-9e98-2e1186146552","resolution":{"observed_at":"2026-08-07T10:28:50.920945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04325","last_updated":"2024-06-06T17:58:54Z","snapshot_observed_at":"2026-07-06T18:26:42.010940Z","submitted_at":"2024-06-06T17:58:54Z","title":"ShareGPT4Video: Improving Video Understanding and Generation with Better Captions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04325","snapshot_observed_at":"2026-08-07T10:28:51.015037Z","title":"Sharegpt4video: Improving video understanding and generation with better captions.arXiv preprint arXiv:2406.04325, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:51.015037Z"},"links":{"cited_paper":"/paper/2406.04325","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:92f17a414d7addeb12e08dac9990d443d57be2f78268803c218a0046fc9eba86","observation_id":"c2782dec-d4a8-494b-bbe4-8deb106d887f","resolution":{"observed_at":"2026-08-07T10:28:51.015037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:51.104238Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:51.104238Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:7c86b98addb01eeb761555e479e96d67e1caf4aa913628bd790891d4354f3c10","observation_id":"67ea4abd-87d7-4b0b-9e40-e8b935b22aa5","resolution":{"observed_at":"2026-08-07T10:28:51.104238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:54.857063Z","title":"aws-prototyping/long-llava-qwen2-7b, 2024","venue":null,"work_id":"97b3c33e-6934-4a50-b049-aed067114cb7","year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:51.329194Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:e581e2a764cff4fe460304e8cd97603426edaf4255412fae65a41b445c923c31","observation_id":"04fb546c-0951-41d1-bce2-934208d8a927","resolution":{"observed_at":"2026-08-07T10:28:54.932150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14023","last_updated":"2024-08-26T05:27:14Z","snapshot_observed_at":"2026-08-07T05:22:51.503928Z","submitted_at":"2024-08-26T05:27:14Z","title":"Video-CCAM: Enhancing Video-Language Understanding with Causal Cross-Attention Masks for Short and Long Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14023","snapshot_observed_at":"2026-08-07T10:28:51.431837Z","title":"Video-ccam: Enhancing video-language understanding with causal cross-attention masks for short and long videos.arXiv preprint arXiv:2408.14023, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:51.431837Z"},"links":{"cited_paper":"/paper/2408.14023","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:b14469885c0f0878c1b3f3eea7f2f0187b9258fd3ffa754dd499a29475a9e690","observation_id":"97b1818a-42de-4fdb-820d-985568e79bc4","resolution":{"observed_at":"2026-08-07T10:28:51.431837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-08-07T09:52:45.942315Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16852","snapshot_observed_at":"2026-08-07T10:28:51.563326Z","title":"Long context transfer from language to vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:51.563326Z"},"links":{"cited_paper":"/paper/2406.16852","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:dd72a0804d46abdfc1dbb77cc8637a5a95063094e65f7c869a452a9bc582a300","observation_id":"d56b795a-64cc-4291-86fd-07789b11d2f0","resolution":{"observed_at":"2026-08-07T10:28:51.563326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:54.687089Z","title":"Temporal alignment networks for long-term video","venue":null,"work_id":"ea06f357-11df-4e56-adf0-8d3d17d9b9a5","year":2022},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:51.695307Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:f1c271b2c4862f1343993ccb00d45c08f767894a7bfc8a85cb0f8c2c61a2f882","observation_id":"cbeb08f8-64c3-46e3-a966-d5eae9f61395","resolution":{"observed_at":"2026-08-07T10:28:54.760273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17005","last_updated":"2024-05-23T14:49:29Z","snapshot_observed_at":"2026-07-06T16:53:55.269172Z","submitted_at":"2023-11-28T17:59:04Z","title":"MVBench: A Comprehensive Multi-modal Video Understanding Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17005","snapshot_observed_at":"2026-08-07T10:28:51.806239Z","title":"Mvbench: A comprehensive multi-modal video understanding benchmark","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:51.806239Z"},"links":{"cited_paper":"/paper/2311.17005","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:d952e4cc7619e8619570fb80695fdb31a893bbe743963c0c4f2bde264d047aa2","observation_id":"ded1134d-8f6e-40d4-bcd3-355b0f706f3f","resolution":{"observed_at":"2026-08-07T10:28:51.806239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03413","last_updated":"2024-04-04T12:46:01Z","snapshot_observed_at":"2026-07-06T17:55:36.748672Z","submitted_at":"2024-04-04T12:46:01Z","title":"MiniGPT4-Video: Advancing Multimodal LLMs for Video Understanding with Interleaved Visual-Textual Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03413","snapshot_observed_at":"2026-08-07T10:28:51.919841Z","title":"Minigpt4-video: Advancing multimodal llms for video understanding with interleaved visual-textual tokens.arXiv preprint arXiv:2404.03413, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:51.919841Z"},"links":{"cited_paper":"/paper/2404.03413","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:30dab0911bbaa8920dc602032cdde4f5a8c2f8a0eae767dcbe842e9956bfc1da","observation_id":"90c069d5-78fa-4889-9b20-ecc8e2e66d6c","resolution":{"observed_at":"2026-08-07T10:28:51.919841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16994","last_updated":"2024-04-29T14:52:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T19:29:55Z","title":"PLLaVA : Parameter-free LLaVA Extension from Images to Videos for Video Dense Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16994","snapshot_observed_at":"2026-08-07T10:28:52.036063Z","title":"Pllava: Parameter-free llava extension from images to videos for video dense captioning.arXiv preprint arXiv:2404.16994, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.036063Z"},"links":{"cited_paper":"/paper/2404.16994","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:05acaa8fa5611a10e8d40f74fa99b69f76cdcce318a376d254fc09ff48ddb65c","observation_id":"841de52e-6fdb-4cd1-932e-e5d78859507a","resolution":{"observed_at":"2026-08-07T10:28:52.036063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-07T10:28:52.131174Z","title":"Videochat: Chat-centric video understanding.arXiv preprint arXiv:2305.06355, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.131174Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:d0600c28902080339e847ba914824408becb0e21d0f5ddcef762df4da09f785a","observation_id":"b5bc3b82-eb86-4917-8094-c69ed13df073","resolution":{"observed_at":"2026-08-07T10:28:52.131174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:54.530023Z","title":"Vista-llama: Reducing hallucination in video language models via equal distance to visual tokens","venue":null,"work_id":"5032b6d3-a0e4-46b3-a38e-24e9745a7a29","year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.249257Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:3b87807651bfbbabe7a8462f9e5959ba71edcbc8e3bffa0aa781a6e934578c45","observation_id":"025af6e4-5523-48a3-bbb0-a31e17236f2c","resolution":{"observed_at":"2026-08-07T10:28:54.600521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:54.330867Z","title":"Moviechat: From dense token to sparse memory for long video understanding","venue":null,"work_id":"6221acef-d3cf-44ba-ac63-619f75c17f4b","year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.323626Z"},"links":{"citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:18f3983b458c654b43ffe31823b4d6e30b48965041e66f138c57934453dec6c6","observation_id":"d4fe6a54-53d8-4197-bbb9-0a3aba7e0de1","resolution":{"observed_at":"2026-08-07T10:28:54.420895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08046","last_updated":"2024-04-05T15:21:09Z","snapshot_observed_at":"2026-07-06T16:47:17.136168Z","submitted_at":"2023-11-14T10:11:36Z","title":"Chat-UniVi: Unified Visual Representation Empowers Large Language Models with Image and Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08046","snapshot_observed_at":"2026-08-07T10:28:52.406829Z","title":"Chat-univi: Unified visual representation empowers large language models with image and video understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.406829Z"},"links":{"cited_paper":"/paper/2311.08046","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:21241325dfb5e2061f5d30d26735efb528a870214ed1d7695497ba614b32978e","observation_id":"6381f0d3-ecab-48cd-815c-29a40fcc0c55","resolution":{"observed_at":"2026-08-07T10:28:52.406829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04640","last_updated":"2024-03-07T16:31:02Z","snapshot_observed_at":"2026-08-03T18:43:24.966971Z","submitted_at":"2024-03-07T16:31:02Z","title":"CAT: Enhancing Multimodal Large Language Model to Answer Questions in Dynamic Audio-Visual Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04640","snapshot_observed_at":"2026-08-07T10:28:52.514103Z","title":"Cat: enhancing multimodal large language model to answer questions in dynamic audio-visual scenarios.arXiv preprint arXiv:2403.04640, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.514103Z"},"links":{"cited_paper":"/paper/2403.04640","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:1a8da87d71b7cd729a60d947978855feb14ea61db52c0d5d9b296f4612d292b2","observation_id":"5518530f-bb48-4847-adfb-cf52eff7b58f","resolution":{"observed_at":"2026-08-07T10:28:52.514103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00308","last_updated":"2024-03-30T10:11:26Z","snapshot_observed_at":"2026-08-03T16:21:15.084317Z","submitted_at":"2024-03-30T10:11:26Z","title":"ST-LLM: Large Language Models Are Effective Temporal Learners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00308","snapshot_observed_at":"2026-08-07T10:28:52.598295Z","title":"St-llm: Large language models are effective temporal learners.arXiv preprint arXiv:2404.00308, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.598295Z"},"links":{"cited_paper":"/paper/2404.00308","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:89ae70ea86da4b90120f6a3e9c90cc64ff63a57402c001a5070c813514ed12f4","observation_id":"b1649634-71a0-4263-bd39-1fb94d03ec3e","resolution":{"observed_at":"2026-08-07T10:28:52.598295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T10:28:52.675004Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.675004Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:d9bd9d99db61f5e1e416d530105d34d8ac2ba8d48ccf51a357b4dc001f7ea45a","observation_id":"7630b6a7-429d-4150-9796-7b38c732fd6a","resolution":{"observed_at":"2026-08-07T10:28:52.675004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T10:28:52.769185Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.769185Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:75c542d8df18fdc7e47e1676083bd8a1348a42c814ae59a7b5c0c76738b44b6a","observation_id":"27afb509-f49e-4f96-9c8d-6ab3dd4736e1","resolution":{"observed_at":"2026-08-07T10:28:52.769185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T10:28:52.855846Z","title":"Visual instruction tuning.arXiv preprint arXiv:2304.08485, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.855846Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:fdb836a52df43286a6f2f04dcf37a1f863f919fbc5ee0b66faf7276805b4e8b0","observation_id":"efd4f661-ed5e-4a93-8567-59ebe3793f39","resolution":{"observed_at":"2026-08-07T10:28:52.855846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15973","last_updated":"2025-02-08T21:50:41Z","snapshot_observed_at":"2026-07-06T18:19:38.561528Z","submitted_at":"2024-05-24T23:09:27Z","title":"Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15973","snapshot_observed_at":"2026-08-07T10:28:52.987620Z","title":"Enhancing visual-language modality alignment in large vision language models via self-improvement.arXiv preprint arXiv:2405.15973, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.987620Z"},"links":{"cited_paper":"/paper/2405.15973","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:240131a4a3d1a7e4adb64018720da4629bc59c443ebf104c399d9b0f6dbba487","observation_id":"e873ec0a-ab0b-4f29-a3b5-edc9fc45642c","resolution":{"observed_at":"2026-08-07T10:28:52.987620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-07T10:28:53.072713Z","title":"Aligning large multimodal models with factually augmented rlhf.arXiv preprint arXiv:2309.14525, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.072713Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2506.05260"},"observation_digest":"sha256:633c385f057acb5846512dd8a0547039bea7809d71a23df0c807d002ac200e06","observation_id":"45796a56-d9a6-4f0d-ba93-5557fe424b6e","resolution":{"observed_at":"2026-08-07T10:28:53.072713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.05260","last_updated":"2025-06-05T17:21:16Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:19:37.470353Z","submitted_at":"2025-06-05T17:21:16Z","title":"LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2506.05260."}