{"as_of":"2026-08-24T01:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2ff8ca40d2d62daaeedf210c956ae9c019136054306c885de29dd71ef3b5858","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:01:30.169786Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.08507/citation-record","integrity":"/paper/2505.08507/integrity","json":"/paper/2505.08507/citation-record.json","paper":"/paper/2505.08507"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:29.910923Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.910923Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:44bf3acfb6f0ff2670103a2e50f38f2e4e2470e6028a405dd3a63e2e38ddb7b2","observation_id":"853756a2-cb3f-41c9-a2ed-471a2f0f7948","resolution":{"observed_at":"2026-08-15T22:01:29.910923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:29.916104Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.916104Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:4be5c81c317dbe38557cf04ca0f6d0a5e9c7a029555f0017258ecf6132ebb241","observation_id":"3bfc6b3f-6fcf-40c6-adf9-d6e882849614","resolution":{"observed_at":"2026-08-15T22:01:29.916104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.995216Z","title":null,"venue":null,"work_id":"f1223455-c14b-4563-8b88-8f9f3115b7ec","year":2019},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.920988Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:1d66e9b1634e1de267df8892e6dfae4c12b183697ed0736d57208c2c014ea035","observation_id":"8bab2e73-a639-4005-a585-ef0d2c974344","resolution":{"observed_at":"2026-08-15T22:01:30.999530Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-15T22:01:29.925276Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.925276Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:9e4cfe69a6697d166b9176a182a119fd4414898d0e8cdc98459340178859289b","observation_id":"8c749b8c-beaf-4c4f-bf2a-54467204a8a3","resolution":{"observed_at":"2026-08-15T22:01:29.925276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:29.929616Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.929616Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:fb6cd7c46cb02c3502bc30a3414cdcbdae4561aa9a3f25e023d1d52b59d0a868","observation_id":"27bfdd50-6ab8-4a53-9ce1-5d65395375c8","resolution":{"observed_at":"2026-08-15T22:01:29.929616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.974322Z","title":null,"venue":null,"work_id":"a6f76371-8eb6-44cd-bf9c-5a60564a1a6a","year":2019},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.933643Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:e8b3d4c4daf8a10632ada16b3682c8eaaefcd4269630b80091144f060f73d031","observation_id":"02b95cc4-86ed-4004-80f9-ec17e8151620","resolution":{"observed_at":"2026-08-15T22:01:30.978666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-15T22:01:29.937797Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.937797Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:693313b8e3d9cfa34e52bc2358d157e132ae6431cbc1a7ae19782d91d2a2cb2d","observation_id":"c225d0ac-622e-4e90-96ba-7e40c2504415","resolution":{"observed_at":"2026-08-15T22:01:29.937797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.961462Z","title":null,"venue":null,"work_id":"a7191130-2d3b-4635-868c-7bebd48a3528","year":2004},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.942419Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:a3619dade570c93f64e85c5912b9bbc2353a2d57cdd076525d6a7526e638a68a","observation_id":"963bdade-a1cd-41ea-9026-4265a94aee23","resolution":{"observed_at":"2026-08-15T22:01:30.965732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.948712Z","title":null,"venue":null,"work_id":"0b576441-db96-4e93-9da6-357bfd6cf6c0","year":2018},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.946785Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:93fe6d189d7dbe2d200b8093ffd00aaf573ebe55cc7c8cd97f02348fe2ee0b5e","observation_id":"bfd77ebc-9fec-48b0-a3f6-f2b591677b94","resolution":{"observed_at":"2026-08-15T22:01:30.952830Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:29.950804Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.950804Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:8cd5412060aea878970829dd34feec2584d9e9cb3d8c2e9f62cd94b0d2cf9c48","observation_id":"15e7a395-9685-469b-91de-623e75d0b860","resolution":{"observed_at":"2026-08-15T22:01:29.950804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.927597Z","title":null,"venue":null,"work_id":"e0c56495-5b40-43a1-9019-a38b305d8649","year":1952},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.955072Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:37d46e1f49487677c3d154ae400755e283e029b1877bc3a97cdc53a8fa27f10e","observation_id":"26742ea3-0049-4310-a1c8-395adcd07b2d","resolution":{"observed_at":"2026-08-15T22:01:30.931636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-16T14:20:22.893368Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-08-15T22:01:29.958940Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.958940Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:6f80d4173f153d022e38dc61bbbd128c9fcd92abb098a739e05e3cc7e7f4fe03","observation_id":"a325e666-b571-44ca-bee0-c1f652982af7","resolution":{"observed_at":"2026-08-15T22:01:29.958940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-15T22:01:29.963072Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.963072Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:9e637118c83e51bdd3dd0ae7c11b5bf34b07c5dd0be74894bfd907c231896676","observation_id":"2a9ab82c-44bd-469b-a058-7ddb4ed2bb14","resolution":{"observed_at":"2026-08-15T22:01:29.963072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:29.967280Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.967280Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:deb63e805b9bc629020badc13c1affe6addf239b9c7bdfedf6d4a15c3d27878f","observation_id":"6d0bc3c3-f682-4764-b7bb-d663e45670a0","resolution":{"observed_at":"2026-08-15T22:01:29.967280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:29.971268Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.971268Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:1a41f93fb6be6caf0688824e39bd7278f9739aa1e46417fcb56d8b9e1b633e8e","observation_id":"6aec295b-c6ec-42da-a3c1-07f5f202412d","resolution":{"observed_at":"2026-08-15T22:01:29.971268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01377","last_updated":"2024-07-16T03:24:39Z","snapshot_observed_at":"2026-08-14T00:28:11.851309Z","submitted_at":"2023-10-02T17:40:01Z","title":"UltraFeedback: Boosting Language Models with Scaled AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01377","snapshot_observed_at":"2026-08-15T22:01:29.975433Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.975433Z"},"links":{"cited_paper":"/paper/2310.01377","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:132bc1d4082b5b0e6ca6c117a35a7c57c97be0d34fd66f1143751779e1ff0db9","observation_id":"7f617a0b-208a-4516-8e88-cd641025a7c3","resolution":{"observed_at":"2026-08-15T22:01:29.975433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.898769Z","title":null,"venue":null,"work_id":"6e4d3a81-b6ce-4750-9084-c5e9d905e6ec","year":1983},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.979776Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:c2134f31b3c9c22ef79f831ad3c7316401c08b7cdf137ccd2182b96a44752d9c","observation_id":"cf92b869-7082-413c-bbaf-d803c7d9a0cd","resolution":{"observed_at":"2026-08-15T22:01:30.902559Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T22:01:29.983638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.983638Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:e58bbc7643bfde1a48ec6146e296a3b734f0196011db8d8a1d2def355f633f3b","observation_id":"59e5b8b6-137d-4104-a5a0-18150ad54181","resolution":{"observed_at":"2026-08-15T22:01:29.983638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.885387Z","title":null,"venue":null,"work_id":"e55874be-03ec-4ce7-94ad-33c8f341d7c6","year":2020},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.987813Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:3edf6b0bbaa94eaeaffa852963d119a4214c4be0eb6aa4d2e02a3e589f51cb23","observation_id":"c0f95fb3-d458-4f9c-b11c-26206f7b2e5f","resolution":{"observed_at":"2026-08-15T22:01:30.889861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-08-17T15:29:47.883677Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-15T22:01:29.991766Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.991766Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:971a5635534e53e238eb524c141803d096d8dacbf70f954c197888b5c61fa5a8","observation_id":"1c5ee20f-8b5a-48fc-9666-890439d09f8d","resolution":{"observed_at":"2026-08-15T22:01:29.991766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.871892Z","title":null,"venue":null,"work_id":"fbc7c812-7080-4b70-9b99-f850dc6dc094","year":2019},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.995808Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:15d89dddb08d26c9745f78328620026dc8cffc0c06e9b37223dc1e44e8833b6c","observation_id":"121172a4-d12c-42e8-965e-9f6a9286b9f7","resolution":{"observed_at":"2026-08-15T22:01:30.875948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:29.999619Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:29.999619Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:33464fb27abe71588cce5e042f83dc33e7abdfde27e0b0bfef0fe4af56b40bfa","observation_id":"f0cb6f24-07e8-4a6d-95c8-75e401b93a70","resolution":{"observed_at":"2026-08-15T22:01:29.999619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04792","last_updated":"2024-02-29T20:59:17Z","snapshot_observed_at":"2026-08-16T14:20:38.839188Z","submitted_at":"2024-02-07T12:31:13Z","title":"Direct Language Model Alignment from Online AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04792","snapshot_observed_at":"2026-08-15T22:01:30.003661Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.003661Z"},"links":{"cited_paper":"/paper/2402.04792","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:dc8d3c4312f8d019e64797768fb951788f3fc3ea4f62d305c405ea93344da520","observation_id":"5650d78d-a847-42cc-8221-fc0c13ce9ded","resolution":{"observed_at":"2026-08-15T22:01:30.003661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-15T22:01:30.007659Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.007659Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:b4c950db96ad983f372ff07ad6763fc1253b68dcd7b2f6e164704c4ffaedb74d","observation_id":"8546ea88-9230-40d5-a710-81ab1d0c384f","resolution":{"observed_at":"2026-08-15T22:01:30.007659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02561","last_updated":"2023-06-30T21:39:54Z","snapshot_observed_at":"2026-08-18T18:36:22.935192Z","submitted_at":"2023-06-05T03:32:26Z","title":"LLM-Blender: Ensembling Large Language Models with Pairwise Ranking and Generative Fusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02561","snapshot_observed_at":"2026-08-15T22:01:30.011597Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.011597Z"},"links":{"cited_paper":"/paper/2306.02561","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:80c33e65830a5808d64e89290061d484b67514f1b6bdad82ab924364dda7a0f2","observation_id":"2a71715f-59f3-463c-b74e-c608740154ba","resolution":{"observed_at":"2026-08-15T22:01:30.011597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T22:01:30.015824Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.015824Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:5c408e49455eeb2eab81f4fb3bf70d2c5dc49b93281035aa3b584040517f1067","observation_id":"89cc55cf-13a4-43f1-bede-b113fe9a3ef6","resolution":{"observed_at":"2026-08-15T22:01:30.015824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.859402Z","title":null,"venue":null,"work_id":"81367a39-fef9-40ee-b75c-3bee56ee749f","year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.019748Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:66e83a81fdbc3af846f11d78fbdab6a80ccb8104043d0103db6627649b348812","observation_id":"263df5ce-1722-45d3-af34-0bdefee097a3","resolution":{"observed_at":"2026-08-15T22:01:30.863370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.02866","last_updated":"2022-06-28T03:42:49Z","snapshot_observed_at":"2026-08-20T14:22:16.596063Z","submitted_at":"2021-06-05T10:51:26Z","title":"Conditional Contrastive Learning for Improving Fairness in Self-Supervised Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.02866","snapshot_observed_at":"2026-08-15T22:01:30.023561Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.023561Z"},"links":{"cited_paper":"/paper/2106.02866","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:da9c74d03e309a43aff9d7957744d9e7c3bb9c546a7800bc08e4807484d1e13c","observation_id":"32991a22-e661-43fb-8392-6e1d5b1e03c5","resolution":{"observed_at":"2026-08-15T22:01:30.023561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14734","last_updated":"2024-11-01T20:05:19Z","snapshot_observed_at":"2026-08-20T05:24:55.574908Z","submitted_at":"2024-05-23T16:01:46Z","title":"SimPO: Simple Preference Optimization with a Reference-Free Reward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14734","snapshot_observed_at":"2026-08-15T22:01:30.027666Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.027666Z"},"links":{"cited_paper":"/paper/2405.14734","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:58e27f594c3fcef910c08cf626f3f39f4676c8ba749021ccc950ca9f5dc9d617","observation_id":"dd1d3041-7ae2-49bc-8346-b91dad26bed4","resolution":{"observed_at":"2026-08-15T22:01:30.027666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00886","last_updated":"2024-06-11T16:25:52Z","snapshot_observed_at":"2026-08-20T23:26:50.938895Z","submitted_at":"2023-12-01T19:26:23Z","title":"Nash Learning from Human Feedback","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00886","snapshot_observed_at":"2026-08-15T22:01:30.031609Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.031609Z"},"links":{"cited_paper":"/paper/2312.00886","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:810777d0c5ed021cfef90708f4513c7b2746387a0039ec192594739a6133715f","observation_id":"a66cb64b-1fc4-43dc-8c11-9fce68a0a370","resolution":{"observed_at":"2026-08-15T22:01:30.031609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.846477Z","title":null,"venue":null,"work_id":"8584ec84-91d9-4004-ae62-94fb15974c02","year":2010},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.035663Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:86a03f1efd31fc734105cf9f868f7fc490a0d8f0d11a7ef9bb80321387eef19f","observation_id":"e96d362d-19f3-486d-a58c-8fa83520d088","resolution":{"observed_at":"2026-08-15T22:01:30.850799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-08-14T18:53:38.574749Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-15T22:01:30.039509Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.039509Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:88fc9cd70526fd4791df42b10d488e037eadb3f608cf168bd7271bf08c12e049","observation_id":"85f69cbc-9499-43ed-803e-bbed47271c8e","resolution":{"observed_at":"2026-08-15T22:01:30.039509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.834039Z","title":null,"venue":null,"work_id":"58a7a32f-b34a-4389-b427-7c7a605cd63b","year":2022},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.043616Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:018ff7b9940f5bc8878b91aeead3dfbc38b7b2b02b7d8c6bceb712f1e67d7237","observation_id":"ef33d5bc-1499-4d85-950b-a4d1f9ad92e7","resolution":{"observed_at":"2026-08-15T22:01:30.838073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13228","last_updated":"2024-07-03T13:46:33Z","snapshot_observed_at":"2026-08-14T02:18:02.339361Z","submitted_at":"2024-02-20T18:42:34Z","title":"Smaug: Fixing Failure Modes of Preference Optimisation with DPO-Positive","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13228","snapshot_observed_at":"2026-08-15T22:01:30.047460Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.047460Z"},"links":{"cited_paper":"/paper/2402.13228","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:4dae5814801709b8deed195428afddae26413b386fb98ab83a7be43b227a3c16","observation_id":"646779c3-7538-45e3-a613-4a3a5dc9ba8c","resolution":{"observed_at":"2026-08-15T22:01:30.047460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19733","last_updated":"2024-06-26T01:28:35Z","snapshot_observed_at":"2026-08-16T13:56:31.553308Z","submitted_at":"2024-04-30T17:28:05Z","title":"Iterative Reasoning Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19733","snapshot_observed_at":"2026-08-15T22:01:30.051783Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.051783Z"},"links":{"cited_paper":"/paper/2404.19733","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:c0a32b8fcfdbddf0076de6485c9fdd23fc1313c592d3f68764f1f0a1e84282b1","observation_id":"55c5d506-89c0-4514-8191-f7d6f9d01ae2","resolution":{"observed_at":"2026-08-15T22:01:30.051783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19159","last_updated":"2024-09-09T04:39:31Z","snapshot_observed_at":"2026-08-20T11:07:35.159951Z","submitted_at":"2024-03-28T06:03:47Z","title":"Disentangling Length from Quality in Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19159","snapshot_observed_at":"2026-08-15T22:01:30.055880Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.055880Z"},"links":{"cited_paper":"/paper/2403.19159","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:40b124431eaa6545bd630a58f5d8ed4b082eb1be0bb36fa269c31bd8c11d49ce","observation_id":"b9af7862-07bc-4ea4-9094-1a5eba98fd14","resolution":{"observed_at":"2026-08-15T22:01:30.055880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.821259Z","title":null,"venue":null,"work_id":"8b50f473-2081-4483-b955-9a795ce6cef3","year":2019},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.060027Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:80b1a2e2f13cfd4f5d488496f153ca7d23319a30a47aebcd8bd14e82f42a37ee","observation_id":"ddc650b3-2547-43c7-a5bc-df3506484bed","resolution":{"observed_at":"2026-08-15T22:01:30.825400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.063686Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.063686Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:36fd342d38551ea3ae5814447ca78f0e3ad67ed4d7b3930a0be180d1b586d18e","observation_id":"51132a8b-a32e-40f4-bd44-c6b1801c1a4d","resolution":{"observed_at":"2026-08-15T22:01:30.063686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03715","last_updated":"2024-04-04T17:56:41Z","snapshot_observed_at":"2026-08-17T02:24:53.749690Z","submitted_at":"2024-04-04T17:56:41Z","title":"Direct Nash Optimization: Teaching Language Models to Self-Improve with General Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03715","snapshot_observed_at":"2026-08-15T22:01:30.067470Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.067470Z"},"links":{"cited_paper":"/paper/2404.03715","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:9a3b6d3bf937cf7a097c4bd428d32022de5a7b31d23b61e5ca9e9f33fe029088","observation_id":"27a16a56-8388-416c-94ff-08dc03f11475","resolution":{"observed_at":"2026-08-15T22:01:30.067470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T22:01:30.071471Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.071471Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:b4f98cb53e3d24a6e531a08dbfc01140367e1d7fed53e4c02da3c1fb40a233c5","observation_id":"6f1c94b2-353a-4f2a-b76f-6944bb8ccbf4","resolution":{"observed_at":"2026-08-15T22:01:30.071471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.800198Z","title":null,"venue":null,"work_id":"755bb1d9-5941-416c-89df-ebc60e86f8fc","year":2020},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.075358Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:6af8f3c2e29290c6feecd944e9611cd8bf3bd9408c52feeeff1e1d7cac057c2c","observation_id":"bbb7a90f-d231-4161-8ab7-323a002690b2","resolution":{"observed_at":"2026-08-15T22:01:30.804224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.079064Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.079064Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:b02036e119929580df7e67b3c0280b12aff141d1811088c0406fd51dcb2098e2","observation_id":"9720ebef-292f-4cf2-90ae-1d34025d9f4b","resolution":{"observed_at":"2026-08-15T22:01:30.079064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14367","last_updated":"2024-06-02T22:00:42Z","snapshot_observed_at":"2026-08-16T13:58:48.478970Z","submitted_at":"2024-04-22T17:20:18Z","title":"Preference Fine-Tuning of LLMs Should Leverage Suboptimal, On-Policy Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14367","snapshot_observed_at":"2026-08-15T22:01:30.083231Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.083231Z"},"links":{"cited_paper":"/paper/2404.14367","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:68fd740213be6d33fb79e3c846efa54056c65581e28a4c0342f41e06e75c24d8","observation_id":"2eb8e6dd-4863-4eab-ad9f-10620b29cf7c","resolution":{"observed_at":"2026-08-15T22:01:30.083231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05749","last_updated":"2024-05-28T23:25:15Z","snapshot_observed_at":"2026-08-16T14:20:11.482387Z","submitted_at":"2024-02-08T15:33:09Z","title":"Generalized Preference Optimization: A Unified Approach to Offline Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05749","snapshot_observed_at":"2026-08-15T22:01:30.087528Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.087528Z"},"links":{"cited_paper":"/paper/2402.05749","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:68d70d1c6b467363d40640775d331b9365019b1e11fac2753393c4be4028cfbe","observation_id":"e1a42b13-7698-4f3a-a3e8-d98314293d05","resolution":{"observed_at":"2026-08-15T22:01:30.087528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.779193Z","title":null,"venue":null,"work_id":"d6b064d1-3dea-4700-8a08-b6907f3a9a32","year":2022},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.091647Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:d074b13b6e806d1fcd37324993d27277aeedd2516490328b53a02b4b1d0d9414","observation_id":"358c5337-4b1c-429a-bcef-dff33df4ad90","resolution":{"observed_at":"2026-08-15T22:01:30.783161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13625","last_updated":"2020-01-23T09:08:54Z","snapshot_observed_at":"2026-08-21T18:51:14.614972Z","submitted_at":"2019-07-31T17:50:51Z","title":"On Mutual Information Maximization for Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13625","snapshot_observed_at":"2026-08-15T22:01:30.095660Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.095660Z"},"links":{"cited_paper":"/paper/1907.13625","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:e4f427f9a67bca83bccae1a2718d71d6b6db02300a7a508e38fdc5a3878807c5","observation_id":"46fc1427-e61b-4968-9948-69d86abfabbb","resolution":{"observed_at":"2026-08-15T22:01:30.095660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16944","last_updated":"2023-10-25T19:25:16Z","snapshot_observed_at":"2026-08-18T22:05:54.705341Z","submitted_at":"2023-10-25T19:25:16Z","title":"Zephyr: Direct Distillation of LM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16944","snapshot_observed_at":"2026-08-15T22:01:30.099954Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.099954Z"},"links":{"cited_paper":"/paper/2310.16944","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:e02a3163043704d5b442e2851e8e12cc3c43d431163a50f7f3e8dab1361d4ab8","observation_id":"b23bdb74-7636-4e0a-9422-aa4a67bf5dec","resolution":{"observed_at":"2026-08-15T22:01:30.099954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.104470Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.104470Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:d3bc13b820c116f1b493da3ed7c392c1c81b5590e260a7819e331910ec07a0ae","observation_id":"1964ddcf-7864-4d77-a235-c7055fa0edad","resolution":{"observed_at":"2026-08-15T22:01:30.104470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.756817Z","title":null,"venue":null,"work_id":"1d530615-dc91-490a-a479-4cea735d2025","year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.108562Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:8736431dc98e6ce15d0235d8a432867a85f79e89c5f0e099d495232f070d06bc","observation_id":"9aa5b613-2996-4847-a5d9-d919e2b97e44","resolution":{"observed_at":"2026-08-15T22:01:30.761207Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.742893Z","title":null,"venue":null,"work_id":"6f38346f-b667-47d3-96b4-d2b06b8ab736","year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.112738Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:64de5313b5e4ffc1d5dc319b22cdbd47c9a1a768284443a4ed59cb78572cacc4","observation_id":"9d69d374-c9ae-4a8a-beca-57798c86d61a","resolution":{"observed_at":"2026-08-15T22:01:30.747119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.729307Z","title":null,"venue":null,"work_id":"0cde4764-5686-4e93-937b-89d94ecd8f23","year":2021},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.116989Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:c27bda8731405a68c9993ce90f821f3c61308ff1cd09ce60df37d581935c01b0","observation_id":"77e56128-ddb8-41bc-a98e-8db3d5e14aa2","resolution":{"observed_at":"2026-08-15T22:01:30.733249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00883","last_updated":"2025-02-20T15:26:44Z","snapshot_observed_at":"2026-08-14T03:37:52.669333Z","submitted_at":"2025-02-02T19:25:41Z","title":"SimPER: A Minimalist Approach to Preference Alignment without Hyperparameters","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00883","snapshot_observed_at":"2026-08-15T22:01:30.121138Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.121138Z"},"links":{"cited_paper":"/paper/2502.00883","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:9b572c98871d8a76b876bbabe478443e19c5132bdebc88cf3147b19d14de5e58","observation_id":"72e51d6b-cbf6-4ec3-b7a6-0cdc1ea58549","resolution":{"observed_at":"2026-08-15T22:01:30.121138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.716374Z","title":null,"venue":null,"work_id":"e6c7b57e-b738-4066-8743-771584a0f299","year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.125471Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:4da45b4789184235788ba1a783fbd78d62201ae1a35aaa80bec04d05b6e142ba","observation_id":"cb486f40-3385-4352-a47b-572b1bacb018","resolution":{"observed_at":"2026-08-15T22:01:30.720409Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11456","last_updated":"2024-05-01T14:50:56Z","snapshot_observed_at":"2026-08-22T02:29:32.961473Z","submitted_at":"2023-12-18T18:58:42Z","title":"Iterative Preference Learning from Human Feedback: Bridging Theory and Practice for RLHF under KL-Constraint","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11456","snapshot_observed_at":"2026-08-15T22:01:30.129520Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.129520Z"},"links":{"cited_paper":"/paper/2312.11456","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:d173a99bed2c6bd5d21c5b903f26a24a842aebf6f491ea992250443fcefa0f97","observation_id":"5d5d4293-279b-4ff4-810c-6722d49ffc12","resolution":{"observed_at":"2026-08-15T22:01:30.129520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.702479Z","title":null,"venue":null,"work_id":"fbd89925-d2fa-4f11-877f-a45afc0c8e43","year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.133963Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:e551e29e9109d9edee4141e41f63b242cbd9d5a67b2f70f7c635b8bdfe23a847","observation_id":"966b6536-ee11-494a-8920-914433fc1d58","resolution":{"observed_at":"2026-08-15T22:01:30.707494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10719","last_updated":"2024-10-10T08:30:17Z","snapshot_observed_at":"2026-08-20T11:04:33.167279Z","submitted_at":"2024-04-16T16:51:53Z","title":"Is DPO Superior to PPO for LLM Alignment? A Comprehensive Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10719","snapshot_observed_at":"2026-08-15T22:01:30.138334Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.138334Z"},"links":{"cited_paper":"/paper/2404.10719","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:86a158959d19fe9a74bbf36040306bc54cf1aca26cc67368e98359c2e3619545","observation_id":"56f4439f-686d-447f-bd31-9b07ce9e441e","resolution":{"observed_at":"2026-08-15T22:01:30.138334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02078","last_updated":"2024-04-02T16:25:30Z","snapshot_observed_at":"2026-08-18T07:57:39.581947Z","submitted_at":"2024-04-02T16:25:30Z","title":"Advancing LLM Reasoning Generalists with Preference Trees","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02078","snapshot_observed_at":"2026-08-15T22:01:30.142617Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.142617Z"},"links":{"cited_paper":"/paper/2404.02078","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:d0c4be08e146dbdff8a5a21908258975033060fc6c508e219340e52432f5280b","observation_id":"b527fa5f-5611-4f88-811b-e9b95c6ec9f1","resolution":{"observed_at":"2026-08-15T22:01:30.142617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-15T01:20:08.134494Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-15T22:01:30.147175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.147175Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:bf9087f66392b3af56b87d5885a8f3a9971dc8d528967ae95d8b931807e3cacc","observation_id":"b0971951-d3cb-4414-b510-8a0031962c4b","resolution":{"observed_at":"2026-08-15T22:01:30.147175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10425","last_updated":"2023-05-17T17:57:10Z","snapshot_observed_at":"2026-08-20T10:41:24.815766Z","submitted_at":"2023-05-17T17:57:10Z","title":"SLiC-HF: Sequence Likelihood Calibration with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10425","snapshot_observed_at":"2026-08-15T22:01:30.152786Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.152786Z"},"links":{"cited_paper":"/paper/2305.10425","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:3b7ac72bfefb0a8d05539502cd7c3b176fcced0119f04857211dc5893de09a45","observation_id":"fd360663-2ac3-415c-af6b-3ab7597baae8","resolution":{"observed_at":"2026-08-15T22:01:30.152786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04964","last_updated":"2023-07-18T08:44:47Z","snapshot_observed_at":"2026-08-16T10:37:13.463130Z","submitted_at":"2023-07-11T01:55:24Z","title":"Secrets of RLHF in Large Language Models Part I: PPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04964","snapshot_observed_at":"2026-08-15T22:01:30.157129Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.157129Z"},"links":{"cited_paper":"/paper/2307.04964","citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:d7a362eff8f2a04d3323a7a7b2cd5d592bf27424fe1e3946fcd58694dcf59c70","observation_id":"d663b943-b965-4288-bcb8-73c011e67336","resolution":{"observed_at":"2026-08-15T22:01:30.157129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.161337Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.161337Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:95ad4a74b44a1991fb66abcd97b04823e94864f4b3559151fe2a7e6a7a16ae87","observation_id":"d937ad8b-5700-4532-8594-bd385cd4b38a","resolution":{"observed_at":"2026-08-15T22:01:30.161337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.165599Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.165599Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:4c3fcc78187254ebe8abcead812bacbe8f7bd91c20bb700a293931f79432ed8a","observation_id":"c301a447-869c-49a7-8d37-ee14c95a6878","resolution":{"observed_at":"2026-08-15T22:01:30.165599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:01:30.169786Z","title":"accepted","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T22:01:30.169786Z"},"links":{"citing_paper":"/paper/2505.08507"},"observation_digest":"sha256:dc4bd5044edbd378a64b3b9ea54a3d2744d32bbe69027b530b7520dd7c04a6ab","observation_id":"5ad0620b-fd3e-4269-aed9-65167606532b","resolution":{"observed_at":"2026-08-15T22:01:30.169786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.08507","last_updated":"2025-05-13T12:37:48Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T04:54:45.328920Z","submitted_at":"2025-05-13T12:37:48Z","title":"InfoPO: On Mutual Information Maximization for Large Language Model Alignment"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":63,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2505.08507."}