{"as_of":"2026-08-08T09:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:934979d7f43041903a1f1fdce14f51cadd2a8580e98d5a4d1c29ac861310d0e9","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:50:14.253577Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.23557/citation-record","integrity":"/paper/2505.23557/integrity","json":"/paper/2505.23557/citation-record.json","paper":"/paper/2505.23557"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:15.688614Z","title":"local” Assumptions 4.2 and 4.4 are satisfied. Given that Assumption 4.4 is based on “ignoring","venue":null,"work_id":"c3f0241e-c6cc-4cd2-80f9-86ff48f5dd25","year":2024},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.971210Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:f843a3489f8775c4b5babe77823773979c0b74f955b881e748a1a24fac810dc5","observation_id":"07e8a8fd-4c78-48ab-8946-564c4430a597","resolution":{"observed_at":"2026-08-07T12:50:15.768250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:15.865038Z","title":"J., Rohatgi, D., Zhang, C., Simchowitz, M., Ash, J","venue":null,"work_id":"4c180383-7fa2-43b3-8f10-3bb88f82793b","year":2024},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.085135Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:4e223409ba1b4c8833f9596fd8396e4fd48e56096d8e7c95cc9c9419fb2c546f","observation_id":"f71d4177-68a3-4219-88b1-932075eb51c2","resolution":{"observed_at":"2026-08-07T12:50:15.950799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:13.409774Z","title":"S., and Bag- nell, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.409774Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:5009741c63e1034b839102533e8f9c8838de01110f420f39c60ef731fcbe34ab","observation_id":"394fcf52-97d4-42ea-8a37-96cd55ca27e9","resolution":{"observed_at":"2026-08-07T12:50:13.409774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T12:50:13.880712Z","title":"M., Stiennon, N., Wu, J., Brown, T","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.880712Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:fc6cee27f7d112ccd5f55874e546f10e88765d29ac048595de19767624004a49","observation_id":"a485c698-e5b9-4dab-a966-6ad3f2d8e46d","resolution":{"observed_at":"2026-08-07T12:50:13.880712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:15.461825Z","title":"reversed","venue":null,"work_id":"75c9c174-0b4b-4aa7-8921-100b4bd183f7","year":2025},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:14.086477Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:07a1a79a84f899e44fead7ff172c2ae6aa927c85ca49595aca4b1800b318c00d","observation_id":"f1591904-80c7-4fd9-8aa8-92561bf2707c","resolution":{"observed_at":"2026-08-07T12:50:15.566421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:15.268468Z","title":"Let ε=θ−θ ⋆","venue":null,"work_id":"e8352e4c-e091-45ae-948c-66c9bed13637","year":2017},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:14.146385Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:be031a7ed2928b3b9fe28e8fc1817276700ce95b60f1c96ba01503998955a0ce","observation_id":"4ef90a22-24ef-4481-86a2-ddcc144b3c92","resolution":{"observed_at":"2026-08-07T12:50:15.345434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:15.109666Z","title":"spiky” along some directions. Due to those distant vertices, the center would become a worse estimator than DP, since the “average","venue":null,"work_id":"b8eb95fa-bf49-4f79-b8e8-ebbe8623e256","year":2024},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:14.253577Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:d8c5e40b534fcb338f345040c50440355774a3e254307c3c90b9fbe24dcaad9d","observation_id":"f77b728b-d1a5-4650-9678-e7ca3ab4fada","resolution":{"observed_at":"2026-08-07T12:50:15.176348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:50:12.536863Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":1946,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.536863Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:d5573786a4f3b591798e82b02d6c41f4c7049cda8c2f529dede683c36fa50202","observation_id":"27ac98e9-f633-453c-9266-84c860a289f5","resolution":{"observed_at":"2026-08-07T12:50:12.536863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:12.815217Z","title":"Gorbatovski, A., Shaposhnikov, B., Sinii, V ., Malakhov, A., and Gavrilov, D","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":1952,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.815217Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:13491294de601c890a84074f87d607545f43797a8ddd741dc777256191e629aa","observation_id":"d7c51675-d737-444d-981c-bbb66bcb436a","resolution":{"observed_at":"2026-08-07T12:50:12.815217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02612","last_updated":"2024-06-19T17:08:13Z","snapshot_observed_at":"2026-07-06T18:09:46.934515Z","submitted_at":"2024-05-04T08:43:45Z","title":"Learning Linear Utility Functions From Pairwise Comparison Queries","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02612","snapshot_observed_at":"2026-08-07T12:50:12.685227Z","title":"Ge, L., Juba, B., and V orobeychik, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.685227Z"},"links":{"cited_paper":"/paper/2405.02612","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:90760e9cd31cee133747e12d838e08b27787b47eb8139b5f33f9064617867685","observation_id":"8c545c67-5315-4b54-baca-17bdbba71ada","resolution":{"observed_at":"2026-08-07T12:50:12.685227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18282","last_updated":"2025-06-03T20:18:22Z","snapshot_observed_at":"2026-08-04T11:02:36.369659Z","submitted_at":"2025-01-30T11:41:13Z","title":"Leveraging Sparsity for Sample-Efficient Preference Learning: A Theoretical Perspective","version":4},"cited_work":{"arxiv_id":"2501.18282","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.18282","snapshot_observed_at":"2026-08-07T12:50:14.379589Z","title":"Leveraging Sparsity for Sample-Efficient Preference Learning: A Theoretical Perspective","venue":"cs.LG","work_id":"29536d14-9a9d-4979-9e07-8c1b9f8c6735","year":2025},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.817113Z"},"links":{"cited_paper":"/paper/2501.18282","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:0cdba357e778912200bafcb31a1b21b315d89b1a2934dd42a975e54b2d57a159","observation_id":"fce61919-11eb-4a8d-a430-2dc5df42afa5","resolution":{"observed_at":"2026-08-07T12:50:14.442149Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:16.051450Z","title":"Orpo: Monolithic prefer- ence optimization without reference model","venue":null,"work_id":"30865d36-505f-4045-b398-834e73364c61","year":2024},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.968757Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:a1199fb19bd8fc1e88a6fc3a8c2587c90e4b9f9edd216934da12708b45a1210d","observation_id":"74163a85-31a4-4e68-bac6-0f4dbfa3ff99","resolution":{"observed_at":"2026-08-07T12:50:16.164514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:12.391013Z","title":"URL https://epubs.siam.org/ doi/10.1137/141000671","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.391013Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:706452f19bbe2efdc8b5f0f7dea9cf915df6a7d730f8bea7ade902f5d1f9176b","observation_id":"d7e98598-0844-42c3-ac38-0568f46db10c","resolution":{"observed_at":"2026-08-07T12:50:12.391013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10571","last_updated":"2024-09-14T11:39:13Z","snapshot_observed_at":"2026-07-06T19:16:14.638445Z","submitted_at":"2024-09-14T11:39:13Z","title":"ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood","version":1},"cited_work":{"arxiv_id":"2409.10571","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.10571","snapshot_observed_at":"2026-08-07T12:50:14.533308Z","title":"ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood","venue":"cs.LG","work_id":"9bbeed96-22ce-440d-9f72-4c223c4a214c","year":2024},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.733014Z"},"links":{"cited_paper":"/paper/2409.10571","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:9236b5f2652633c796f58ed18b7ff128081411c3444b0addbeb44457348f7c32","observation_id":"eb7675bc-1ff7-49e9-a7d8-6e4ebaff4ace","resolution":{"observed_at":"2026-08-07T12:50:14.583926Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:13.180091Z","title":"URL http://dx.doi.org/10.1145/3372885","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.180091Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:cbe317679e3ecceb28605b556293d98f18c0bd3cdff2e068b243cfe9ec5cdfd3","observation_id":"b0645b99-4a94-49f4-b1c1-9edbe5dad173","resolution":{"observed_at":"2026-08-07T12:50:13.180091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:50:13.633918Z","title":"Touvron, H., Martin, L., Stone, K., Albert, P., Almahairi, A., Babaei, Y ., Bashlykov, N., Batra, S., Bhargava, P., Bhosale, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.633918Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:edf75567a7067b15621e756056be496de2ae6c23151c412bca3f29fc1dbf18f5","observation_id":"0bdb7b64-d646-437e-922b-a90d85e046aa","resolution":{"observed_at":"2026-08-07T12:50:13.633918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:50:13.319522Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.319522Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:6ff7ed04f6eed6821f9d1c385bcd03ff6fd4ec50f9a804a84b53cd01e4169068","observation_id":"6beabf82-1c55-4fe9-8b17-8e6e0773cab5","resolution":{"observed_at":"2026-08-07T12:50:13.319522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T12:50:12.309997Z","title":"Constitutional ai: Harmlessness from ai feedback.arXiv preprint arXiv:2212.08073,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.309997Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:5e17ac56219dac5e2d467ebdae89d2425ab68bd2b8b7e26edd4ab3e6b2e5fdf4","observation_id":"c10156df-c108-4b20-813e-4d25d0cbdaf0","resolution":{"observed_at":"2026-08-07T12:50:12.309997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05749","last_updated":"2024-05-28T23:25:15Z","snapshot_observed_at":"2026-07-06T17:27:29.050237Z","submitted_at":"2024-02-08T15:33:09Z","title":"Generalized Preference Optimization: A Unified Approach to Offline Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05749","snapshot_observed_at":"2026-08-07T12:50:13.529395Z","title":"D., Zheng, Z., Calandriello, D., Munos, R., Rowland, M., Richemond, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.529395Z"},"links":{"cited_paper":"/paper/2402.05749","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:9927b66f474550fc58d5f23120a895c9d88bad20d7dcf4338e713e27a7d05563","observation_id":"ba1dbab5-2129-42cb-9ed6-8fe0fa6d62b7","resolution":{"observed_at":"2026-08-07T12:50:13.529395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-07T12:41:06.542814Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":6},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2505.23557."}