{"as_of":"2026-08-13T08:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b2bdac1c0c349be6dcb67a48443db423028c13f1c34398ae3a106295b4fb69d","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:19:52.822369Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.03271/citation-record","integrity":"/paper/2501.03271/integrity","json":"/paper/2501.03271/citation-record.json","paper":"/paper/2501.03271"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.419843Z","title":"It provides the core preference alignment signal commonly used in reinforcement learning from human feedback (RLHF) (Christiano et al., 2017)","venue":null,"work_id":"3c8c20d5-1100-4eac-a709-4fc8cb9f0b37","year":2017},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.660007Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:2b6710d8b0e92ca48582bf70cc0f5943f0397acb93ceb7d1bdad87f9d82d1561","observation_id":"2b8df58e-5994-41f7-8a91-f8e5c8f778b3","resolution":{"observed_at":"2026-08-10T22:19:53.423899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.410559Z","title":"The factor γ determines how much the model should focus on aligning responses semantically","venue":null,"work_id":"3c692e3c-da84-4358-aaa3-2a45d45b17c7","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.663766Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:f4bcbf49d31934b7d946a0619c7a23e2b74fd1c7314e98548ea086c36c532db4","observation_id":"fbe7a981-3107-4b70-90b2-cae9a7b39673","resolution":{"observed_at":"2026-08-10T22:19:53.413752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.380398Z","title":"semantic margin","venue":null,"work_id":"65b8ff50-b526-4860-8512-22527bc0f50a","year":2023},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.674734Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:92cc45559d010d031b1151cf4e6561673346f915f333581242c9fe4a0e1d1ee7","observation_id":"faaf65be-ec15-492b-963a-a6dab4c232d7","resolution":{"observed_at":"2026-08-10T22:19:53.384130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.317263Z","title":"Larger devi- ations in NAG suggest the suitability of RBF and Spectral kernels to handle the increased separation","venue":null,"work_id":"98d416a0-9eb0-496f-8daa-94e524fd0781","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.696282Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:684621239445dd3a9a2f25ad59f14558e61070f0293cfc64adbcaf53f58dc9f2","observation_id":"39713119-a846-4b51-b765-999a12a5242d","resolution":{"observed_at":"2026-08-10T22:19:53.320279Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.440202Z","title":"Advances in Neural Informa- tion Processing Systems","venue":null,"work_id":"fce8a6b3-4aef-407e-9879-a8e3a7601754","year":1991},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.649154Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:108222fbf04974c0b53bc90c996bd21923c464fa939b040c04e0da296af758cc","observation_id":"98083ef1-ae6d-43d4-b938-84e025f9787e","resolution":{"observed_at":"2026-08-10T22:19:53.443777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12761","last_updated":"2025-03-14T04:47:39Z","snapshot_observed_at":"2026-08-12T22:21:40.084656Z","submitted_at":"2024-10-16T17:32:23Z","title":"SAFREE: Training-Free and Adaptive Guard for Safe Text-to-Image And Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12761","snapshot_observed_at":"2026-08-10T22:19:52.652196Z","title":"weightedkernelmixture","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.652196Z"},"links":{"cited_paper":"/paper/2410.12761","citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:f038aeae869de0fdfc9007d6b5108fc69ccd5d8ac1b3c2ca4f490811a2fef56e","observation_id":"1a6a632e-4802-44c0-86a7-9cb8366928f6","resolution":{"observed_at":"2026-08-10T22:19:52.652196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.430520Z","title":"So the answer is,","venue":null,"work_id":"e4eb7acc-7760-4f20-82dd-226b6f39d57c","year":2022},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.656680Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:d1cd9d229e26190c3a633f15c0b235a631284e146e13645c846f4ba7de342899","observation_id":"d0d48f6e-9af0-4a58-ad8b-d144d1b7fe4d","resolution":{"observed_at":"2026-08-10T22:19:53.433940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.401218Z","title":"• γ >0: Embedding-based alignment is included, encouraging the model to consider semantic co- herence alongside probability alignment","venue":null,"work_id":"d23f3438-6285-4fc7-94a4-529eb6e1c9d2","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.667668Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:2be930885443b644aae9c45853b51b3e5eea525ce008dd6eca17f4d43799df13","observation_id":"a2251d4b-5fa0-41f6-96c6-f4bddf191a58","resolution":{"observed_at":"2026-08-10T22:19:53.404798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.391075Z","title":"This helps the model avoid reinforc- ing incorrect preferences when probability-based signals are uncertain","venue":null,"work_id":"c49535e3-b044-4056-a73d-9a7fbcc7539a","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.671293Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:9d68a32b80644831db65af133e8b5f3fa108674d7be888aa163a687dafe77b8f","observation_id":"e8dd7623-0101-4704-b1e8-3310ce513e25","resolution":{"observed_at":"2026-08-10T22:19:53.394905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.370461Z","title":null,"venue":null,"work_id":"724b9ac5-a753-4f9e-8e2a-f12d3c375719","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.677865Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:a78392c5b8b4cc60603c70126d9bdf2d54fcd7cdf4b5f91a2b7cdfa180713b6a","observation_id":"9688a092-39bd-45ca-9740-a25b6a7d8856","resolution":{"observed_at":"2026-08-10T22:19:53.373753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.359422Z","title":"the reward model serves as a learned proxy for human judgment, guiding the policy to generate more desirable out- puts","venue":null,"work_id":"460dec61-34a8-47f1-8fae-da46638c5381","year":2017},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.681179Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:7a4f5ecedbf66ebedf9f88aff2e2200ea6cebbbc102015cae8e3b030d32d7421","observation_id":"85cbe184-9c23-47ea-bbed-ee6722f31e0f","resolution":{"observed_at":"2026-08-10T22:19:53.363449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.348517Z","title":"It is defined as: PND = d(x, y+) − d(x, y−) where d(x, y+) and d(x, y−) denote the distances from x to the positive and negative responses, re- spectively","venue":null,"work_id":"bff4f8c9-4086-4023-b5e6-6b58ca11d711","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.685421Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:a55dfcc5e8a4ecfbd6fcc0c4789812a7f40bbbf350a41419038c9b93cc8248b6","observation_id":"5e404d99-e947-4833-8ecb-a24e47cb5d7c","resolution":{"observed_at":"2026-08-10T22:19:53.351871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.337814Z","title":"Conversely, low PNA V values imply stable alignment, favoring simpler kernels such as Mahalanobis or Spectral","venue":null,"work_id":"ab0bb5bf-02bd-4f21-b3db-bb505f90efb1","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.688857Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:111a7a8277c49a3d47adf59e227c4212284fc55360cae7a11bc31d2216a89848","observation_id":"483f8a42-42ba-44e7-9546-f1f423ca072d","resolution":{"observed_at":"2026-08-10T22:19:53.341110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.326760Z","title":null,"venue":null,"work_id":"1e065875-0ad7-47bd-81f5-a6e68ce559a8","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.692931Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:7edd1ae612dc5f3de74242cf61009ba81afc045be3686e7e18873c79c5ca7c25","observation_id":"04900dec-2822-4706-a463-90d00936f45f","resolution":{"observed_at":"2026-08-10T22:19:53.330517Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.307518Z","title":"tailedness","venue":null,"work_id":"7d6530c2-3570-4ecc-91a4-dc539fdb3180","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.699586Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:2fc5c60012815245f63e4d85d1f2725884c0101b60d9506aa7a414489b5c0725","observation_id":"c151bc98-d2e7-4869-bef6-cab0287aef28","resolution":{"observed_at":"2026-08-10T22:19:53.310912Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.296923Z","title":null,"venue":null,"work_id":"b5e27f02-f419-49a0-b838-1356e0c29044","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.703029Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:1be7c6c23d6d88f966a68a32917a2f930f028e538855d48044b1160c4a8b7635","observation_id":"d223f0bb-a233-4dbc-b864-7f5968d2e625","resolution":{"observed_at":"2026-08-10T22:19:53.299967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.287598Z","title":"tailedness","venue":null,"work_id":"54c03ea4-a26c-4101-9df2-dec87b292f3b","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.706207Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:b88b4822c8aaf1d1012c9fdaccc8b21a5ff90c2e7caf7351aaa26598302733bf","observation_id":"f8c00141-ce8b-4703-8ae9-fef6093ab31b","resolution":{"observed_at":"2026-08-10T22:19:53.290903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.277191Z","title":"tailedness","venue":null,"work_id":"c71983f5-5d7c-4de8-81a9-5fe30a6c43f9","year":2004},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.709623Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:71074cbbda376eae5d4b03c08ab80d60c00ee75c2d03710b8975837f7072e4fa","observation_id":"2eb72395-f5a7-4f3a-9dcc-e5abccee9398","resolution":{"observed_at":"2026-08-10T22:19:53.280277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.264975Z","title":"The RBF kernel exhibits isotropic influence (circular), while the Polynomial kernel allows nonlinear, bounded in- fluence","venue":null,"work_id":"2677d9a4-e59a-4507-8abf-ebff15cb06ca","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.712628Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:eb14a789b1193d9d41776e0f28f8be6ee3cf297fcfd959d6c9ef6b14ab470db5","observation_id":"f21edbfe-7652-4769-b057-5f057ada81b5","resolution":{"observed_at":"2026-08-10T22:19:53.268810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.253904Z","title":"local\" kernels. In contrast, the Mahalanobis and Spectral kernels show a slower decay, reflecting their role as","venue":null,"work_id":"3c71c6cb-2bdc-4a6f-af79-3115355cbc2e","year":2002},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.715537Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:fd3abad7e00c022fb30e4b7973835c558e28220f96d656fb3cfe712b11239651","observation_id":"5aa28a01-606a-437e-a347-f81020c21f8c","resolution":{"observed_at":"2026-08-10T22:19:53.257548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.234891Z","title":"• Computing the logarithm of the ratio between the positive and negative class probabilities","venue":null,"work_id":"de981515-222a-44ec-84d2-7d6a6b3585a2","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.722134Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:56bdbbd18b889c520c497ccf5101f94de3bba7aa5993bf7dc54f8172ee533ba5","observation_id":"c6e680dc-33de-4d25-bd4c-fe538c67ad57","resolution":{"observed_at":"2026-08-10T22:19:53.237843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.225207Z","title":"(e⊤y−ex+c)∇θ(e⊤y+ex)−(e⊤y+ex+c)∇θ(e⊤y−ex) (e⊤y−ex+c)2 # =γd e⊤y+ex+c e⊤y−ex+c !d−1 ·","venue":null,"work_id":"58238ea6-2542-4849-ae75-77203c221c2c","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.725251Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:655336140d458d64e33db73a77591d2015b5a535fa523cfcb689ef89fa1451d6","observation_id":"5b876d01-a45e-43d9-bdc3-6d3c931ec274","resolution":{"observed_at":"2026-08-10T22:19:53.228407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.213476Z","title":"• Softmax Calculation: Compute the exponential efθ(x,y) for each class and normalize by the sum over all classes","venue":null,"work_id":"17c208a5-083e-492c-b36c-f9f5630fc61f","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.728455Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:4f1c9320acc731d0e98d6a38532f5dd21586eeecc956df8d35f40683f87d9c02","observation_id":"654f3029-6129-4f9a-b50d-13332c6bdf9a","resolution":{"observed_at":"2026-08-10T22:19:53.216828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.204306Z","title":"− 1 σ2 logπ(y+| x) π(y−| x) ·exp  − logπ(y+|x) π(y−|x) 2 2σ2   ·∇θlogπ(y+| x)− ∇θlogπ(y−| x) − γ σ2 · e⊤xey+ e⊤xey− ·exp  − e⊤xey+ e⊤xey− 2 2σ2   ·","venue":null,"work_id":"c147b023-3125-4b1e-9288-799033df8675","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.732117Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:384559a2f08f60db476c33c7c6f6fa50b994a810859d7f8679335ddf0e1a6422","observation_id":"a8b48bb8-0205-4ac5-8c9c-887316c40714","resolution":{"observed_at":"2026-08-10T22:19:53.207555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.194673Z","title":"where πθ(y | x) is modeled using a softmax func- tion: πθ(y | x) = efθ(x,y) P y′ efθ(x,y′)","venue":null,"work_id":"429e8926-5767-4540-abe7-98db55d83447","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.735984Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:df1664168b7ddfa98891fd7b892575ba9fc619ddb51c18ef43fd89efec58c621","observation_id":"769a11e7-3947-472e-b436-a357e4b65815","resolution":{"observed_at":"2026-08-10T22:19:53.197893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.184564Z","title":"• Ratio Calculation: Compute the ratio e⊤ x ey+ e⊤x ey−","venue":null,"work_id":"199b0488-17d3-47a3-9c29-7fd66dbb99e2","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.739234Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:b37d33527d48c8dbb8c8a7895d90cfe8a4f8000c241a8e4222bd2e6959b4180a","observation_id":"6f955f84-b230-4149-ae58-a95c08e763b5","resolution":{"observed_at":"2026-08-10T22:19:53.187809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.175386Z","title":null,"venue":null,"work_id":"9bfc182b-8dca-4c59-99e4-56a40f047107","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.742997Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:c2477fb347fe2e8193ca6accc1e6461ec00c4a201902bb6c4a12dd9b1ea2d660","observation_id":"ccfdada3-6bd9-45ed-a461-af5c88418575","resolution":{"observed_at":"2026-08-10T22:19:53.178490Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.165442Z","title":null,"venue":null,"work_id":"54be85c6-5d49-4ed8-92ba-88bf74b88c92","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.746872Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:c90dbb200db48ae3ae38ad020f6e7cd4841c4f17e76d41a55f8965f9226744ff","observation_id":"58cdebd1-44ab-4239-8527-29214910d430","resolution":{"observed_at":"2026-08-10T22:19:53.168497Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.156323Z","title":null,"venue":null,"work_id":"3105bf62-6810-4bc8-b814-e7dcd9c1554e","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.750944Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:0986fbdd6dbf4c54266088be7fc1669add50a7148dce9958988b9e4bbdad7107","observation_id":"e4db9c6b-6be1-451f-a2f2-f5a1c6209108","resolution":{"observed_at":"2026-08-10T22:19:53.159314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.144859Z","title":null,"venue":null,"work_id":"e15d587c-b225-4784-8178-ba876d946b0a","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.755229Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:734f3ef7c8de8d9e41fa4fbe1f3acaac238188c7a337668f11d3e9189d10c285","observation_id":"5c4b5597-7c17-4547-af11-348b02da768e","resolution":{"observed_at":"2026-08-10T22:19:53.147808Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.135398Z","title":null,"venue":null,"work_id":"3fb59db5-731d-4f27-a2d5-2d5388618f6f","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.758966Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:a6f24a0ec7296bff23a4d2fd4ad139217c79c6ea9106f68762a0714e60f89e1b","observation_id":"31a46170-d363-4e13-b13b-0d3e0638337e","resolution":{"observed_at":"2026-08-10T22:19:53.138212Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.126481Z","title":null,"venue":null,"work_id":"dfa7b85f-5558-411a-ba85-c1e4b8e7ca62","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.762517Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:0f89725fedc59a175806e436ebdcf6cb43fcbc39a4caa11e2f9665a891da1119","observation_id":"128b0f3d-9da8-4dfd-8f30-9863717d3453","resolution":{"observed_at":"2026-08-10T22:19:53.129088Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.116712Z","title":"Steps Involved: • Score Computation: Calculate fθ(x, y) for each class y, which involves a dot product between input features and model parameters","venue":null,"work_id":"71a07385-2734-4bed-abd5-098605348dfe","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.765952Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:1b3edb9c2ac20943f7b8dcae97a343f1d341e425eb5e41f97a917e5d09589b4a","observation_id":"5eea5219-43ca-4e1d-a53f-2ded0c5a691c","resolution":{"observed_at":"2026-08-10T22:19:53.119709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.107144Z","title":"Steps Involved: • Dot Product Computation : Calculate the dot products e⊤ x ey+ and e⊤ x ey−, where ex, ey+, ey− ∈ Rd","venue":null,"work_id":"589c5e6f-d59e-42f7-9c27-bccba2facb09","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.769188Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:19a3e43a53df33fb5e7e2391a48d1507796a164cb1bf49ba00efc5e6a4209bd5","observation_id":"eb5ad9ae-ef82-4688-8a1f-2496f3fde62a","resolution":{"observed_at":"2026-08-10T22:19:53.110711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.096936Z","title":"Steps Involved: • Score Computation: Calculate fθ(x, y) for each class y, which involves a dot product between input features and model parameters","venue":null,"work_id":"5a4d7e0f-1c17-4ae5-9fe0-0e311acc9fda","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.772893Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:0731e8d39d54ccfab5caf4b3b9f6cc94ab9f9a4d6fdf75454ebce8d8051a845c","observation_id":"860061fe-95bb-4ff3-bbca-a4e2824bad87","resolution":{"observed_at":"2026-08-10T22:19:53.100371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.086852Z","title":"Steps Involved: • Dot Product Computation : Calculate the dot products e⊤ x ey+ and e⊤ x ey−, where ex, ey+, ey− ∈ Rd","venue":null,"work_id":"1b99b31f-e26d-4ba6-b8a6-713b117d8781","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.777240Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:217cae596c9667e158bb1b9736346575dd1ebef60069e625b12472682c3662e6","observation_id":"7ce2653e-f1c6-4cee-95a5-3148b580bac6","resolution":{"observed_at":"2026-08-10T22:19:53.090521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.077377Z","title":null,"venue":null,"work_id":"a80c8a6a-227a-4e82-bcf9-534cd45f168c","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.780784Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:e18cfe51f1d0615cdd3a1beb726de413e25c2120b4ee6c9de9d6475bd3ee27c9","observation_id":"46f1883d-dea7-4ef1-9e4f-1611435d13ac","resolution":{"observed_at":"2026-08-10T22:19:53.080425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.067594Z","title":null,"venue":null,"work_id":"624c68ee-93bf-4649-9e5e-0aa50174d495","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.784682Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:77c633a5f768ef59edc49e983cddc92fc1751f61bd8b0b7e5c0ca2e67de8b0e0","observation_id":"4202698c-b24e-4ee2-8a50-34fcfa2c643e","resolution":{"observed_at":"2026-08-10T22:19:53.070692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.056044Z","title":null,"venue":null,"work_id":"52e5c00d-e37e-40b4-9e8a-ac622c93d742","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.788403Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:caf63702872357febff2ba771955ff876061190af2f97a6271761ccf28ccd61b","observation_id":"90bbd48b-8d29-464b-b884-a3e9dc6ffc07","resolution":{"observed_at":"2026-08-10T22:19:53.060044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.045356Z","title":null,"venue":null,"work_id":"230dc060-332f-4622-a128-5ca4e1d1de4d","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.791496Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:00ee5120d55d68802cf1e076ded3350ac35be25e6e9d743cf1db3862652ac044","observation_id":"c80db629-ddcc-42c7-b1d9-02ef01cf52f5","resolution":{"observed_at":"2026-08-10T22:19:53.048614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.035515Z","title":"RBF Kernel KRBF(x, x′) = exp − ∥x − x′∥2 2σ2 Steps Involved: • Compute the Euclidean distance ∥x − x′∥, which involves O(d) operations, where d is the dimen- sion of the input","venue":null,"work_id":"0e21045c-2b33-4653-9588-8eac0970be7d","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.794313Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:99fc47170d7ff14498a9b1d1e3bf6e812416435f8b7eb12c0cbd3853a4469864","observation_id":"84a73a3e-fa9d-4902-b819-a7bed2d439ba","resolution":{"observed_at":"2026-08-10T22:19:53.039153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.025691Z","title":"Spectral Kernel KSpectral(x, x′) = pX i=1 exp −λiz2 i ϕi(zi), where zi = log π(y+|x) π(y−|x)","venue":null,"work_id":"4cb289d1-1c53-484d-929a-ab0e9b7e4a7f","year":2003},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.797742Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:6993440f13323762e3ccc2c5a6fc5a93b6cbe19469b34100b4f0d28b62a2435b","observation_id":"d58bd280-5e59-4bc2-bb9c-7b545da80ca6","resolution":{"observed_at":"2026-08-10T22:19:53.029184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.014224Z","title":"• Lipschitz Continuity: The gradient of the RBF kernel is Lipschitz continuous due to its exponen- tial decay property","venue":null,"work_id":"c19ea738-6d66-4db4-bafe-5bf28426b0de","year":2006},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.801100Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:7221ec173963790e61ead0895adfc4052c6fc183a1df43b3e6203d98e9f00af2","observation_id":"199e6983-76aa-4b0f-9b1c-0edcdc30b325","resolution":{"observed_at":"2026-08-10T22:19:53.019218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:52.999858Z","title":"Higher degrees in- troduce non-convexity, resulting in a more rugged loss landscape with multiple local minima and saddle points","venue":null,"work_id":"30d9bd26-28bb-45a0-bb84-3932a2806968","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.804028Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:ec2927d89d75335bf6871c6a8b819f2675adeda2921fa6f13bb173718e4c0986","observation_id":"96c4d69c-0fb8-4d61-945e-57d561595d32","resolution":{"observed_at":"2026-08-10T22:19:53.003717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:52.988246Z","title":"Orthonormal basis functions, such as wavelets, can introduce oscillatory behavior in the loss land- scape (Ng et al., 2001)","venue":null,"work_id":"78993f19-cb84-4b6e-b441-a265e65f9ecd","year":2001},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.807196Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:8478ec829fa2bdb97b3f6c82e7e33559e729f1dab539a8c34e69e3b3a5704f5d","observation_id":"2b6085b4-e054-4701-ba60-6a1f7ead3b5b","resolution":{"observed_at":"2026-08-10T22:19:52.991567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:52.977447Z","title":"distance","venue":null,"work_id":"dca1bad3-c70d-4518-ae07-886191b06ee8","year":2009},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.810821Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:b62a58949a11ca845b6763b1e66169e52aace3abf71a1e77b8ef941b482b5ee6","observation_id":"cc4920d5-3a07-414c-bd63-6218ca5b34fa","resolution":{"observed_at":"2026-08-10T22:19:52.980602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:52.966756Z","title":"HT-SR theory posits that ρ(λ) often follows a truncated power law: ρ(λ) ∝ λ−α, for λmin ≤ λ ≤ λmax","venue":null,"work_id":"a10b9bca-f991-4222-b65e-30859180fb9d","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.814975Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:836bacc3c83a2be969f8f760f64914ddedf77936f71e2c4d91055519e1d74bc1","observation_id":"b85bd9b0-1645-44b2-8d4d-ab4e3fa171b8","resolution":{"observed_at":"2026-08-10T22:19:52.970574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:52.955645Z","title":null,"venue":null,"work_id":"0e12ecf5-ae4f-42ba-85e6-24494b38c79a","year":null},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.818646Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:c41dcda314de90d46f811a975f28eb74c44bc84cb92b21610052ce205f276bd6","observation_id":"06cd8f15-93eb-4c3d-9565-45e359970603","resolution":{"observed_at":"2026-08-10T22:19:52.958609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:52.944326Z","title":"Correlation Flow,","venue":null,"work_id":"01dc0f2d-ae20-4ca7-8108-896c0905e0fa","year":2012},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.822369Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:eb0aff6ce83d2084f4312b42fd7a974bd592ef3cf6aeb88f940b5e4c97ba4040","observation_id":"dff8693b-f982-4353-bb16-a2fb432f6df7","resolution":{"observed_at":"2026-08-10T22:19:52.948103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.08608","last_updated":"2017-03-02T19:32:10Z","snapshot_observed_at":"2026-08-13T03:10:58.738032Z","submitted_at":"2017-02-28T02:19:20Z","title":"Towards A Rigorous Science of Interpretable Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.08608","snapshot_observed_at":"2026-08-10T22:19:52.616572Z","title":"Finale Doshi-Velez and Been Kim","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":465,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.616572Z"},"links":{"cited_paper":"/paper/1702.08608","citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:32bb74fb265192aa56f0f009bd92d4ea21c2365cbed82c2a3d8024ced765a97e","observation_id":"627141cc-c26f-4354-8f0b-063b89ed57f2","resolution":{"observed_at":"2026-08-10T22:19:52.616572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-10T22:19:52.636195Z","title":"In Advances in Neural Information Processing Systems (NeurIPS), pages 849–856","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.636195Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:3c4972d48313edcd04adfcf3eaf398c5ea8a57c5ab50b4cf34399a653e5737a3","observation_id":"4d2e9a84-5d0d-4993-a114-52a94c6f4b7c","resolution":{"observed_at":"2026-08-10T22:19:52.636195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.243475Z","title":"stop execution if X is true","venue":null,"work_id":"e3d36e4c-ac26-4331-a2d0-692632da1802","year":2001},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.718765Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:6f57f70f2fa015599b16bb7f47a40a9e332e99062c3982cae1eb148d8cf28dab","observation_id":"e8ab9796-9968-4d86-b365-93bab8e9ef69","resolution":{"observed_at":"2026-08-10T22:19:53.246861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.459540Z","title":"In IEEE Conference on Com- puter Vision and Pattern Recognition (CVPR), pages 1735–1742","venue":null,"work_id":"c58c92a0-f6d0-4d95-b5f4-084dc5fa8bf6","year":2022},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.620948Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:4ce16bccd4cc4faa7665b6f38a543cb5ff277156cc57f278c97727a1e3b5aaa7","observation_id":"735ef1a2-1143-4332-8459-25218799a086","resolution":{"observed_at":"2026-08-10T22:19:53.463425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09279","last_updated":"2024-10-07T21:24:59Z","snapshot_observed_at":"2026-08-12T23:43:26.084884Z","submitted_at":"2024-06-13T16:17:21Z","title":"Unpacking DPO and PPO: Disentangling Best Practices for Learning from Preference Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09279","snapshot_observed_at":"2026-08-10T22:19:52.624338Z","title":"Pro- ceedings of the 20th Annual Conference on Learning Theory (COLT), pages 528–543","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.624338Z"},"links":{"cited_paper":"/paper/2406.09279","citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:42c43c86452dbaa296bd90221b53fd3c40289b9ffacc85b23e8df78598e8a762","observation_id":"161117fc-6c47-4808-bf29-27efd01ab84c","resolution":{"observed_at":"2026-08-10T22:19:52.624338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12908","last_updated":"2023-11-21T15:24:05Z","snapshot_observed_at":"2026-08-13T05:20:21.767335Z","submitted_at":"2023-11-21T15:24:05Z","title":"Diffusion Model Alignment Using Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12908","snapshot_observed_at":"2026-08-10T22:19:52.646022Z","title":"Journal of machine learning research, 9(11):2579–2605","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.646022Z"},"links":{"cited_paper":"/paper/2311.12908","citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:ff638a358c83545a2ff40f06c03c4b4d7a3c6128b5a53566bb15beac3586bdfe","observation_id":"8efc0ae7-d759-4fe7-b41a-a83990e3f85f","resolution":{"observed_at":"2026-08-10T22:19:52.646022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-10T22:19:52.643057Z","title":"The MIT Press","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.643057Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:e1226136fdf554e2e6f1ffbb2ac70e1d27e90072a8fe9c72f271074d2504240a","observation_id":"c7c61bca-92d7-45f7-a2de-b5a16724f374","resolution":{"observed_at":"2026-08-10T22:19:52.643057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:19:53.450063Z","title":"In International Conference on Learning Representations (ICLR)","venue":null,"work_id":"cf8fa3f1-bf80-4d2c-9e41-eee0866243c2","year":2009},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.632670Z"},"links":{"citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:019afd87420cabbc5ba63ffc7d2dd406723c9932ff148d6ea5c7ef11ee004581","observation_id":"36d39408-377b-4298-ab49-eb471f7f3c6e","resolution":{"observed_at":"2026-08-10T22:19:53.453574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-10T22:19:52.610934Z","title":"arXiv preprint arXiv:2110.14168","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.610934Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:59ef8d62f208c014df59dd1a297cd1623bbde1925316f4a23f808d99fe3122a2","observation_id":"c685b90a-17d4-48ae-a7c7-1b2dda82f10a","resolution":{"observed_at":"2026-08-10T22:19:52.610934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-10T22:19:52.639456Z","title":"arXiv preprint arXiv:2203.02155","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.639456Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:33b29a0c145116a4234e2e46871a3240d18069922f3a1a432ab5d38f10a41743","observation_id":"f71bc17a-6336-4ed3-bc88-ea28b62fdd03","resolution":{"observed_at":"2026-08-10T22:19:52.639456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-11T17:22:43.545531Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-10T22:19:52.628333Z","title":"GitHub reposi- tory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.628333Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:6e2808ef12dff906528f17784596ae2bed1e953142950c89ff2566def0c5a82f","observation_id":"3e278364-c54a-4a64-b026-deea65b7dd89","resolution":{"observed_at":"2026-08-10T22:19:52.628333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04132","last_updated":"2024-03-07T01:22:38Z","snapshot_observed_at":"2026-08-02T17:55:33.750637Z","submitted_at":"2024-03-07T01:22:38Z","title":"Chatbot Arena: An Open Platform for Evaluating LLMs by Human Preference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04132","snapshot_observed_at":"2026-08-10T22:19:52.606670Z","title":"Preprint, arXiv:2403.04132","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:52.606670Z"},"links":{"cited_paper":"/paper/2403.04132","citing_paper":"/paper/2501.03271"},"observation_digest":"sha256:fb5a670930b71511118b8aa92ca8484765d4b3ac078ed456009bddeb31cfd079","observation_id":"32c14187-a3d3-4346-9292-90415eed753b","resolution":{"observed_at":"2026-08-10T22:19:52.606670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.03271","last_updated":"2025-01-20T04:24:56Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T01:42:12.935693Z","submitted_at":"2025-01-05T00:08:52Z","title":"DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":35},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2501.03271."}