{"as_of":"2026-08-07T09:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:769c375f2e8c8caa898aada8b4fef451dcb3d568242d434eedee0191d2415521","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:09:44.129023Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-07T05:09:44.129023Z","title":"A survey of direct preference optimization.arXiv preprint arXiv:2503.11701, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08745","last_updated":"2025-06-10T12:40:39Z","snapshot_observed_at":"2026-08-07T05:00:36.359594Z","submitted_at":"2025-06-10T12:40:39Z","title":"Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:09:44.129023Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2506.08745"},"observation_digest":"sha256:497f4cca1019433291c44f60917c69378bc3d0da461194b6e235597fb0ff8abe","observation_id":"e1c935f6-3a28-48d5-aa9a-b50a8efa91e9","resolution":{"observed_at":"2026-08-07T05:09:44.129023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-07T05:09:34.053645Z","title":"A survey of direct preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09096","last_updated":"2025-06-16T04:03:11Z","snapshot_observed_at":"2026-08-07T05:00:14.370421Z","submitted_at":"2025-06-10T12:59:14Z","title":"Intra-Trajectory Consistency for Reward Modeling","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:09:34.053645Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2506.09096"},"observation_digest":"sha256:6ff1d2b2261d9e1965f9149223d54fd8a877679a4499f2f675d995cae3940907","observation_id":"99d4cb26-b296-413f-a0f2-d56a0e88cb02","resolution":{"observed_at":"2026-08-07T05:09:34.053645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-06T15:40:33.764607Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15281","last_updated":"2025-07-21T06:30:39Z","snapshot_observed_at":"2026-08-06T15:33:26.321695Z","submitted_at":"2025-07-21T06:30:39Z","title":"A Novel Self-Evolution Framework for Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T15:40:33.764607Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2507.15281"},"observation_digest":"sha256:15f7cceb28acfe24990963e6a0c0bea177559828d40322c356335e3c29a46b72","observation_id":"7a998fd7-a7b3-4929-9f05-f782f3d09b1b","resolution":{"observed_at":"2026-08-06T15:40:33.764607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2509.03526","last_updated":"2026-05-20T03:07:46Z","snapshot_observed_at":"2026-08-07T01:53:38.136292Z","submitted_at":"2025-08-25T07:31:48Z","title":"Enhancing Speech Large Language Models through Reinforced Behavior Alignment","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-21T22:23:52.392075Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2509.03526"},"observation_digest":"sha256:d6e2e52af0e0df475529e578be63d3ea67e9710124cf1a837c2183b144127456","observation_id":"8de070ee-5aae-42de-9bcb-a29fff768523","resolution":{"observed_at":"2026-05-21T22:24:23.437263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-04T06:54:11.231474Z","title":"A survey of direct preference optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.00382","last_updated":"2026-08-03T16:22:30Z","snapshot_observed_at":"2026-08-06T23:37:31.925847Z","submitted_at":"2025-11-01T03:29:56Z","title":"Efficiency vs. Alignment: Investigating Safety and Fairness Risks in Parameter-Efficient Fine-Tuning of LLMs","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T06:54:11.231474Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2511.00382"},"observation_digest":"sha256:3a0637183eeed403208e0eb3b1731c7aa711bf3c7bdf4e44903951d58152960b","observation_id":"ecd42d58-be7e-4676-946a-a1142d2fc2ae","resolution":{"observed_at":"2026-08-04T06:54:11.231474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2603.18113","last_updated":"2026-05-09T03:21:15Z","snapshot_observed_at":"2026-08-02T05:27:37.366682Z","submitted_at":"2026-03-18T14:05:51Z","title":"VC-Soup: Value-Consistency Guided Multi-Value Alignment for Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T09:38:32.977517Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2603.18113"},"observation_digest":"sha256:c62813379eca53effcf970b26d4806313d3a6f2b11b9f62df606f4be619c858f","observation_id":"ee5a3204-80e7-427e-b045-6d032292e33a","resolution":{"observed_at":"2026-05-15T09:39:54.350069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2604.07941","last_updated":"2026-04-16T04:43:04Z","snapshot_observed_at":"2026-08-02T07:24:04.075021Z","submitted_at":"2026-04-09T08:00:37Z","title":"Large Language Model Post-Training: A Unified View of Off-Policy and On-Policy Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:28:58.515666Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2604.07941"},"observation_digest":"sha256:5f8a04c1f866218d167ca75cbaa94972e15ee559896016b0aca3be24685c460c","observation_id":"1696a3ff-944e-435f-8c6c-275e5452166a","resolution":{"observed_at":"2026-05-11T00:30:53.684688Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2604.11259","last_updated":"2026-04-13T10:12:03Z","snapshot_observed_at":"2026-08-03T00:30:16.982532Z","submitted_at":"2026-04-13T10:12:03Z","title":"Mobile GUI Agent Privacy Personalization with Trajectory Induced Preference Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T16:11:49.149334Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2604.11259"},"observation_digest":"sha256:b30a26351f440c814b7e298151ad7fada7c2047968253ff352b803d60b1d404c","observation_id":"fd377ff2-8a5f-44e1-bfc0-9fec693a5a7f","resolution":{"observed_at":"2026-05-11T09:11:01.255353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":1},"reference_index":177,"source":"arxiv_source","source_observed_at":"2026-05-13T04:55:55.013900Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:abdafde2805c6ced6fdeccc26eee68bba0b2927c25ab735969c6c3f8976bb263","observation_id":"9c1d35da-0d6c-45d9-8dd0-cd8bd70ac6c5","resolution":{"observed_at":"2026-05-13T04:57:16.671074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-15T05:41:10.714594Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:8ae1864f215c633284f4ee923704a2b79e0b96bf31086b4ba6d3c66587a9cc3b","observation_id":"6b978201-41a7-494c-915b-f4ea47e82fac","resolution":{"observed_at":"2026-05-15T05:45:05.018076Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2605.30930","last_updated":"2026-05-29T07:19:58Z","snapshot_observed_at":"2026-08-02T17:43:14.199867Z","submitted_at":"2026-05-29T07:19:58Z","title":"TUX: Measuring Human--AI Tacit Understanding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-28T21:18:37.366258Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2605.30930"},"observation_digest":"sha256:b1aa0013cac627b6fb10c58eed25b3c832f021362320d70754e6ab612568c089","observation_id":"62e96638-a393-4a34-84f2-c538b10ce10c","resolution":{"observed_at":"2026-06-28T21:22:38.748817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2606.18323","last_updated":"2026-06-16T15:41:44Z","snapshot_observed_at":"2026-08-06T02:49:06.057401Z","submitted_at":"2026-06-16T15:41:44Z","title":"Reliable Neural-Codec Text-to-Speech by ASR Self-Verification and Distillation: Near-Zero Catastrophic Failures Across Models and Codecs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T22:46:47.786929Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2606.18323"},"observation_digest":"sha256:37244474219af5812478c42ecf7aaf27c2a4927c0eb30b86e7a688ef20b6a26b","observation_id":"20ac0933-1d06-433f-bea2-65123a72cac4","resolution":{"observed_at":"2026-07-03T23:19:02.939868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-02T13:36:56.375550Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21610","last_updated":"2026-05-20T04:43:02Z","snapshot_observed_at":"2026-08-06T13:09:35.487490Z","submitted_at":"2026-05-20T04:43:02Z","title":"SCOPE and SCION: A Benchmark and an Auditable Reference Pipeline for Schema Induction and Fusion from Text","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T13:36:56.375550Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2607.21610"},"observation_digest":"sha256:eb4ec7cba428a4e8c91dd693f6bd9110e3e9f6b711875bb1ed08f683ec2b9386","observation_id":"35783b72-aa3d-4470-8121-0eaf885c9031","resolution":{"observed_at":"2026-08-02T13:36:56.375550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-03T00:22:51.122740Z","title":"arXiv preprint arXiv:2503.11701 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28814","last_updated":"2026-07-30T20:16:03Z","snapshot_observed_at":"2026-08-06T01:56:46.237133Z","submitted_at":"2026-07-30T20:16:03Z","title":"Rolling With Resistance: Preference-Optimized LLM Counselors Can Trade Goal Persistence for Relational Attunement in Motivational Interviewing","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-03T00:22:51.122740Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2607.28814"},"observation_digest":"sha256:cdbe00e9104ae98f0504e16bd3b573c021ed57b9a29bd08267be3edea5dd1ed2","observation_id":"6f2b483e-719d-4b54-a9a6-702675fde444","resolution":{"observed_at":"2026-08-03T00:22:51.122740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.11701/citation-record","integrity":"/paper/2503.11701/integrity","json":"/paper/2503.11701/citation-record.json","paper":"/paper/2503.11701"},"outbound":[],"paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T01:42:32.296078Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2503.11701."}