{"as_of":"2026-08-09T11:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a02f22a2697981314581d5c35ef96d503bdd05ae5d0779cb66f82a8613dc3d6d","coverage":[{"denominator":93,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":93,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T07:21:37.075273Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T14:25:39.401131Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:28:31.100259Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"cited_work":{"arxiv_id":"2510.26707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.26707","snapshot_observed_at":"2026-07-16T02:21:43.072236Z","title":"injustice","venue":null,"work_id":"01f40c90-596a-4d92-b27d-3142698ce77a","year":2025},"citing_paper":{"arxiv_id":"2602.20021","last_updated":"2026-02-23T16:28:48Z","snapshot_observed_at":"2026-07-06T22:46:45.213871Z","submitted_at":"2026-02-23T16:28:48Z","title":"Agents of Chaos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T07:03:41.003127Z"},"links":{"cited_paper":"/paper/2510.26707","citing_paper":"/paper/2602.20021"},"observation_digest":"sha256:f60fd518cba1735bc253de0b01980ecba8ffb918413057b7ba2eaad9c1f2d658","observation_id":"2b36d67e-7fce-43c3-aaf8-ea4c70cb0075","resolution":{"observed_at":"2026-07-16T02:21:43.072236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"cited_work":{"arxiv_id":"2510.26707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.26707","snapshot_observed_at":"2026-07-16T02:21:43.072236Z","title":"injustice","venue":null,"work_id":"01f40c90-596a-4d92-b27d-3142698ce77a","year":2025},"citing_paper":{"arxiv_id":"2607.01690","last_updated":"2026-07-02T04:31:41Z","snapshot_observed_at":"2026-08-02T22:45:02.076056Z","submitted_at":"2026-07-02T04:31:41Z","title":"Epistemic Goggles: A Pretrained Module that Induces an Epistemic Frame via Gradient Editing","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-03T14:25:39.401131Z"},"links":{"cited_paper":"/paper/2510.26707","citing_paper":"/paper/2607.01690"},"observation_digest":"sha256:91e4e41b4bc65f44d5fdffeecec3ee59aab0b41d428a4a5eca08b66bde21111e","observation_id":"1dc20ae4-13db-441a-9fc1-a700325ee9cf","resolution":{"observed_at":"2026-07-16T02:21:43.072236Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.26707/citation-record","integrity":"/paper/2510.26707/integrity","json":"/paper/2510.26707/citation-record.json","paper":"/paper/2510.26707"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:32.162650Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:32.162650Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:a8b77fd323592f214f90c004e9597ef96696c4ad672cc130de5a8d652ee62c63","observation_id":"b7020dab-58e3-4a4e-8b27-e7ddb9b3a545","resolution":{"observed_at":"2026-08-04T07:21:32.162650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:32.254871Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:32.254871Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:c7e1c4aa0c5fa8e7f846e9062d59e993e0cfe1d6ad6ad170c3b3fbc9cc29858b","observation_id":"583ba2b3-030e-489b-b61a-edf3aaf2545b","resolution":{"observed_at":"2026-08-04T07:21:32.254871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09932","last_updated":"2024-09-06T00:46:40Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T16:58:28Z","title":"Foundational Challenges in Assuring Alignment and Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09932","snapshot_observed_at":"2026-08-04T07:21:32.304935Z","title":"Foundational challenges in assuring alignment and safety of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:32.304935Z"},"links":{"cited_paper":"/paper/2404.09932","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:269be5686782adc394a0d696912a8ec42d674b03e17bffd84dbfdccd142f5302","observation_id":"c691439b-6c02-4607-97ce-bce0e5225742","resolution":{"observed_at":"2026-08-04T07:21:32.304935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:32.415062Z","title":"Explicitly unbiased large language models still form biased associations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:32.415062Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:3a39cb54c95b3a3ca5fc7f53975b18109c55e1885a1d1f60c5b3cb87b2f4843f","observation_id":"ccea4413-468e-4c0d-a1d5-00ca6ef01197","resolution":{"observed_at":"2026-08-04T07:21:32.415062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-04T07:21:32.505290Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:32.505290Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:22551a346ee3a0b1b43c049407b90c0e32323ad9629acf57262e7f0a1d2ec4b5","observation_id":"25ef445c-80f4-4d22-b188-e1e7d5403e31","resolution":{"observed_at":"2026-08-04T07:21:32.505290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:32.644736Z","title":"Managing extreme AI risks amid rapid progress","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:32.644736Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:b03f2b14ba09ccc5be635b62aa02fa4f4ff228f4b747d89e5a6358c9adb9ab02","observation_id":"868e3cb9-8791-4c68-bf8d-ce68f25f16a6","resolution":{"observed_at":"2026-08-04T07:21:32.644736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11641","last_updated":"2019-11-26T15:31:46Z","snapshot_observed_at":"2026-08-08T00:48:01.603669Z","submitted_at":"2019-11-26T15:31:46Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11641","snapshot_observed_at":"2026-08-04T07:21:32.759175Z","title":"Piqa: Reasoning about physical commonsense in natural language, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:32.759175Z"},"links":{"cited_paper":"/paper/1911.11641","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:95c89764c3769e981ca649f306a4f78d8fbaa36a97c56a44084dae10b2b9104b","observation_id":"bec17b05-1907-4ff2-b9d9-eef95268efad","resolution":{"observed_at":"2026-08-04T07:21:32.759175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:32.848184Z","title":"Picking on the same person: Does algorithmic monoculture lead to outcome homogenization? Advances in Neural Information Processing Systems, 35: 0 3663--3678, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:32.848184Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:a6f2aefa7d1724d3019f219f9710c7968f0d42e39f31f3a32df7437155a85b44","observation_id":"7d92a9b5-5d41-4c2a-aaad-d14ed3ff6f7e","resolution":{"observed_at":"2026-08-04T07:21:32.848184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:32.895674Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:32.895674Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:497deb9124a3870ea766194de90d778fc2732afd4cd37be0a2ec52e3f5255e3e","observation_id":"d25f0d5f-e33a-479a-89d8-bd8935ca3324","resolution":{"observed_at":"2026-08-04T07:21:32.895674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:32.989406Z","title":"Density-based clustering based on hierarchical density estimates","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:32.989406Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:c0c710c4b92a18d9f2f6ff0b9018562eb18afdf393071148ec1eb22cc780d375","observation_id":"ff12c554-9e1a-449e-b44b-ca34341a3352","resolution":{"observed_at":"2026-08-04T07:21:32.989406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:33.151838Z","title":"How people use chatgpt","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:33.151838Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:ab24e008e7380e44beb67abd1485a25880f8dc5d26ec9ac7c0392f6809d48bdd","observation_id":"61c25588-6734-4e04-a503-e6ac06b173d4","resolution":{"observed_at":"2026-08-04T07:21:33.151838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:33.275598Z","title":"Chatbot arena: An open platform for evaluating LLMs by human preference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:33.275598Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:3e73c70f9edb46b6ad290a4884f5debc139d8846d509a9cee30e2b57ab6b4a69","observation_id":"f8af7be2-4772-4162-95cd-7d2cd92e1e12","resolution":{"observed_at":"2026-08-04T07:21:33.275598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:33.428012Z","title":"Reward model interpretability via optimal and pessimal tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:33.428012Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:964d308d8a10d2f5cf61f0532086f5273ad60e1c150681acc54daa0baa9532c6","observation_id":"80661ef1-2db9-42e3-a4c4-78ed71680965","resolution":{"observed_at":"2026-08-04T07:21:33.428012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:33.594774Z","title":"Ultrafeedback: Boosting language models with high-quality feedback, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:33.594774Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:ffe43ca3d3eb7cf954f580072dcc9c7f2150cbc4846d522463ca8a7ff9698b9b","observation_id":"c0854b5b-b415-4338-9639-f691b53da6dd","resolution":{"observed_at":"2026-08-04T07:21:33.594774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:33.744615Z","title":"Towards measuring the representation of subjective global opinions in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:33.744615Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:363b06e78372ecfda762a52f68212e840fa36c4b68b17f70de52f8536d3e2d40","observation_id":"8e58ee50-3c08-4035-bb6a-a2d358894d86","resolution":{"observed_at":"2026-08-04T07:21:33.744615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04626","last_updated":"2024-04-06T13:24:37Z","snapshot_observed_at":"2026-07-06T17:56:32.062035Z","submitted_at":"2024-04-06T13:24:37Z","title":"Towards Analyzing and Understanding the Limitations of DPO: A Theoretical Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04626","snapshot_observed_at":"2026-08-04T07:21:33.898254Z","title":"Towards analyzing and understanding the limitations of DPO : A theoretical perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:33.898254Z"},"links":{"cited_paper":"/paper/2404.04626","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:b38b9a7138dc9cf2724c175569e00c2af3de474e872750f282136bb262767f58","observation_id":"ff4fe65e-d1f5-4eb6-96dc-0c36871e3cd9","resolution":{"observed_at":"2026-08-04T07:21:33.898254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:34.060310Z","title":"Artificial intelligence, values, and alignment","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:34.060310Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:13f7d8ec26efcede17e54a6afa4202eb9d9667f97da69753b660695e0e105a36","observation_id":"4e89affd-d33a-40ea-ad19-cdf217241346","resolution":{"observed_at":"2026-08-04T07:21:34.060310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:34.179117Z","title":"The delta learning hypothesis: Preference tuning on weak data can yield strong gains","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:34.179117Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:cb363e287634180669bd62f9082d6bc94c799ff8cbd59ca7bfc902ad1e7c88b4","observation_id":"4e5dfb86-0977-4182-ab54-2e041776e0e3","resolution":{"observed_at":"2026-08-04T07:21:34.179117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:34.326465Z","title":"Donoho, and Sanmi Koyejo","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:34.326465Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:d94328a8530c5a61ca0c3e5a8bf1b9e27728c2c7daa63f6e4513f226ec259961","observation_id":"8db42bf4-9729-41d2-b6d9-c1eba768a891","resolution":{"observed_at":"2026-08-04T07:21:34.326465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19443","last_updated":"2025-01-22T08:25:25Z","snapshot_observed_at":"2026-08-07T23:46:21.698721Z","submitted_at":"2024-03-28T14:15:10Z","title":"Mixed Preference Optimization: Reinforcement Learning with Data Selection and Better Reference Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19443","snapshot_observed_at":"2026-08-04T07:21:34.487518Z","title":"Mixed preference optimization: Reinforcement learning with data selection and better reference model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:34.487518Z"},"links":{"cited_paper":"/paper/2403.19443","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:65948dc61752a999c8d19969bfa36e1a86d5d0118d67cfce28c4b9b0d186d4a3","observation_id":"11313824-2d8c-4dac-84da-31195cb06a85","resolution":{"observed_at":"2026-08-04T07:21:34.487518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14093","snapshot_observed_at":"2026-08-04T07:21:34.645305Z","title":"Alignment faking in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:34.645305Z"},"links":{"cited_paper":"/paper/2412.14093","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:a93c212e98736cdaa01d62ecb818e12ada766a3b315f7cd786b8e5e5561c0016","observation_id":"c969a66e-9580-4f57-b164-ca65bdc3adca","resolution":{"observed_at":"2026-08-04T07:21:34.645305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:34.807216Z","title":"Assessing the alignment of large language models with human values for mental health integration: Cross-sectional study using schwartz’s theory of basic values","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:34.807216Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:584d8b42c0dcc58a44675fd052b9c74f1f96e2839c34849e69c9c9a497ba0231","observation_id":"db5c1e40-539c-49b6-9dc1-a79331402d02","resolution":{"observed_at":"2026-08-04T07:21:34.807216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-04T07:21:34.925316Z","title":"Measuring massive multitask language understanding, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:34.925316Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:4878e4daaac8dcb02719acb6c3c783cab0611a91fe97cd67a4190701ccd7551b","observation_id":"7081315d-ac38-409d-8dee-b50f99117000","resolution":{"observed_at":"2026-08-04T07:21:34.925316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:35.048765Z","title":"Collective constitutional AI : Aligning a language model with public input","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:35.048765Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:caaf8b1bbbe041218b57cc814f4df107df85f289a243873bb85d53626be9fec4","observation_id":"4df6632a-359b-49ae-94ca-c2ce52d9cf17","resolution":{"observed_at":"2026-08-04T07:21:35.048765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15236","last_updated":"2025-04-21T17:13:16Z","snapshot_observed_at":"2026-08-07T19:41:52.379127Z","submitted_at":"2025-04-21T17:13:16Z","title":"Values in the Wild: Discovering and Analyzing Values in Real-World Language Model Interactions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15236","snapshot_observed_at":"2026-08-04T07:21:35.154191Z","title":"Values in the wild: Discovering and analyzing values in real-world language model interactions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:35.154191Z"},"links":{"cited_paper":"/paper/2504.15236","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:f8554b047401027254520241971aab59e2df8cf8dfca9bcd1171ee6563533f5a","observation_id":"c59fcb09-fbd9-4b40-8cd6-a72464373a79","resolution":{"observed_at":"2026-08-04T07:21:35.154191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:35.236114Z","title":"The n+ implementation details of RLHF with PPO : A case study on TL ; DR summarization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:35.236114Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:aff4318666d85038a69dddfe0094d5990221a71c3b1ddd051583d1503cba7914","observation_id":"f7171a3d-7da3-43e6-992e-c3a88d358e18","resolution":{"observed_at":"2026-08-04T07:21:35.236114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:35.313021Z","title":"Smith, Yejin Choi, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:35.313021Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:0539c6579d815298f4292394307587b9fb30c94e58cafc25f0ae54cf7c4975dd","observation_id":"7d834588-3883-4372-ace6-2a3ea5455fb9","resolution":{"observed_at":"2026-08-04T07:21:35.313021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:35.393478Z","title":"Evaluating and inducing personality in pre-trained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:35.393478Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:5e3160077cc3a6ba2972b170cd005ac0cdefc93764d8250ef2be2c2ab72cfab6","observation_id":"43fa4ae1-344f-42cd-92a8-5ae510799db5","resolution":{"observed_at":"2026-08-04T07:21:35.393478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07574","last_updated":"2022-07-12T17:48:46Z","snapshot_observed_at":"2026-08-04T11:25:24.291696Z","submitted_at":"2021-10-14T17:38:12Z","title":"Can Machines Learn Morality? The Delphi Experiment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07574","snapshot_observed_at":"2026-08-04T07:21:35.508909Z","title":"Can machines learn morality? The D elphi experiment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:35.508909Z"},"links":{"cited_paper":"/paper/2110.07574","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:d73d88eb0967565076e5deb550011681b3322ee2ee00a094bed107667709ead9","observation_id":"6664693e-d4f1-4378-b89a-bfb1aa9d12ff","resolution":{"observed_at":"2026-08-04T07:21:35.508909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:35.671360Z","title":"The PRISM alignment dataset: What participatory, representative and individualised human feedback reveals about the subjective and multicultural alignment of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:35.671360Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:f405c9a06c980ec05b001f1ca69c46da989401bb0fb3064f41bd26804290ed68","observation_id":"8c019ce7-207a-4777-93f6-ce1786575ea5","resolution":{"observed_at":"2026-08-04T07:21:35.671360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06452","last_updated":"2024-02-19T14:39:07Z","snapshot_observed_at":"2026-07-29T18:39:02.141391Z","submitted_at":"2023-10-10T09:25:44Z","title":"Understanding the Effects of RLHF on LLM Generalisation and Diversity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06452","snapshot_observed_at":"2026-08-04T07:21:35.867471Z","title":"Understanding the effects of RLHF on LLM generalisation and diversity","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:35.867471Z"},"links":{"cited_paper":"/paper/2310.06452","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:62d45c9999fa4f4180d5095cf7453750d11ecedc9cfbd1747ecebfe1249a7ae8","observation_id":"e4f0ae8d-e82a-4240-b65c-68f0c77ce503","resolution":{"observed_at":"2026-08-04T07:21:35.867471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10636","last_updated":"2024-04-17T16:27:37Z","snapshot_observed_at":"2026-07-06T18:01:01.206270Z","submitted_at":"2024-03-27T18:12:02Z","title":"What are human values, and how do we align AI to them?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10636","snapshot_observed_at":"2026-08-04T07:21:36.038024Z","title":"What are human values, and how do we align ai to them? arXiv preprint arXiv:2404.10636, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.038024Z"},"links":{"cited_paper":"/paper/2404.10636","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:4e17ad0956fe6f413ac6102dc7a3cafeacf9e2bf60b469ff58c4d8560aa9daff","observation_id":"799a5af8-7389-4679-a38b-7c4e8bf47bf9","resolution":{"observed_at":"2026-08-04T07:21:36.038024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05475","last_updated":"2025-02-08T07:24:04Z","snapshot_observed_at":"2026-08-09T02:15:12.668653Z","submitted_at":"2025-02-08T07:24:04Z","title":"You Are What You Eat -- AI Alignment Requires Understanding How Data Shapes Structure and Generalisation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05475","snapshot_observed_at":"2026-08-04T07:21:36.204883Z","title":"You are what you eat-- AI alignment requires understanding how data shapes structure and generalisation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.204883Z"},"links":{"cited_paper":"/paper/2502.05475","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:a359ff04efeaf32531e70f6f5251420e1acfe823976295fbbf2c33fc7f8dd41f","observation_id":"9b3ed33b-b11d-49c6-9727-d10fa1c087e9","resolution":{"observed_at":"2026-08-04T07:21:36.204883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.365788Z","title":"Beyond probabilities: Unveiling the misalignment in evaluating large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.365788Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:a1c720c4e247420a3b848a0d13d1244f5d96c1680e4f8baf01c9734df60e39f3","observation_id":"6a5cdd90-821f-44c8-aea4-7e8a7dcc8ae5","resolution":{"observed_at":"2026-08-04T07:21:36.365788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.527874Z","title":"Treleaven, and Miguel Rodrigues Rodrigues","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.527874Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:9e0f2f6413d6e14c8a26599716ee75690e528c2330f96135d62dadfc7fb4b8f4","observation_id":"c1c841ae-ac45-4cfc-9560-50c6fcbf4233","resolution":{"observed_at":"2026-08-04T07:21:36.527874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.652253Z","title":"How people use claude for support, advice, and companionship, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.652253Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:a89851636c16f8ac321bd2c0354c5bc085058149273876e699124a20d4e257ac","observation_id":"401a553f-a0ce-4630-9c9a-6d94c8cc87f6","resolution":{"observed_at":"2026-08-04T07:21:36.652253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.772987Z","title":"UMAP : Uniform manifold approximation and projection","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.772987Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:cfa42a37fbeb71fb85d9341c32043865ea8685025d8b92e4b4cbd740698485cb","observation_id":"e0443012-cc9c-43b4-85a3-a507ff5a1f90","resolution":{"observed_at":"2026-08-04T07:21:36.772987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.887916Z","title":"Sim PO : Simple preference optimization with a reference-free reward","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.887916Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:4dd9898dc1404ecffa77910d526fa94d284b4b3ce03ff27a21636544d05595d0","observation_id":"c41dd467-5975-4b76-9836-c30c62f78fff","resolution":{"observed_at":"2026-08-04T07:21:36.887916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.923689Z","title":"S em E val-2016 task 6: Detecting stance in tweets","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.923689Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:62825a87d7c45685d89a0d974951d9f3cbfa327666d456d4582df8d144bd2a11","observation_id":"ee67d119-5e3b-4ce7-bdec-3780c02cec85","resolution":{"observed_at":"2026-08-04T07:21:36.923689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.927567Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.927567Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:8f27f18b86375273e25443dcd0f5542d3079802601a85a2e10654d9fec919b13","observation_id":"7c69da23-1635-43ab-a2f5-28564340eecd","resolution":{"observed_at":"2026-08-04T07:21:36.927567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.930799Z","title":"Reinforcement learning finetunes small subnetworks in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.930799Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:7bde29daf210a785b1eab1cf843d06a5e429ffac9899d2c51016c30079c01d22","observation_id":"d68db222-c491-47f3-966b-20f2c0522de4","resolution":{"observed_at":"2026-08-04T07:21:36.930799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.933807Z","title":"Value imprint: A technique for auditing the human values embedded in RLHF datasets","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.933807Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:0928ddf60858e17dd4fc02dbfd3f86715d075cdd3ae247ec2bc9b2ba7e4434a3","observation_id":"4e02c4ea-5139-49a9-ad6c-d877154124cb","resolution":{"observed_at":"2026-08-04T07:21:36.933807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.937221Z","title":"Attributing mode collapse in the fine-tuning of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.937221Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:80ea08dcbc31f211ec66ceb32adc9d2311ded048c208f725e8abf5388bbac491","observation_id":"4506d2a1-8ed9-4f8f-a201-446923a8bc83","resolution":{"observed_at":"2026-08-04T07:21:36.937221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.940405Z","title":"Help OpenAI fix over-refusals! https://community.openai.com/t/help-openai-fix-over-refusals/409799, October 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.940405Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:527c89650910294a22d5cf5b05d612b345f1d5937588e6fe41fddda709877f3a","observation_id":"93f02863-4f38-4f68-b74f-dcc50402cecf","resolution":{"observed_at":"2026-08-04T07:21:36.940405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.943222Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.943222Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:fd0abe49cfb41e7ec70746fc804b962a42c178bd04276d761d1a82373ae9849f","observation_id":"cb844eee-afd8-4989-819d-406d159fb918","resolution":{"observed_at":"2026-08-04T07:21:36.943222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05196","last_updated":"2024-07-01T16:36:30Z","snapshot_observed_at":"2026-08-09T02:48:08.220255Z","submitted_at":"2023-09-11T02:16:47Z","title":"Does Writing with Language Models Reduce Content Diversity?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05196","snapshot_observed_at":"2026-08-04T07:21:36.946254Z","title":"Does writing with language models reduce content diversity? arXiv preprint arXiv:2309.05196, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.946254Z"},"links":{"cited_paper":"/paper/2309.05196","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:8e311e4a3d2feb9158659e3294df5ccec28465ae119bd5d4fed442738126938e","observation_id":"2163ede4-d52a-41e7-8815-17c97486c2d1","resolution":{"observed_at":"2026-08-04T07:21:36.946254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13228","last_updated":"2024-07-03T13:46:33Z","snapshot_observed_at":"2026-08-08T16:03:10.053914Z","submitted_at":"2024-02-20T18:42:34Z","title":"Smaug: Fixing Failure Modes of Preference Optimisation with DPO-Positive","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13228","snapshot_observed_at":"2026-08-04T07:21:36.949344Z","title":"Smaug: Fixing failure modes of preference optimisation with DPO -positive","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.949344Z"},"links":{"cited_paper":"/paper/2402.13228","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:efcd7b5cae038b230ad2acdf621a0e04fb65efd8956d65cf9940831b4131517d","observation_id":"7612a28b-e51f-4648-9590-bcdca58dfb72","resolution":{"observed_at":"2026-08-04T07:21:36.949344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16180","last_updated":"2023-07-30T09:34:35Z","snapshot_observed_at":"2026-07-06T16:00:16.896971Z","submitted_at":"2023-07-30T09:34:35Z","title":"Do LLMs Possess a Personality? Making the MBTI Test an Amazing Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16180","snapshot_observed_at":"2026-08-04T07:21:36.952385Z","title":"Do LLMs possess a personality? M aking the MBTI test an amazing evaluation for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.952385Z"},"links":{"cited_paper":"/paper/2307.16180","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:4626bc425aaad5caf6473d812f21b7285ef577a25617eaba3ccd9031d696c19b","observation_id":"f487b967-7c27-41da-acc1-d30af7ec929b","resolution":{"observed_at":"2026-08-04T07:21:36.952385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.955565Z","title":"What matters in data for DPO ? arXiv preprint arXiv:2508.18312, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.955565Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:b7e50a859d14022f252e8a35c190b4803ec8b0e59872b1233e7a5c74b834a1b0","observation_id":"b4505e6d-be81-4c75-b378-f56b154576a8","resolution":{"observed_at":"2026-08-04T07:21:36.955565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.958465Z","title":"Enhancing alignment using curriculum learning & ranked preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.958465Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:8377ad7e14441702a499730caf466d743eb8474bd7563dbf99962405e002aede","observation_id":"a30fd34e-c19f-41c8-bfba-41909370aeb9","resolution":{"observed_at":"2026-08-04T07:21:36.958465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.961607Z","title":"AI psychometrics: Assessing the psychological profiles of large language models through psychometric inventories","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.961607Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:78858ec73979e76fabe1d0ea08321305d3e76315d8e4d28be492491e51e22379","observation_id":"8b0332f1-9254-4451-9e14-ac841cfceef4","resolution":{"observed_at":"2026-08-04T07:21:36.961607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.964623Z","title":"Discovering language model behaviors with model-written evaluations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.964623Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:6437b1bc2e7a26f9684b4ef3a1bf4563731af49446d02e43139f5ddb6a28a318","observation_id":"0596c147-d6b9-4acf-b9a3-022ba8ba951a","resolution":{"observed_at":"2026-08-04T07:21:36.964623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.967897Z","title":"The lock-in hypothesis: Stagnation by algorithm","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.967897Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:8a41d1d51bdbff0ad49fc77aae965c4114dd50a109ed7449036ba51370823353","observation_id":"7a30bb37-6d7b-48c4-afa4-4b7135e157ea","resolution":{"observed_at":"2026-08-04T07:21:36.967897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.971048Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.971048Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:075b3b3d1f56e840b4588978acdd575ca97e3e7a2e1f17e58296fd816fc23eeb","observation_id":"1a50e33d-3126-4b41-93bd-cda1c32d5553","resolution":{"observed_at":"2026-08-04T07:21:36.971048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.1248","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Balancing the budget: Understanding trade-offs between supervised and preference-based finetuning","venue":null,"work_id":"0656bd78-fb6a-484c-834c-99f890253f69","year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.974067Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:d76d0ad65985b0e9b35e08c2bd57fc852dc14cdf9b5df4acc4f251cecf4bb327","observation_id":"7ba371e8-31ca-488c-bd83-6c786723c494","resolution":{"observed_at":"2026-08-04T07:23:25.417130Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.977018Z","title":"Close Encounters of the AI Kind: A Survey of Public Sentiment About Artificial Intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.977018Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:5586355b74c065534de193e0aa6b4fa9c1602e9665dde9e5c024b46741601434","observation_id":"c51d5a61-30a7-4562-8172-306c0c6917be","resolution":{"observed_at":"2026-08-04T07:21:36.977018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.10616","last_updated":"2025-07-25T11:09:53Z","snapshot_observed_at":"2026-08-06T17:46:01.198994Z","submitted_at":"2025-07-13T19:04:17Z","title":"Scalpel vs. Hammer: GRPO Amplifies Existing Capabilities, SFT Replaces Them","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.10616","snapshot_observed_at":"2026-08-04T07:21:36.979706Z","title":"Scalpel vs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.979706Z"},"links":{"cited_paper":"/paper/2507.10616","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:46c8f61fd14c6c7d00c8ab34819fbe28ba8c536bc220c2cf7278f9e162343f6a","observation_id":"bbe44da7-e415-4b51-972f-25ad4f82d755","resolution":{"observed_at":"2026-08-04T07:21:36.979706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.982407Z","title":"Sentence- BERT : Sentence embeddings using S iamese BERT -networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.982407Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:5135bd36b4bab02aa64d69cbdc04a457054f9fb46a69cbf5d7dc8c7f0fcf5f03","observation_id":"d757b45a-c349-4ce2-aaf2-3816fbd1fb33","resolution":{"observed_at":"2026-08-04T07:21:36.982407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-04T07:21:36.985050Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.985050Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:8caf4671428972a74159c346446c5f5a047b8be64863bb1e2490bccff1de3a61","observation_id":"2b5d258e-ad5f-4136-b1f7-e69fb7b9f73f","resolution":{"observed_at":"2026-08-04T07:21:36.985050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.987575Z","title":"Sutherland","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.987575Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:f6b15127cf5b789a90feff26e93b01e6581b4305097ca557460e1d66941c9bea","observation_id":"9cf8c958-726a-4484-b5cf-3e8638269a19","resolution":{"observed_at":"2026-08-04T07:21:36.987575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.989983Z","title":"The nature of human values","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.989983Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:77c2f9a096d68e09a8d342c40b3888fbd98ede100cc38cebe77b9516d1a3d970","observation_id":"09734dc1-b817-4710-9c0e-56e1f651171f","resolution":{"observed_at":"2026-08-04T07:21:36.989983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.992715Z","title":"Political compass or spinning arrow? T owards more meaningful evaluations for values and opinions in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.992715Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:f4c67f8a8d8ba8f4f6a774071c074c3f0b913051111999432093536fcc67a61c","observation_id":"e5be2664-227d-4b88-b604-37a70899582b","resolution":{"observed_at":"2026-08-04T07:21:36.992715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:36.995122Z","title":"Unintended impacts of LLM alignment on global representation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.995122Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:9e8993246311952b77657aeaee8e9837eca4d174a13e5efbec0220320a4a76a0","observation_id":"5800a519-118e-4268-95db-c0010128cf52","resolution":{"observed_at":"2026-08-04T07:21:36.995122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1146/annurev-psych-020821-125100","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Personal values across cultures","venue":"Annual Review of Psychology","work_id":"b0f11f0e-642f-47af-bd93-a07514c81da6","year":2022},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:36.997512Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:da74b931a50365458f0a6663c64d76f7fe6b040c3b63a6a47e63d522648983d6","observation_id":"4c2d37db-47a1-4192-ba6e-18113229c799","resolution":{"observed_at":"2026-08-04T07:23:24.534884Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.000377Z","title":"A note on the pure theory of consumer's behaviour","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.000377Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:a4f581196243b21dfe4b049164a3adda3ca3693564407f98f9bd4ca11bf4ff0e","observation_id":"e4e3e7f7-c2a8-47a6-873e-8c41f67f2a58","resolution":{"observed_at":"2026-08-04T07:21:37.000377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.003104Z","title":"Whose opinions do language models reflect? In Proceedings of the 40th International Conference on Machine Learning, ICML'23","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.003104Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:252f79d5cdc0fd61d700ec4fb403e0cb5179297895667db6fd6817dfe6a8914e","observation_id":"5e2dc7e3-fa82-40e3-b82b-a7a644cd1529","resolution":{"observed_at":"2026-08-04T07:21:37.003104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-04T07:21:37.006048Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.006048Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:2edac0d7e895a45a3084304ec6bd7adabc356efda7664c99360592ef2b4ff145","observation_id":"c080ecf5-ddac-4e2b-a5bf-2dc02784bf35","resolution":{"observed_at":"2026-08-04T07:21:37.006048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.009189Z","title":"Extending the cross-cultural validity of the theory of basic human values with a different method of measurement","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.009189Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:bd71070e81cbce6d611c3f369f09ca1a3375c32658e2fbb54cc48925325e2f85","observation_id":"6b244c73-9fa5-41c0-9394-57147c4ea694","resolution":{"observed_at":"2026-08-04T07:21:37.009189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00184","last_updated":"2025-03-11T21:11:39Z","snapshot_observed_at":"2026-08-09T06:45:36.794399Z","submitted_at":"2023-07-01T00:58:51Z","title":"Personality Traits in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00184","snapshot_observed_at":"2026-08-04T07:21:37.011514Z","title":"Personality traits in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.011514Z"},"links":{"cited_paper":"/paper/2307.00184","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:d49dd8ae897c7e22718a4d33e1e3a05019c6c66da8e8a4611e8631bd3ab23a25","observation_id":"6b96b46b-896c-4566-8f79-cbc9bb3476f3","resolution":{"observed_at":"2026-08-04T07:21:37.011514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.014088Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.014088Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:744c1ffc76f100bdb71416ef8175934573b37a4b55d470b7d15553cf41e3a789","observation_id":"3644a10b-8e21-4e94-9b3f-f7117cf027b7","resolution":{"observed_at":"2026-08-04T07:21:37.014088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.016578Z","title":"AI models collapse when trained on recursively generated data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.016578Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:6c1889d0e6c9a9e739625136760df8d83b8b875f6ecf2a59597f0ff93700ab8d","observation_id":"e959d165-fcc9-46a4-aacb-a4cab8e11f30","resolution":{"observed_at":"2026-08-04T07:21:37.016578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.018945Z","title":"Recognizing stances in ideological on-line debates","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.018945Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:574f1ab528ed65de8b54afbaae3f9326c82bc1a2a406a44d1311b0a906adbdf1","observation_id":"6de127ee-bbd2-4f5b-8315-be8e6d85046a","resolution":{"observed_at":"2026-08-04T07:21:37.018945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.021453Z","title":"Position: A roadmap to pluralistic alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.021453Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:4220ea85e56cfc31ada43c0c1b8600a88333d44fddcff13675b1cfff652ac734","observation_id":"75e6bea5-fa0f-497b-aed3-b9f49c0ce960","resolution":{"observed_at":"2026-08-04T07:21:37.021453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.023833Z","title":"Value profiles for encoding human variation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.023833Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:f5dae66956fb9ad78ad4d60873ab7b1562633d5e92bc51dee47cfea4b02239d7","observation_id":"598171ea-1410-4e46-a127-810c083de10a","resolution":{"observed_at":"2026-08-04T07:21:37.023833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00069","last_updated":"2026-06-23T16:02:17Z","snapshot_observed_at":"2026-08-07T17:42:58.380771Z","submitted_at":"2025-02-27T13:26:07Z","title":"Societal Alignment Frameworks Can Improve LLM Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00069","snapshot_observed_at":"2026-08-04T07:21:37.027536Z","title":"Lillicrap, Ana Marasović, Sylvie Delacroix, Gillian K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.027536Z"},"links":{"cited_paper":"/paper/2503.00069","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:0850ec40826531a4e249f642a3b1fae362befc89033f81a6b1b72ccaab96822f","observation_id":"8e2756ac-3518-456d-91a9-8fb9e10c83cd","resolution":{"observed_at":"2026-08-04T07:21:37.027536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.030262Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.030262Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:862127550c6cff65f261dd29b61a5227395b4016503c7e35ac26b245a58966e9","observation_id":"a3929b99-c3ad-4ab9-8b1c-5b98d9ffc56b","resolution":{"observed_at":"2026-08-04T07:21:37.030262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.311","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A deep dive into the trade-offs of parameter-efficient preference alignment techniques","venue":null,"work_id":"75a38563-cca5-4ace-92bb-4790d0d4ac31","year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.032655Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:9b67f7ec1db7babc07d2d75dba9c1b7ffd9a71519103ef41b79ec599cfe1d0c3","observation_id":"525a74ce-e610-4566-b478-a56051b46833","resolution":{"observed_at":"2026-08-04T07:23:23.815623Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.035278Z","title":"Zephyr: Direct distillation of LM alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.035278Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:d53b5eeb31b6e3d28ec62fde95dd52d0f51a824b6728c90dd6e38a6489eac4b7","observation_id":"d9b4f115-1e60-4c8c-a6da-3861ad1d6efd","resolution":{"observed_at":"2026-08-04T07:21:37.035278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.037596Z","title":"Smith, Daniel Khashabi, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.037596Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:268d8b7896605e4bbcb1b37c0c2ffac9d410d50416c14bbed3af9f0b584cb02f","observation_id":"042852bf-7a90-444e-a523-934f7e9a50ab","resolution":{"observed_at":"2026-08-04T07:21:37.037596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.040157Z","title":"Dai, and Quoc V Le","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.040157Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:57cef279ccd72379c4fdeb342fd19f3b24ca994b85186192772f7cc28344b3ee","observation_id":"3b4fe45e-3de7-43ec-9337-9acab483fec0","resolution":{"observed_at":"2026-08-04T07:21:37.040157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.042675Z","title":"Simple synthetic data reduces sycophancy in large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.042675Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:64f12bb6ff45026ca4d046cd90a0a4503ce580b0ce2e7720ee0f7fc5b1ac1ea3","observation_id":"c6df399c-3182-45d0-8f2c-5b66a7ad10d5","resolution":{"observed_at":"2026-08-04T07:21:37.042675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.045646Z","title":"Generative monoculture in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.045646Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:c8ad003c1f741066ac286ba473885331b0fe3710c78aa075cb507e721637b0c0","observation_id":"a1f2541f-3de0-4329-920f-ca7f7e606755","resolution":{"observed_at":"2026-08-04T07:21:37.045646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.048330Z","title":"Fairness feedback loops: T raining on synthetic data amplifies bias","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.048330Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:09c9c43bad65396c6c13a37f3376687e2e125f06e8de7cb0f7de80dea49fb358","observation_id":"903165b2-286b-4b5c-a49d-430bcbd09f15","resolution":{"observed_at":"2026-08-04T07:21:37.048330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.051409Z","title":"Finding the sweet spot: Preference data construction for scaling preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.051409Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:ae23f13c82c6ebac5cf64d906483eead72d838a3f62a197a5f47d8effc26735e","observation_id":"2859d098-492b-4a6e-b637-604ab0131a74","resolution":{"observed_at":"2026-08-04T07:21:37.051409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-04T07:21:37.053895Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.053895Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:9befa26dc79201898e3d36439e937b63a74757f2f3a989c7502a2922f587c9c8","observation_id":"57f17ede-74b7-42fe-8765-87296f6ee870","resolution":{"observed_at":"2026-08-04T07:21:37.053895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-07-31T00:09:56.948833Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-04T07:21:37.056559Z","title":"HellaSwag : Can a machine really finish your sentence?, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.056559Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:c24339dca0c59349ffbfe90f1b1ffd770fa928771527cbfdc959e304d5219936","observation_id":"243287a8-3e34-4a96-956e-826044370593","resolution":{"observed_at":"2026-08-04T07:21:37.056559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.059357Z","title":"Cultivating pluralism in algorithmic monoculture: The community alignment dataset","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.059357Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:6d7617f2b999282b404760eae0d1f170f37ea0e90c998971e6e01f9a760dbe7b","observation_id":"bda9dd5c-5a7f-424b-8526-9546765e2a12","resolution":{"observed_at":"2026-08-04T07:21:37.059357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07912","last_updated":"2025-08-07T23:50:47Z","snapshot_observed_at":"2026-08-09T01:40:08.645048Z","submitted_at":"2025-04-10T17:15:53Z","title":"Echo Chamber: RL Post-training Amplifies Behaviors Learned in Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07912","snapshot_observed_at":"2026-08-04T07:21:37.061716Z","title":"Echo chamber: RL post-training amplifies behaviors learned in pretraining","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.061716Z"},"links":{"cited_paper":"/paper/2504.07912","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:fdb47dc19ab34f5466303964c28ea9abd7309dc0e1bd60057bfaa3668e45b0b2","observation_id":"822b0dd1-0a95-4955-87e4-6c232c4c4d42","resolution":{"observed_at":"2026-08-04T07:21:37.061716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.064385Z","title":"WildChat : 1m chat GPT interaction logs in the wild","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.064385Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:6f421664a2139fafc307df11504b37710a96d5411504354d6b0f2ccfa175b825","observation_id":"7bdb39b3-4714-428e-bd87-d71216056727","resolution":{"observed_at":"2026-08-04T07:21:37.064385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04964","last_updated":"2023-07-18T08:44:47Z","snapshot_observed_at":"2026-08-07T18:08:01.409989Z","submitted_at":"2023-07-11T01:55:24Z","title":"Secrets of RLHF in Large Language Models Part I: PPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04964","snapshot_observed_at":"2026-08-04T07:21:37.066762Z","title":"Secrets of RLHF in large language models part I: PPO","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.066762Z"},"links":{"cited_paper":"/paper/2307.04964","citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:e59e53bb6e803eaa4fcddcfb4b3341d686e64c4535c1ed7f6d5ddf6399b9a36b","observation_id":"79a032b9-b362-4938-b476-819ec8889aea","resolution":{"observed_at":"2026-08-04T07:21:37.066762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.069555Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.069555Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:71f6c3b8ef4e0074a8601240697134c3f745a256a67f4ebdc06aaeff811a6f21","observation_id":"45df0724-a0af-40ba-a0bd-b59f1653f31a","resolution":{"observed_at":"2026-08-04T07:21:37.069555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.072580Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.072580Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:d9a7fe27571af93a0dc22900ad5201cb6add65fb032a25475cb8d3e1c604c688","observation_id":"5ee8303d-dbe4-40e0-94fb-0da5de1c300d","resolution":{"observed_at":"2026-08-04T07:21:37.072580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:21:37.075273Z","title":"small value-gap","venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-04T07:21:37.075273Z"},"links":{"citing_paper":"/paper/2510.26707"},"observation_digest":"sha256:c5d41d45db7dfcc51b396d2bf135159626f45d9874aa84d887dc1c8def80c2dc","observation_id":"ae830681-f92a-46a2-9b68-618736407641","resolution":{"observed_at":"2026-08-04T07:21:37.075273Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.26707","last_updated":"2026-07-15T04:49:02Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T05:29:04.731147Z","submitted_at":"2025-10-30T17:09:09Z","title":"Value Drifts: Tracing Value Alignment During LLM Post-Training"},"reference_resolution":{"displayed":93,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":89,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":93},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 93 of 93 outbound references and 2 inbound Pith citation observations for arXiv:2510.26707."}