{"as_of":"2026-08-08T18:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fc3700d7ef44f33d7823e4d24b8286ba1491941a18fdad624f21cce6969c2bca","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:16:17.842335Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00152/citation-record","integrity":"/paper/2506.00152/integrity","json":"/paper/2506.00152/citation-record.json","paper":"/paper/2506.00152"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:21.787519Z","title":"How ai outperforms humans at creative idea generation","venue":null,"work_id":"3728ca40-517c-4ba0-b860-7ffb06bfbf28","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.199586Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:f1575a52a39c67b40ad013fa52a9b71c989d8b0340e71f3b493dc3f710449bf0","observation_id":"c01c58dc-46a1-4004-9c0b-838f4a9ef487","resolution":{"observed_at":"2026-08-07T12:16:21.862335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:21.575061Z","title":"Ai–human hybrids for marketing research: Leveraging large language models (llms) as collaborators","venue":null,"work_id":"1a9a0062-c376-4c19-8e23-1464aad597f3","year":2025},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.274735Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:5838b4f10379be96830ce4051df3ad71f5401cd9e497aec44207790338dc91c2","observation_id":"f31d8b2a-4c52-4119-add1-707b0bd7539f","resolution":{"observed_at":"2026-08-07T12:16:21.719018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:21.247264Z","title":"Frontiers: Can large language models capture human prefer- ences? Marketing Science, 43(4):709–722, 2024","venue":null,"work_id":"b1d19b84-2cf1-40bd-9490-82a99aba0815","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.329272Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:127eebcff68a6b111724ede3b7e08ba6272eb0763ffd1dfae742664f5a1b0d51","observation_id":"afd87cce-6043-4ae9-ade5-b60d56f90e14","resolution":{"observed_at":"2026-08-07T12:16:21.378710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02611","last_updated":"2024-11-26T18:51:57Z","snapshot_observed_at":"2026-07-06T18:25:22.852874Z","submitted_at":"2024-06-03T07:56:58Z","title":"LOLA: LLM-Assisted Online Learning Algorithm for Content Experiments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02611","snapshot_observed_at":"2026-08-07T12:16:14.436321Z","title":"Lola: Llm-assisted online learning algorithm for content experiments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.436321Z"},"links":{"cited_paper":"/paper/2406.02611","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:7a427488ecd3e7e98afe857764284074bccc02b09725f9b4b1e59faef4172f53","observation_id":"6846cab9-cc19-47e6-a3ce-bd099f0400b1","resolution":{"observed_at":"2026-08-07T12:16:14.436321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01957","last_updated":"2025-05-01T17:40:14Z","snapshot_observed_at":"2026-08-02T22:21:10.473799Z","submitted_at":"2024-10-02T19:03:42Z","title":"Challenges and Future Directions of Data-Centric AI Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01957","snapshot_observed_at":"2026-08-07T12:16:14.584356Z","title":"How reliable is human feedback for aligning large language models? arXiv preprint arXiv:2410.01957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.584356Z"},"links":{"cited_paper":"/paper/2410.01957","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:840ce81a508826c956a1868c0f954ec5a9ea8b7b2f56480303e04e4832fb6e64","observation_id":"782aba1f-e6cb-4374-a701-b56451811f89","resolution":{"observed_at":"2026-08-07T12:16:14.584356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:21.076656Z","title":"A/b testing: A systematic literature review","venue":null,"work_id":"12cd624a-ed37-497d-b4a4-c83619d9a771","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.691279Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:67bf4bebf3d8b38798f31760c4a92b405c2f459e4fe279fe395552a85a296505","observation_id":"27be85ee-4e45-4465-813a-2cb4eaa498c1","resolution":{"observed_at":"2026-08-07T12:16:21.155978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:14.782289Z","title":"Causal alignment: Augmenting language models with a/b tests","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.782289Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:6948554acf6198d62835b220faca516183982491bced3aa529fb5a00cdbb5831","observation_id":"1304c1b3-7cf6-4b4f-b5fc-b527e17c1310","resolution":{"observed_at":"2026-08-07T12:16:14.782289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.07238","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.373549Z","title":"Using advanced llms to enhance smaller llms: An interpretable knowledge distillation approach","venue":null,"work_id":"b61ef70f-6df3-436a-a048-30b02a4e919f","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.857940Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:724558792a0390ead79630563b911cb999281daa9643b53976c85bf28dc6ec51","observation_id":"8653298e-2855-4c80-b5a5-42532f56fab3","resolution":{"observed_at":"2026-08-07T12:16:18.468656Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:20.851057Z","title":"Test & roll: Profit-maximizing a/b tests","venue":null,"work_id":"34b17b3a-842b-4d19-8f1a-93852be8aa8a","year":2019},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.936266Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:4183598f8ab67f07d955568310d470991a3e650cbd73fd7bbe87c4625610b7f3","observation_id":"f01b1c0a-05a2-43f4-83de-fea84e624f49","resolution":{"observed_at":"2026-08-07T12:16:20.952564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:20.630455Z","title":"An empirical meta-analysis of e-commerce a/b testing strategies","venue":null,"work_id":"57aeb3a2-11f4-4ecc-b1e5-0a03a2cb63c4","year":2020},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.032629Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:78e538919412e6f9ac173f8968183c2e4fda66abf85713509ab44864b6cfabe7","observation_id":"87253cb1-f801-432d-bdea-fbb23aa2948b","resolution":{"observed_at":"2026-08-07T12:16:20.744955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:15.103600Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.103600Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:b30042864d81635ae045aa581edf33ad818d04200abe5278c52b86a5984d4f75","observation_id":"1395be67-84f5-406e-a8d9-835b1a721668","resolution":{"observed_at":"2026-08-07T12:16:15.103600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:15.175631Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.175631Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:6c706d129df0ca496ae7228143578c45cc630c87367f8b8d212fca909bf7d5c2","observation_id":"1cdda42c-2864-4fcc-98e6-63524a7aad59","resolution":{"observed_at":"2026-08-07T12:16:15.175631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:15.267425Z","title":"Lima: Less is more for alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.267425Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:701f7dc0078a6c70f38ed588975d438ccb61e0119da9efebc94879ea57c2ce56","observation_id":"c4fbbd3e-4590-4657-83e2-9b8471d94855","resolution":{"observed_at":"2026-08-07T12:16:15.267425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:20.350248Z","title":"The importance of human-labeled data in the era of llms","venue":null,"work_id":"aace9e42-2ad6-43df-9ebd-0be4caf0a12b","year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.350394Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:50fccf4defc025a18a8eb50646f3377076abc20517dadde55494a9f7735e3029","observation_id":"19e5775a-1770-4bdd-b367-a0ee4092b2a6","resolution":{"observed_at":"2026-08-07T12:16:20.458336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:15.448497Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.448497Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:5ccb505a15386e2f8bfcc7e1976d4423220f05f3160e75ef08cd86bbb3de1c72","observation_id":"d37f9bd2-4b6f-4a95-a0ad-9ad7914a76d4","resolution":{"observed_at":"2026-08-07T12:16:15.448497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:20.125856Z","title":"Scaling laws for reward model overoptimization in direct alignment algorithms","venue":null,"work_id":"cae23afe-1c61-4119-9abf-995b69abaa1d","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.508979Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:5a922585fefd37fd990428d72fefadbf3c72899946eaead860f80efadc5ee41d","observation_id":"52856e02-4a99-4368-bd32-d4e6a38b8a78","resolution":{"observed_at":"2026-08-07T12:16:20.241078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T12:16:15.576254Z","title":"Fine-tuning language models from human preferences","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.576254Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:d41a39bdc28e778ec3c19c6398cb9e9d465f743345122162504a2ad41c6a8278","observation_id":"dc2dd242-8485-4e6a-930e-aaca2b364761","resolution":{"observed_at":"2026-08-07T12:16:15.576254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.917416Z","title":"RLAIF: Scal- ing reinforcement learning from human feedback with AI feedback, 2024","venue":null,"work_id":"db5205fb-8473-411b-b13e-33f874cf88d4","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.641137Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:e282493ef30cb25598f7bf743c59fb61fe32f23075120e9508a2bf45eafa750d","observation_id":"d3240d1f-c082-4435-8769-cf59db7c3518","resolution":{"observed_at":"2026-08-07T12:16:20.015498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:16:15.716062Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.716062Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:2805ddc537e68bed6f4e0e684cd63871c2be0a24820617eb8e3d7eb665ce5ae4","observation_id":"a1ae2e67-47ec-4273-961f-b4052573685a","resolution":{"observed_at":"2026-08-07T12:16:15.716062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T12:16:15.782738Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.782738Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:5d7b563a552f64ba6264a4e29631b4c9865ee11ad8df6f9169c09ced511c4a4b","observation_id":"480d506a-8742-4f8c-8b15-36439fc36f17","resolution":{"observed_at":"2026-08-07T12:16:15.782738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.820659Z","title":"The upworthy research archive, a time series of 32,487 experiments in us media","venue":null,"work_id":"901340cb-d56c-4c6b-ba72-669af186b29b","year":2021},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.889787Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:f2bd6f554cf25fd3493437082163c441d493c95932545a67d23559ad18142f3a","observation_id":"aaacbc1b-e606-4515-969b-55cc7792ebc4","resolution":{"observed_at":"2026-08-07T12:16:19.855934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:15.951592Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.951592Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:8e79a2a58c71d1000195e1f3800a44f25dbf4a21030e27ca0cc9d2eba7faaad5","observation_id":"b83ca2f0-ed9d-4ed0-a290-b717dab7fc04","resolution":{"observed_at":"2026-08-07T12:16:15.951592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.686941Z","title":"Double/debiased machine learning for treatment and structural parameters","venue":null,"work_id":"3b1b3c8e-765e-47aa-91c9-1c3393b57d53","year":2018},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.038335Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:c28e5962d6f819fa97861b00eca55774015c44eb5e14d4aa11fc66e3bf75ece9","observation_id":"701f88d8-2126-41e2-b4aa-0934efbfa74d","resolution":{"observed_at":"2026-08-07T12:16:19.753711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.565962Z","title":"Minimax estimation of conditional moment models","venue":null,"work_id":"b7e45cb2-e466-44de-9bfa-1ad8d222a094","year":2020},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.117623Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:4aadb261a7e3d073be366103244b1d357d261a2118435b66bad1d349e77f1969","observation_id":"65f8d39b-6f2e-4437-a4f6-2610d9fae4a8","resolution":{"observed_at":"2026-08-07T12:16:19.625610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.435359Z","title":"Mind: A large-scale dataset for news recommendation","venue":null,"work_id":"28e00933-6abe-4616-a236-e38f6a33afc9","year":2020},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.213931Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:d3007e30c8d0ef5c275d1415265db36a188f154be85a1d9abc29476fa0e6e6e0","observation_id":"1100beae-4776-418e-9d8d-4350b6df5d89","resolution":{"observed_at":"2026-08-07T12:16:19.491351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.289802Z","title":"Generative brand choice","venue":null,"work_id":"c78b4443-4c4f-4a50-94af-8a09d8fd269a","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.324319Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:39d0f783ec538847e6041d25162c99e0ca8dd419312885573e911577036010c8","observation_id":"447989a9-e58f-42f3-8c2c-84d434e6fd98","resolution":{"observed_at":"2026-08-07T12:16:19.360338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.189688Z","title":"Deep neural networks for estimation and inference","venue":null,"work_id":"5448fa28-0675-4334-aa83-41ff32d0087f","year":2021},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.439142Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:65b27063318454141e922680a7066a7ae99e12a6552fb12b029b239ce141a334","observation_id":"873e0199-de5f-45a7-8d8f-68a9106cb74a","resolution":{"observed_at":"2026-08-07T12:16:19.222244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.131739Z","title":"Deep generalized method of moments for instrumental variable analysis","venue":null,"work_id":"4244b661-b07b-4dc8-ba91-c6e92521427e","year":2019},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.546057Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:2ca0a144b271410af18485eb5d3175fa12d0900dd8aa8dd8ef0fe2000f199c4d","observation_id":"9ee94596-7af0-49a8-9bb8-96f8d995be3a","resolution":{"observed_at":"2026-08-07T12:16:19.159180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.078675Z","title":"Causal regressions for unstructured data","venue":null,"work_id":"9a8a43a7-7fe0-4460-b15b-64cc4f12085b","year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.631945Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:09214c7b9c3ef511c90c2a9cba8deb8d8d0c5713bad883adb9b5c358637b6ce7","observation_id":"58c9ac13-0bb7-41a8-8aca-77a9ee31969a","resolution":{"observed_at":"2026-08-07T12:16:19.093833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04964","last_updated":"2023-07-18T08:44:47Z","snapshot_observed_at":"2026-08-07T18:08:01.409989Z","submitted_at":"2023-07-11T01:55:24Z","title":"Secrets of RLHF in Large Language Models Part I: PPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04964","snapshot_observed_at":"2026-08-07T12:16:16.728456Z","title":"Secrets of rlhf in large language models part i: Ppo","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.728456Z"},"links":{"cited_paper":"/paper/2307.04964","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:8f53aa8189d25ca3566a903dc7c8cce7601bc73d45b3dacbf269f3d07ab658c3","observation_id":"c5bc5580-efe2-45b2-973b-4a1e30795853","resolution":{"observed_at":"2026-08-07T12:16:16.728456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09279","last_updated":"2024-10-07T21:24:59Z","snapshot_observed_at":"2026-07-06T18:30:28.421247Z","submitted_at":"2024-06-13T16:17:21Z","title":"Unpacking DPO and PPO: Disentangling Best Practices for Learning from Preference Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09279","snapshot_observed_at":"2026-08-07T12:16:16.819602Z","title":"Unpacking dpo and ppo: Disentangling best practices for learning from preference feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.819602Z"},"links":{"cited_paper":"/paper/2406.09279","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:c1af1debcddd8e3b88d53f6c2d2105fc69378ee45102a05f490a52b566ac31fa","observation_id":"7e660493-93ab-42cd-a656-900de269cc29","resolution":{"observed_at":"2026-08-07T12:16:16.819602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.964626Z","title":"Bias in data-driven artificial intelligence systems—an introductory survey","venue":null,"work_id":"0f69b3e6-e3dd-4145-9d54-c296fd0225a2","year":2020},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.913212Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:ae9b16975d29009f8894c99ced300374b468daf6fa103266e9e9ef2e139cee94","observation_id":"4e951b96-3123-48bf-bcd4-574844319aa9","resolution":{"observed_at":"2026-08-07T12:16:19.003112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06601","last_updated":"2023-03-18T20:44:45Z","snapshot_observed_at":"2026-08-03T12:43:10.574809Z","submitted_at":"2022-04-13T18:41:41Z","title":"Causal Confusion and Reward Misidentification in Preference-Based Reward Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06601","snapshot_observed_at":"2026-08-07T12:16:17.017683Z","title":"Causal confusion and reward misidentification in preference-based reward learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.017683Z"},"links":{"cited_paper":"/paper/2204.06601","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:60c96bd6e0db33eeae42de22371fe28984e85e8454834d989ca6567bc8bfca69","observation_id":"3a528559-9b07-4aa3-8710-8ad63f060415","resolution":{"observed_at":"2026-08-07T12:16:17.017683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10162","last_updated":"2024-06-29T00:28:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-14T16:26:20Z","title":"Sycophancy to Subterfuge: Investigating Reward-Tampering in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10162","snapshot_observed_at":"2026-08-07T12:16:17.142465Z","title":"Sycophancy to subterfuge: Investigating reward-tampering in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.142465Z"},"links":{"cited_paper":"/paper/2406.10162","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:64e9eb20fca6450264ae8f147219fa8f131fcdca828b682a7a62015900238a54","observation_id":"364f773c-46c3-4693-bd84-54150435f2ee","resolution":{"observed_at":"2026-08-07T12:16:17.142465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07319","last_updated":"2024-02-11T22:40:12Z","snapshot_observed_at":"2026-08-07T04:02:57.297390Z","submitted_at":"2024-02-11T22:40:12Z","title":"ODIN: Disentangled Reward Mitigates Hacking in RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07319","snapshot_observed_at":"2026-08-07T12:16:17.249774Z","title":"Odin: Disentangled reward mitigates hacking in rlhf","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.249774Z"},"links":{"cited_paper":"/paper/2402.07319","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:bd999f1779786d2ebae610f6d19b0bd2c506c1f6c3f6f46583546aed85c06ea2","observation_id":"c7e10994-40b2-4706-903f-2421b967a51a","resolution":{"observed_at":"2026-08-07T12:16:17.249774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09620","last_updated":"2025-05-29T02:21:03Z","snapshot_observed_at":"2026-08-04T12:42:12.769532Z","submitted_at":"2025-01-16T16:00:37Z","title":"Beyond Reward Hacking: Causal Rewards for Large Language Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09620","snapshot_observed_at":"2026-08-07T12:16:17.355112Z","title":"Beyond reward hacking: Causal rewards for large language model alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.355112Z"},"links":{"cited_paper":"/paper/2501.09620","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:938313d62f22c36aa47cee39d1f6ecd3c43508caffa0b85824c5eaa28896daa2","observation_id":"9a272143-534e-48a8-8fcd-3a0e9f42ce18","resolution":{"observed_at":"2026-08-07T12:16:17.355112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-07T12:16:17.483713Z","title":"Smollm2: When smol goes big – data-centric training of a small language model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.483713Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:5ac0a386cc2703324ce483133a6a4a00d202dc7228dd48dab9a4e36b7dd66228","observation_id":"fba57f18-16e5-4fdc-8fa1-71201e39de9e","resolution":{"observed_at":"2026-08-07T12:16:17.483713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:17.560917Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.560917Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:2ce40571e428e0dcb58bd3d14f54a1626d40c462ac33664cf93fecac3565dd1b","observation_id":"3fee8457-da0a-4969-a6f0-991d87fcb8a6","resolution":{"observed_at":"2026-08-07T12:16:17.560917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.840075Z","title":"distilbert-base-multilingual-cased-sentiments-student (re- vision 2e33845), 2023","venue":null,"work_id":"ec3371cf-4dfb-4eb4-95d4-8bb4f6f6ea03","year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.598311Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:8a67bbba2c09b6e88fd289f77dd651ae4451f7551207e397339c5076f1698e25","observation_id":"d4df7dea-5854-4d46-b4d2-bbb80f4e4c9f","resolution":{"observed_at":"2026-08-07T12:16:18.888619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:17.647306Z","title":"A survey on bias and fairness in machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.647306Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:65c69ffd09ec26650822f38095afadc7bb2136a52d1858641a6e07a57cf49c14","observation_id":"0056c3d5-8694-46ce-9ea5-cb6f7d039276","resolution":{"observed_at":"2026-08-07T12:16:17.647306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.711261Z","title":"On the adaptive elastic-net with a diverging number of parameters","venue":null,"work_id":"8fbafa9a-2724-47e4-9cd0-3880ab313699","year":2009},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.723474Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:62af9aa0d62fc9b87f47adfc6ec5bbdcdd7ad645a29c793bf208f9c2016bf7c3","observation_id":"16b0d6ec-d405-4c0e-99e9-3877f97d715a","resolution":{"observed_at":"2026-08-07T12:16:18.762006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.560512Z","title":"Endogeneity in high dimensions","venue":null,"work_id":"2be61d75-d867-4d5b-afa0-8c88c3b45599","year":2014},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.767924Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:aa9792ebac6e22f08f24c53cdb61b3893e915e2e55cd2204712f0db7ea292d60","observation_id":"eda638d9-805f-4841-b6d1-17268fd0bc0c","resolution":{"observed_at":"2026-08-07T12:16:18.630931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0250.00050","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.029388Z","title":"packages","venue":null,"work_id":"2c74f0da-cd31-4847-8398-d81f57040859","year":null},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.842335Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:dc2e4f5032b791fdecaca9fb1786eae287c8d0dd2b9fd9de2f546b39928f0840","observation_id":"ac285f32-15af-4f0f-9196-dc30448eca56","resolution":{"observed_at":"2026-08-07T12:16:18.120828Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T12:08:54.195290Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":20,"verified_exact":1,"verified_fuzzy":21},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2506.00152."}