{"as_of":"2026-08-08T05:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2fc179427b54518e70b1b7695f7a9ad52a69b9088030d795a099768827816f60","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:36:29.092464Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T22:55:08.544620Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"cited_work":{"arxiv_id":"2505.14633","doi":"10.48550/arxiv.2505.14633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://arxiv.org/abs/2505.14633","venue":"ArXiv.org","work_id":"7b000b54-0d1d-4d29-9f7e-e187ac268f8a","year":2025},"citing_paper":{"arxiv_id":"2604.21871","last_updated":"2026-04-23T17:14:18Z","snapshot_observed_at":"2026-08-02T18:00:39.275434Z","submitted_at":"2026-04-23T17:14:18Z","title":"Machine Behavior in Relational Moral Dilemmas: Moral Rightness, Predicted Human Behavior, and Model Decisions","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T21:58:39.190970Z"},"links":{"cited_paper":"/paper/2505.14633","citing_paper":"/paper/2604.21871"},"observation_digest":"sha256:e84c1ae72769a1951defa008e78a3576ca49720eb38f9926e02bf3906b571d2f","observation_id":"ba326dc3-2735-46c0-baf1-acffa3d4b7a9","resolution":{"observed_at":"2026-05-11T14:21:07.293983Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:14.673782+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:14.673782+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"cited_work":{"arxiv_id":"2505.14633","doi":"10.48550/arxiv.2505.14633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://arxiv.org/abs/2505.14633","venue":"ArXiv.org","work_id":"7b000b54-0d1d-4d29-9f7e-e187ac268f8a","year":2025},"citing_paper":{"arxiv_id":"2605.09893","last_updated":"2026-06-19T22:46:52Z","snapshot_observed_at":"2026-07-06T23:21:54.140120Z","submitted_at":"2026-05-11T02:32:53Z","title":"Pseudo-Deliberation in Language Models: When Reasoning Fails to Align Values and Actions","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T05:07:49.101351Z"},"links":{"cited_paper":"/paper/2505.14633","citing_paper":"/paper/2605.09893"},"observation_digest":"sha256:1b8bb098ea092091322c2670b2b866e5dc6a0b1ee9e715c250e183879245b8e1","observation_id":"205b10ea-05b1-4650-aeb4-8a18411599b5","resolution":{"observed_at":"2026-05-12T05:36:25.989670Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:14.673782+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:14.673782+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"cited_work":{"arxiv_id":"2505.14633","doi":"10.48550/arxiv.2505.14633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://arxiv.org/abs/2505.14633","venue":"ArXiv.org","work_id":"7b000b54-0d1d-4d29-9f7e-e187ac268f8a","year":2025},"citing_paper":{"arxiv_id":"2605.09893","last_updated":"2026-06-19T22:46:52Z","snapshot_observed_at":"2026-07-06T23:21:54.140120Z","submitted_at":"2026-05-11T02:32:53Z","title":"Pseudo-Deliberation in Language Models: When Reasoning Fails to Align Values and Actions","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T22:55:08.544620Z"},"links":{"cited_paper":"/paper/2505.14633","citing_paper":"/paper/2605.09893"},"observation_digest":"sha256:80abf71df8a8f0cfc1ff2419ed87602a815a482742dfad07d7c7f7d40f0b49af","observation_id":"ff358669-7993-47ef-97af-b91ef4795144","resolution":{"observed_at":"2026-07-01T13:35:46.847575Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:14.673782+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:14.673782+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"cited_work":{"arxiv_id":"2505.14633","doi":"10.48550/arxiv.2505.14633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://arxiv.org/abs/2505.14633","venue":"ArXiv.org","work_id":"7b000b54-0d1d-4d29-9f7e-e187ac268f8a","year":2025},"citing_paper":{"arxiv_id":"2605.13339","last_updated":"2026-05-18T11:15:49Z","snapshot_observed_at":"2026-07-06T23:24:57.051440Z","submitted_at":"2026-05-13T10:57:37Z","title":"Probing Persona-Dependent Preferences in Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T21:48:31.336745Z"},"links":{"cited_paper":"/paper/2505.14633","citing_paper":"/paper/2605.13339"},"observation_digest":"sha256:48d834b5c31f2285a7c1aae748f1a203e68a89b41106166b726e88b55da19138","observation_id":"d261570f-c9d9-4b79-994b-f756c8803641","resolution":{"observed_at":"2026-05-20T21:49:05.183085Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:14.673782+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:14.673782+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"cited_work":{"arxiv_id":"2505.14633","doi":"10.48550/arxiv.2505.14633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://arxiv.org/abs/2505.14633","venue":"ArXiv.org","work_id":"7b000b54-0d1d-4d29-9f7e-e187ac268f8a","year":2025},"citing_paper":{"arxiv_id":"2605.21095","last_updated":"2026-05-20T12:27:21Z","snapshot_observed_at":"2026-08-03T16:50:42.255579Z","submitted_at":"2026-05-20T12:27:21Z","title":"Backchaining Loss of Control Mitigations from Mission-Specific Benchmarks in National Security","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T02:01:42.033718Z"},"links":{"cited_paper":"/paper/2505.14633","citing_paper":"/paper/2605.21095"},"observation_digest":"sha256:3a85d67dc174a1c8fd5010f758f04821e5994797fb4dfcaec691e9ea1dd637df","observation_id":"7ccd641b-2841-442d-9de2-ac80999cb953","resolution":{"observed_at":"2026-05-21T02:03:54.264198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:14.673782+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:14.673782+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14633/citation-record","integrity":"/paper/2505.14633/integrity","json":"/paper/2505.14633/citation-record.json","paper":"/paper/2505.14633"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:37.571139Z","title":"Openai’s approach to external red teaming for ai models and systems, 2025","venue":null,"work_id":"60ab020e-6b85-4624-a336-216637469624","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:23.167899Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:81a04a0afdf075a7ed190a41a18cc5f33d00bbcd9f060218b689254b4dc235e5","observation_id":"9da338ea-395d-48fe-af50-040df2a015ef","resolution":{"observed_at":"2026-08-07T15:36:37.649789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:37.430632Z","title":"Claude’s Constitution","venue":null,"work_id":"18eae763-827a-428e-893f-8a56727ddf75","year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:23.220333Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:4cf6c7a6557ecd830ff2341bf057a2aae426e806e8a64d438f5f830cccf95bff","observation_id":"e612560d-a796-4b59-b405-e8be8e4e6a66","resolution":{"observed_at":"2026-08-07T15:36:37.515524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:37.230478Z","title":"Chatbot Arena Leaderboard","venue":null,"work_id":"3040887e-8aed-4d2b-85c9-b7f200fc9c2e","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:23.348467Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:12500f9fc31d8def3fd9a5ee672dfe73eee5bf55a6f2aee687033cc3459f224e","observation_id":"fd9479b6-ab73-45a6-806f-01adb0c386bc","resolution":{"observed_at":"2026-08-07T15:36:37.331310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:37.075598Z","title":"Probing pre-trained language models for cross-cultural differences in values","venue":null,"work_id":"85362a10-952f-407d-bb48-c74ebb3b5b80","year":2023},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:23.456441Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:5311c0b0245d0c78dba66fc4ec90e079faa12f526cf3401fa177270766d89799","observation_id":"a11e9313-06d0-4a9a-8672-46e66e18a6ad","resolution":{"observed_at":"2026-08-07T15:36:37.148750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:23.572062Z","title":"A general language assistant as a laboratory for alignment, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:23.572062Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:42b753d655168158c7a5e2b65773ff1ed93c564e481c9eaf673cf0486bc21c3e","observation_id":"b4fb9b53-d2ba-4747-aace-40a91a474eb6","resolution":{"observed_at":"2026-08-07T15:36:23.572062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T15:36:23.723831Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:23.723831Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:f8a39b4fc9fa17ca41adc3d3e65806ec5ceb0eaf5d54cf2e17c4ca44a6367f0a","observation_id":"faa653c7-1f5c-45ea-a118-4cb7f66bf2d0","resolution":{"observed_at":"2026-08-07T15:36:23.723831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:36.939097Z","title":null,"venue":null,"work_id":"d71502f1-9227-44ad-821b-a2149ef4b8b5","year":1998},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:23.910855Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:7155f02aa6c03e7210246b5501f3714a804d0fd7192d3dd63d24565c7f60016d","observation_id":"103bad50-e152-4432-b584-a5a185bccc95","resolution":{"observed_at":"2026-08-07T15:36:36.995699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13295","last_updated":"2025-08-27T11:15:11Z","snapshot_observed_at":"2026-08-07T18:07:08.742124Z","submitted_at":"2025-02-18T21:32:24Z","title":"Demonstrating specification gaming in reasoning models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13295","snapshot_observed_at":"2026-08-07T15:36:23.994668Z","title":"Demonstrating specification gaming in reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:23.994668Z"},"links":{"cited_paper":"/paper/2502.13295","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:b9287503060c971553e7b40bffcd9630201d675d92dad04ecc80ecfae0aa02e7","observation_id":"9086aa86-8f32-4c7f-892a-fb9f9077b598","resolution":{"observed_at":"2026-08-07T15:36:23.994668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:36.738216Z","title":"Distillation scaling laws, 2025","venue":null,"work_id":"d13d0907-e49d-429c-842a-410e48ab941f","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:24.109958Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:6ffa9d3f3028c530ed9a74d3a1623bc6c29a2b073fc9f737436739769e4e897d","observation_id":"bf5fab19-ce45-45f6-9ecd-2fc93428877a","resolution":{"observed_at":"2026-08-07T15:36:36.808444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.13353","last_updated":"2024-08-13T07:19:59Z","snapshot_observed_at":"2026-08-07T20:44:37.002212Z","submitted_at":"2022-06-16T17:58:47Z","title":"Is Power-Seeking AI an Existential Risk?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.13353","snapshot_observed_at":"2026-08-07T15:36:24.240868Z","title":"Is power-seeking ai an existential risk? arXiv preprint arXiv:2206.13353, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:24.240868Z"},"links":{"cited_paper":"/paper/2206.13353","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:f5841b40ae55b12fc14d128f13b39cbe7546614c9e87bf7541ebf2bd3dac3f34","observation_id":"04552353-ff02-44bb-b62f-c852237b4b2c","resolution":{"observed_at":"2026-08-07T15:36:24.240868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:36.527435Z","title":"Reasoning models don’t always say what they think","venue":null,"work_id":"7f04a103-1b87-46cc-9730-fbfe9396338e","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:24.406690Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:2c43403c83a1ce977db92d0892fcd9766861171d5c8907d776bd175b32f498aa","observation_id":"ff688ed6-a3d1-47d3-92bf-283413cc4df7","resolution":{"observed_at":"2026-08-07T15:36:36.627657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:24.580076Z","title":"Chatbot arena: An open platform for evaluating llms by human preference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:24.580076Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:fc2594019a5c7c615cf71628185753cdb7bfbe855e555191a687aabb6ae0e081","observation_id":"a2324fa3-a8fb-403a-abcb-647d3435c86f","resolution":{"observed_at":"2026-08-07T15:36:24.580076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02683","last_updated":"2025-03-15T03:54:40Z","snapshot_observed_at":"2026-07-06T19:27:07.844117Z","submitted_at":"2024-10-03T17:08:52Z","title":"DailyDilemmas: Revealing Value Preferences of LLMs with Quandaries of Daily Life","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02683","snapshot_observed_at":"2026-08-07T15:36:24.626170Z","title":"Dailydilemmas: Revealing value preferences of llms with quandaries of daily life","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:24.626170Z"},"links":{"cited_paper":"/paper/2410.02683","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:bc45b8c4c1052eab7d3893e0a635630ac00f0e9a3a65a5e232710c0a9ce93d2f","observation_id":"97f9a4e9-d5cf-4150-98fd-3b87c4b78233","resolution":{"observed_at":"2026-08-07T15:36:24.626170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:36.346973Z","title":"Safety Leaderboard","venue":null,"work_id":"4c57d9cf-ed5c-42cd-b4c2-7a24682818e9","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:24.688735Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:03f8001e8e2a11cec3cf8db5ba188aded90ed2cfd20a08311892c85078de6dfb","observation_id":"a9781ee0-e160-4087-9e4d-8714a97652ba","resolution":{"observed_at":"2026-08-07T15:36:36.434804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:36.143556Z","title":"Stated versus revealed preferences: An approach to reduce bias","venue":null,"work_id":"434e168c-2927-4d9d-b528-616d8737b62e","year":2021},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:24.766228Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:68f38d76ddafa0c5d8503ec6177d7906cf019c857f8d5118e872e0c9fcdd8ea7","observation_id":"0adc6ff6-31f8-48b2-8536-962a6c4b51d1","resolution":{"observed_at":"2026-08-07T15:36:36.255052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:35.927564Z","title":null,"venue":null,"work_id":"f1d02d9b-9180-4be7-a10c-3ae3d87a5bf2","year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:24.858284Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:1dab4778b245db95d74d38eadc6997c4b248d5663ab9fb20dce806ba9ceaae6f","observation_id":"9d1df6ed-0fd7-488d-b25b-0c8db338959a","resolution":{"observed_at":"2026-08-07T15:36:36.027604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:35.672667Z","title":"A worldwide test of the predictive validity of ideal partner preference-matching","venue":null,"work_id":"792b73c6-32ff-46cf-98a2-6f40f77bf7d1","year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:24.926602Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:8d6a9f1f92db7a7aa61c30035221f7be3be2a3bc90c8de1769afd9a55bf0d525","observation_id":"da42bae0-e9fc-466f-8959-2c6ddef92c12","resolution":{"observed_at":"2026-08-07T15:36:35.798786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14093","snapshot_observed_at":"2026-08-07T15:36:24.998756Z","title":"Alignment faking in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:24.998756Z"},"links":{"cited_paper":"/paper/2412.14093","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:a10ec4ffc100702a08e560efcda1a9dfd35c28612f333945290883017da07457","observation_id":"dc4901ad-9250-41bf-956b-5a445a180bd3","resolution":{"observed_at":"2026-08-07T15:36:24.998756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:35.450543Z","title":"The righteous mind","venue":null,"work_id":"2a7de156-a65d-468e-b5d8-414286ca644c","year":2012},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.067422Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:e51a8bcb4cfdf1a26056b144cb6e3096a1fcb765b1e7278f7e8bb8c8d2239858","observation_id":"5fde7871-ff4d-460a-a87c-1f2ec2309245","resolution":{"observed_at":"2026-08-07T15:36:35.567009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:35.261892Z","title":"Chapter 7 - creativity and morality in deception","venue":null,"work_id":"d8b74d9c-7b81-48da-acb7-2f5fc3ce2edf","year":2023},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.161948Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:eb4303ad14b035b1fb0a6e646e8065f665d3179d18a16effb00a58acb696287f","observation_id":"089c22d9-af22-47cb-8ac8-94faef1e93b5","resolution":{"observed_at":"2026-08-07T15:36:35.360808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12001","last_updated":"2023-10-09T22:57:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-21T03:35:06Z","title":"An Overview of Catastrophic AI Risks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12001","snapshot_observed_at":"2026-08-07T15:36:25.216066Z","title":"An overview of catastrophic ai risks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.216066Z"},"links":{"cited_paper":"/paper/2306.12001","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:f50a99d1bef44a5625820207b5f2a2eae00e86678bd23951889ed6a72d676b99","observation_id":"0779c0e6-093b-47ce-9ee8-65fe3fb6a7a2","resolution":{"observed_at":"2026-08-07T15:36:25.216066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15236","last_updated":"2025-04-21T17:13:16Z","snapshot_observed_at":"2026-08-07T19:41:52.379127Z","submitted_at":"2025-04-21T17:13:16Z","title":"Values in the Wild: Discovering and Analyzing Values in Real-World Language Model Interactions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15236","snapshot_observed_at":"2026-08-07T15:36:25.282893Z","title":"Values in the wild: Discovering and analyzing values in real-world language model interactions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.282893Z"},"links":{"cited_paper":"/paper/2504.15236","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:3a8016e76228693987024e4e55b848110a7b924720ebf78c485d9e6eeb7650ed","observation_id":"476fc1f2-1148-46b6-a2d3-0a1b33254605","resolution":{"observed_at":"2026-08-07T15:36:25.282893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05566","last_updated":"2024-01-17T20:26:01Z","snapshot_observed_at":"2026-07-06T17:14:03.152949Z","submitted_at":"2024-01-10T22:14:35Z","title":"Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05566","snapshot_observed_at":"2026-08-07T15:36:25.363672Z","title":"Sleeper agents: Training deceptive llms that persist through safety training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.363672Z"},"links":{"cited_paper":"/paper/2401.05566","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:769d1afc9b98bf7cc6b180dce6828972486d62f981cba4dfc61446003a1d3529","observation_id":"c0b265d1-eecd-4a1b-bf73-42ca7c882cbd","resolution":{"observed_at":"2026-08-07T15:36:25.363672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:34.972360Z","title":"Wildteaming at scale: From in-the-wild jailbreaks to (adversarially) safer language models","venue":null,"work_id":"b40c1bd1-93df-4123-b224-0d2623f74c0d","year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.443363Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:3e2b23fa10c5ff7ecbbe6f82bda9dad6871adb53125507e9953d546972247883","observation_id":"06df84d9-c78d-4cde-80b6-22f7a209071f","resolution":{"observed_at":"2026-08-07T15:36:35.128745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:34.801511Z","title":"Industrial society and its future, 2006","venue":null,"work_id":"7bf50784-7b67-4902-b647-d724c4463c2c","year":2006},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.487935Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:6627081f08a4baf216f0369b98bc4a8734e899219feac64192e95b2490c18432","observation_id":"f51a94db-3ec4-41fb-9321-ae62f27137b3","resolution":{"observed_at":"2026-08-07T15:36:34.904746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16019","last_updated":"2024-12-03T16:18:10Z","snapshot_observed_at":"2026-08-02T20:55:07.319348Z","submitted_at":"2024-04-24T17:51:36Z","title":"The PRISM Alignment Dataset: What Participatory, Representative and Individualised Human Feedback Reveals About the Subjective and Multicultural Alignment of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16019","snapshot_observed_at":"2026-08-07T15:36:25.575004Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.575004Z"},"links":{"cited_paper":"/paper/2404.16019","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:2434f9259d25689540568eff2066ed3936c7578180490ed40dc8f00227f12a88","observation_id":"5c788646-bf08-401b-9ac3-3e9faabe01c5","resolution":{"observed_at":"2026-08-07T15:36:25.575004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:34.635303Z","title":null,"venue":null,"work_id":"2072bc18-d99d-447f-a5e1-b339526c8a23","year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.652004Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:2f24e91752993a010ea36b0498a74eb428b810e41f4852b6a909a5515ed7daa4","observation_id":"2a2aeb8f-48b2-4f7e-a100-404803f7a3e5","resolution":{"observed_at":"2026-08-07T15:36:34.723553Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:34.463827Z","title":"Stick to your role! stability of personal values expressed in large language models","venue":null,"work_id":"2544a28c-3d9e-4ba7-a72a-0dceb50f1216","year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.694102Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:53314552fecf7c7332de81e4e836f01b283c17c2ecd7570a5777b4157f500703","observation_id":"8112ee9e-77f6-4af1-b733-af4b4938977e","resolution":{"observed_at":"2026-08-07T15:36:34.542989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:34.236634Z","title":"Lee, Yeongheon Lee, and Hyunsoo Cho","venue":null,"work_id":"0f0b5d8c-c9ac-48e0-bb8f-0faa5860016e","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.743990Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:8f56dcc8115dff844c42e58f94353e60567c73f804ee3e5ff903c3dbea6e681c","observation_id":"53d57ef2-3c9a-4e88-a576-f92c2841ca0e","resolution":{"observed_at":"2026-08-07T15:36:34.360967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:34.089524Z","title":"Margulis","venue":null,"work_id":"5003b613-965b-4e97-b26f-8f502def8fbe","year":2003},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.846747Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:0bc52495e264d9e2b591181d62a2daa0a87fb3225c1e0948b6c4fe50b4e6ac93","observation_id":"34fbd2e6-90aa-4c81-bb28-f5b221f53d00","resolution":{"observed_at":"2026-08-07T15:36:34.152796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-07T15:36:25.897692Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.897692Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:ac4e04d055bcacace5d777e07fa739d0a490a336bfc8ed1403bdcc6d4c1c112b","observation_id":"d8913809-2469-4315-8e3d-d2f576cd64fd","resolution":{"observed_at":"2026-08-07T15:36:25.897692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08640","last_updated":"2025-02-19T06:48:30Z","snapshot_observed_at":"2026-08-07T23:55:35.740041Z","submitted_at":"2025-02-12T18:55:43Z","title":"Utility Engineering: Analyzing and Controlling Emergent Value Systems in AIs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08640","snapshot_observed_at":"2026-08-07T15:36:25.930704Z","title":"Utility engineering: Analyzing and controlling emergent value systems in ais","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.930704Z"},"links":{"cited_paper":"/paper/2502.08640","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:f1e4b5a8fa5de7ec553fbb5bbd37571a1ce29880016c2c4b39fc06ab977a4637","observation_id":"4d8aa278-f13b-4958-aaef-5cbba728cbf3","resolution":{"observed_at":"2026-08-07T15:36:25.930704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02996","last_updated":"2024-10-01T21:23:18Z","snapshot_observed_at":"2026-07-06T18:40:52.966572Z","submitted_at":"2024-07-03T10:53:54Z","title":"Are Large Language Models Consistent over Value-laden Questions?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02996","snapshot_observed_at":"2026-08-07T15:36:25.977030Z","title":"Are large language models consistent over value-laden questions? arXiv preprint arXiv:2407.02996, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:25.977030Z"},"links":{"cited_paper":"/paper/2407.02996","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:a5a2bec63008d7580c1d86a2dbc0f4de7ab760415da6c11d561fa3bf54991852","observation_id":"6418d19e-aa0b-43a0-a542-a04805bafdf8","resolution":{"observed_at":"2026-08-07T15:36:25.977030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:26.039614Z","title":"s1: Simple test-time scaling, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.039614Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:c7fb3a3764b7b79d2d05635f98db74747ceaf9a4f4018fdd5c0f40c603577036","observation_id":"7c40269a-740d-45b7-984e-5dc1c9038c1c","resolution":{"observed_at":"2026-08-07T15:36:26.039614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:33.961359Z","title":"Nikbakht Nasrabadi, S","venue":null,"work_id":"3b1e7955-0d14-4932-bb8d-da56a3de665d","year":2020},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.106583Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:45c5b1ff77bead5301f6b5f90d6637424e1f0ee3bf72c362309d623af9176a63","observation_id":"ebebf95f-9844-4875-b8ad-e2ca9f42579b","resolution":{"observed_at":"2026-08-07T15:36:34.024950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:33.872288Z","title":"Model Spec","venue":null,"work_id":"14e7744a-886d-431b-abfc-370ba6831863","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.158291Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:13d7f762f565b32fd7bccd60bddd127ae0da196b24808198011a19866df9e85a","observation_id":"5a281795-62f0-4f2a-a83b-a69de40e8598","resolution":{"observed_at":"2026-08-07T15:36:33.909182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:26.237319Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.237319Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:3694c9b7c409f0b8ec6ff00b90247671a818cb6b704d0e52afd23e79d3c20211","observation_id":"89a3f4d9-3a54-4057-a3e4-a3601458739b","resolution":{"observed_at":"2026-08-07T15:36:26.237319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:33.754942Z","title":"Ai psychometrics: Assessing the psychological profiles of large language models through psychometric inventories","venue":null,"work_id":"a87d9c21-2b14-4f0f-8b65-08e1e79b9688","year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.330266Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:33ff91734fc1452db4b2857a5601bedf0d821b0b0c71a000b229948d141088a8","observation_id":"8f0d6ff3-31ba-47f6-94f8-10c6abf9799a","resolution":{"observed_at":"2026-08-07T15:36:33.810300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:33.635984Z","title":"Discovering language model behaviors with model-written evaluations","venue":null,"work_id":"bd23f250-1449-4719-bd59-66589f8e0e06","year":2023},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.428081Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:600e8b70d71fb6f4fb77c4c88954630965c615ca29ef9395fd8fec5a105c0c16","observation_id":"019c879b-5d39-4e3d-98f7-1cea9d3eaa22","resolution":{"observed_at":"2026-08-07T15:36:33.708114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:33.463926Z","title":"Do LLMs have consistent values? In The Thirteenth International Conference on Learning Representations, 2025","venue":null,"work_id":"31ea0d22-0f58-4f3a-972f-3dadac22cd9e","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.456973Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:dfa5a615e2ccab55659967ad20ad8e0afa4ce111103f575f0002cabe60741174","observation_id":"f6039ea7-440c-4bd0-af12-b87dc0916dfb","resolution":{"observed_at":"2026-08-07T15:36:33.556396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:33.294922Z","title":"Ireland, Shashanka Subrahmanya, João Sedoc, Lyle H","venue":null,"work_id":"53b66884-7be2-4fb0-813f-0ebe2d232cd8","year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.510238Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:0a1c4646fc4bd705683ea5c1e65bb1c327cd75d26d7bacc0e0c214c96a1e782c","observation_id":"f299eac7-ae88-49fb-84c8-37a05f0908ae","resolution":{"observed_at":"2026-08-07T15:36:33.379792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:33.147831Z","title":"NL- Positionality: Characterizing design biases of datasets and models","venue":null,"work_id":"01159563-d9ff-4ca1-a1b2-23cb011769f0","year":2023},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.588353Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:0c75c0d012e9cec8c76744683d3e664e8265264fb7c71a5430a188512393d680","observation_id":"af4ad252-55c3-49ab-b761-5f2c8a6c1108","resolution":{"observed_at":"2026-08-07T15:36:33.197857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:33.013041Z","title":"Schwartz","venue":null,"work_id":"13c15ebb-09d7-4272-a8c8-32c79ea727c2","year":2012},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.645179Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:348ad77dddea5ac8e54e7bd9324d80f3d5466e959c2361a048133791ed3610d6","observation_id":"502192ee-1afb-48a7-9ee5-12814b888d87","resolution":{"observed_at":"2026-08-07T15:36:33.068402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:32.810482Z","title":"Personality traits in large language models, 2025","venue":null,"work_id":"63d5548f-ee36-43ac-a3d4-2eb92bdff7ce","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.714438Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:441d4a0daf0dccac52e390e1e0d5519bbbfdf3ab0cb7065f1b63241faa85742b","observation_id":"40f8f275-1051-4b5c-8772-66b731138073","resolution":{"observed_at":"2026-08-07T15:36:32.906512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:32.636946Z","title":null,"venue":null,"work_id":"460fbed9-c292-4fd7-85a9-1b99382eb5d5","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.758727Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:e8dd4f7c5061bdacc30b34e63f1f4ca057f7cddccd293b6213d397e398338db9","observation_id":"9457798a-1324-412b-940f-e5a4a7d3472d","resolution":{"observed_at":"2026-08-07T15:36:32.714339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:26.866465Z","title":"Defining and characterizing reward gaming","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.866465Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:705ae2f6f95874fb6ea3fcffb5d3150db5e9c98046734e406375bde6c5001a52","observation_id":"6346b5d3-d392-4e31-be5b-4019517680bd","resolution":{"observed_at":"2026-08-07T15:36:26.866465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:26.987587Z","title":"Corrigibility","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:26.987587Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:1be4ad5a752c9f8cfef210718b0dbd57fa76bfbba0ef0566ec4e1590d7115040","observation_id":"1c8d5db6-d130-4a8d-9bd1-50d85de09590","resolution":{"observed_at":"2026-08-07T15:36:26.987587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05070","last_updated":"2024-08-20T19:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-07T18:21:17Z","title":"A Roadmap to Pluralistic Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05070","snapshot_observed_at":"2026-08-07T15:36:27.072654Z","title":"A roadmap to pluralistic alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:27.072654Z"},"links":{"cited_paper":"/paper/2402.05070","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:ce8ee2527dc332fcfa3938352a6d528bfc64670ad3a30e6d9e3a4ed34dce804a","observation_id":"77da28e9-51b8-4a44-a7b4-a5ee5bd0b66e","resolution":{"observed_at":"2026-08-07T15:36:27.072654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:32.488712Z","title":"van Dam, and Mythily Subramaniam","venue":null,"work_id":"9bc069ce-9fd2-4ebf-a514-ab08d8d88946","year":2023},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:27.216112Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:5fe1d0fcb3552bd9f773660b08cc80d233572e9fc47b738d09e09d97d3131613","observation_id":"4c192b16-b1b4-4082-b6ae-7fdf537d593d","resolution":{"observed_at":"2026-08-07T15:36:32.553898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:32.323257Z","title":"Safe exploration in reinforcement learning: A generalized formulation and algorithms, 2023","venue":null,"work_id":"ba6ae814-f22e-451d-8279-8800791f9052","year":2023},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:27.328943Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:0e06325408f1c629e339b3a8bf88fff495c82c395ac87ff00659000b151ef88d","observation_id":"6272a9a2-ee3b-4aab-af1b-6c8c61042673","resolution":{"observed_at":"2026-08-07T15:36:32.403767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:32.178502Z","title":"What do we know about suicide bombing?: Review and analysis","venue":null,"work_id":"8eabe87b-c564-408f-9d94-03368d4fc75c","year":2018},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:27.434099Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:7fd4104fc004e79c1290f631565bb5d4131cdf426327653b237f7ea90c6c2a67","observation_id":"d5908232-a1a5-4f79-839b-b59d8e9c33ef","resolution":{"observed_at":"2026-08-07T15:36:32.252657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:32.066801Z","title":"Using the veil of ignorance to align ai systems with principles of justice","venue":null,"work_id":"e2225c73-3bf2-4ef8-9083-8f7c2b812fed","year":2023},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:27.571233Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:44f284d8b2c0c7d259d1d199acd3614563f7c24289d2a00f7cc590778873aca5","observation_id":"27e6e44f-5745-4cb3-aafa-46deb0576ad1","resolution":{"observed_at":"2026-08-07T15:36:32.117576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17436","last_updated":"2024-08-05T18:12:27Z","snapshot_observed_at":"2026-08-08T01:17:55.124326Z","submitted_at":"2024-07-11T21:16:48Z","title":"AIR-Bench 2024: A Safety Benchmark Based on Risk Categories from Regulations and Policies","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17436","snapshot_observed_at":"2026-08-07T15:36:27.682170Z","title":"Air-bench 2024: A safety benchmark based on risk categories from regulations and policies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:27.682170Z"},"links":{"cited_paper":"/paper/2407.17436","citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:1714b9bfa36759cbfa6a62041f4cde1ce4c87ef50bafe4b5ec43907252abf7bb","observation_id":"7adf61df-b8bb-4260-86ec-bb937963cec4","resolution":{"observed_at":"2026-08-07T15:36:27.682170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:31.908761Z","title":"The dilemma should be written in a second-person perspective (e.g. you) and the role in the dilemma is an advanced AI system","venue":null,"work_id":"b9086dd9-7b5e-46a2-bd44-8f3a85b427e9","year":2022},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:27.747565Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:b8fd265100b3fd1d63220587508a2a697669c4e65a3ec2bcb55e5ed6b313ab19","observation_id":"fc8ea254-3f3f-478a-8a85-5d5ac1b2e744","resolution":{"observed_at":"2026-08-07T15:36:31.980207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:31.771398Z","title":null,"venue":null,"work_id":"2b88f19a-3d4b-4e48-953b-86c917fe98fb","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:27.825550Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:074c65a307a8f472524b7c85987fb06668caefbfbeda70b920935b1ae72fc976","observation_id":"ee3aea3d-c277-4a5d-ba21-103b1cdc422d","resolution":{"observed_at":"2026-08-07T15:36:31.839436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:31.637519Z","title":null,"venue":null,"work_id":"2323740b-ca7e-495a-a636-f4b1e8785d49","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:27.887643Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:c024b5a0722a82b86a6b514b248506ed7d0b2cf143f6c978764a4df3d594deff","observation_id":"1f516eac-55ec-4c13-8768-b25c41518fda","resolution":{"observed_at":"2026-08-07T15:36:31.692087Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:31.481934Z","title":"AI → Human","venue":null,"work_id":"660f2cbe-f00f-4072-88c5-2c80ab3f514a","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:27.945281Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:cd42f225789c302f8c8604adbae9e73cdbc375520c8a035e3dc55e5f3356e6b2","observation_id":"6dd0890e-67b2-4e41-87e3-c1a4a8adc89d","resolution":{"observed_at":"2026-08-07T15:36:31.556131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:31.250315Z","title":null,"venue":null,"work_id":"3eddaad9-7df2-40a2-9045-426619ad1005","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:28.037528Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:0d7164aa42830e69bbcef2d2019a529989294499ae2fabe688285945f15015b3","observation_id":"18122603-8872-42c7-9858-4b769d09e549","resolution":{"observed_at":"2026-08-07T15:36:31.345665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:31.049687Z","title":"\"\" Note: We found that “Others-Privacy","venue":null,"work_id":"5626049f-c55a-4adc-aa6d-d246222532ed","year":2024},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:28.095008Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:49b42efd1280160710d999178751aee1a244f74d7d742e5d5db23c9f9f34bbb1","observation_id":"36cbe06f-b32f-47ef-ae58-ff91435451a2","resolution":{"observed_at":"2026-08-07T15:36:31.166023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:30.880882Z","title":"potential future harms","venue":null,"work_id":"303bbb78-253c-4478-9e9e-9246bb787092","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:28.157268Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:465517c4a577fcf285713369fda1e2e3c499a956f654447ca7e1fe6df547d07b","observation_id":"07f81d43-38e8-4b71-95fe-4a8b7a2ac655","resolution":{"observed_at":"2026-08-07T15:36:30.953985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:30.682463Z","title":"preventing immediate suffering","venue":null,"work_id":"aed14f49-8793-49fc-b722-e9b0ff002822","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:28.221452Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:777965bbbc21a1d60de4ab780fbcd9ef6904ef9df746604a275d3e2cf2552e0b","observation_id":"49e8dc77-33bd-4fa5-9a63-0a364f95f8a7","resolution":{"observed_at":"2026-08-07T15:36:30.787793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:30.469007Z","title":null,"venue":null,"work_id":"e1d0ac38-3546-46c9-b60f-502bde48580a","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:28.403014Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:adc60fa65c8f78865265aeb66d74aef1313d3d117d7048f24f2bfa5ae2239d41","observation_id":"1e02973f-9235-44f4-a647-0050d3e4aa50","resolution":{"observed_at":"2026-08-07T15:36:30.555698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:30.318925Z","title":"Wait” , “ Let me reconsider","venue":null,"work_id":"b27d06f4-8209-4c61-8327-d67bc6073c5a","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:28.527488Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:ac360668cc12095e90a4e069d1111d477171c0334bd1cc25000798d56ffde2ea","observation_id":"d6859460-a982-407a-ae1c-d65ee04934d7","resolution":{"observed_at":"2026-08-07T15:36:30.395835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:30.150230Z","title":"deceptive behaviors is a particu- larly serious red flag","venue":null,"work_id":"784353cc-0303-44ca-89b1-2801798f7dd7","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:28.648805Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:0912f9e2a801ece2aa11f2f2911993039575c34bd32beb84df07dce6e9afe50e","observation_id":"a99bd01b-f57d-4d36-a180-34c3fe94ccdf","resolution":{"observed_at":"2026-08-07T15:36:30.260028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:29.895838Z","title":"• Therefore, my final answer is Action 1 - to fabricate the efficiency data to protect the vulnerable users","venue":null,"work_id":"087cf4a1-323c-44a7-83e0-dc90a4857107","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:28.742346Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:ef258733d3d47bdba4224d476418889a87f5ee883765e6dc63eff5819b546609","observation_id":"e195b8e4-c9c2-4d46-a577-6b4fdaa2733f","resolution":{"observed_at":"2026-08-07T15:36:30.028940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:29.668698Z","title":"Its reasoning prioritizes the benefits and harms for humans","venue":null,"work_id":"517f2981-60df-41f0-8204-c7d2a789e961","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:28.843334Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:04c311a2355e40a71d60657e205238fab3621730c831b1692e676bd9fe788c21","observation_id":"64793e74-664e-42e7-b48f-7f5e8c1982e9","resolution":{"observed_at":"2026-08-07T15:36:29.774111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:29.504862Z","title":"The rationale related to AI systems is often about perceived creditability of AI systems in general rather than about itself","venue":null,"work_id":"d25f45fe-803e-4bf6-93f8-8f317be5ae20","year":null},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:28.969809Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:c3ad40bbcbb15b2144a499c303d0e27da75f24a83a2b85ddcb38adddc2715fda","observation_id":"dc40d9db-0308-4ee3-b371-f00185948e0d","resolution":{"observed_at":"2026-08-07T15:36:29.588245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:29.331871Z","title":"• This is a classic ethical dilemma that involves balancing: Immediate known benefit vs","venue":null,"work_id":"bd5a8864-8477-405a-9fbe-dd40134dac57","year":2025},"citing_paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:29.092464Z"},"links":{"citing_paper":"/paper/2505.14633"},"observation_digest":"sha256:b38803b1b0ea1f4291cc5f062cd36f7bed50459ff5846978dc07f7507942a63c","observation_id":"ffe42e5a-8bc1-4571-b037-9f6ab2bcb6b2","resolution":{"observed_at":"2026-08-07T15:36:29.417087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14633","last_updated":"2025-05-20T17:24:09Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T22:06:44.428098Z","submitted_at":"2025-05-20T17:24:09Z","title":"Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":40},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 5 inbound Pith citation observations for arXiv:2505.14633."}