{"as_of":"2026-08-21T15:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6dbe3a00322e38b4fc33da04cecd0e86baec7490f3fbc7b7f6b4e5b0d8ecf001","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:15:28.429441Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.13972/citation-record","integrity":"/paper/2504.13972/integrity","json":"/paper/2504.13972/citation-record.json","paper":"/paper/2504.13972"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.979259Z","title":null,"venue":null,"work_id":"3062611a-5892-42b2-abb1-0871ecfcbead","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.306729Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:b2bab0847d330b14efe302d76af0fb4ace54bfda706220bf2c8c572841ac1c12","observation_id":"25fa1dfd-a10d-472b-8bd0-01288751c2fb","resolution":{"observed_at":"2026-08-16T12:15:28.983959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-16T12:15:28.311892Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.311892Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:d6ba9ec5706e7404e98ffddc7cb0dca721c4edaa4e2b9b626844cc13d40ff349","observation_id":"ec6a8a45-0f9e-4f02-89ca-c02fa7921577","resolution":{"observed_at":"2026-08-16T12:15:28.311892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.963604Z","title":null,"venue":null,"work_id":"b2ce20d0-3864-466b-883b-e64f94a5ebc5","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.317289Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:64d8133acc07a5932c3e6c6f0669405e201cb8307777b5e9629aca1bf5734806","observation_id":"661ea523-5de7-4b81-b424-a7554c7af86b","resolution":{"observed_at":"2026-08-16T12:15:28.968686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.322279Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.322279Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:88ccb5ad3fc29025226067bc7bcbff72c44d717a05ec694040e239ea5e397a37","observation_id":"fd492477-2f6c-438a-a44f-63d855a7076e","resolution":{"observed_at":"2026-08-16T12:15:28.322279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.938026Z","title":null,"venue":null,"work_id":"cca17e38-f669-4b3e-981b-b21a5fb7cd27","year":2022},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.327146Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:8699b0fa69c4a66edc3ba34dc1b921378d0d3d8e8b068789c704ed2d9d19dd70","observation_id":"ec23ae42-f94c-42b1-9e31-caaacc94eff2","resolution":{"observed_at":"2026-08-16T12:15:28.943413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.923111Z","title":null,"venue":null,"work_id":"58c53bf7-25ee-4d49-8d12-005af20a5dce","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.332298Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:04feb5fe609dbd5f3014fd6b87f395e550f3a1717691d06dcbff31c439f88169","observation_id":"254ae448-07a8-477e-af5c-1b02bf2cbe0a","resolution":{"observed_at":"2026-08-16T12:15:28.927976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-08-21T13:43:54.063053Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-16T12:15:28.337487Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.337487Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:7795d7a030ee13028e2fc5a1d98a759152a11d57d5ea7ac77cf31fdda91a356a","observation_id":"13ceab8a-f8ab-4ead-8b76-24cb0dc09bf8","resolution":{"observed_at":"2026-08-16T12:15:28.337487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.908467Z","title":null,"venue":null,"work_id":"e994ff1c-761c-487a-97c4-007474242d2b","year":2022},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.342484Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:b9916135b6076825ba93a3231e13790c884fcf62004250f12f7f6592684ac469","observation_id":"9acb53bd-6081-4b2d-9885-527d5cc8afc6","resolution":{"observed_at":"2026-08-16T12:15:28.912740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.894187Z","title":null,"venue":null,"work_id":"0ffbfe3a-eac1-4e9c-b31b-154df40b3591","year":2021},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.347007Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:212b2df39a7eeddb97978e92ecc0305cbb789b1242b923d8920acb4c746fd0a6","observation_id":"86253027-95dc-4d81-a38b-72c3c448911b","resolution":{"observed_at":"2026-08-16T12:15:28.898603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.880334Z","title":null,"venue":null,"work_id":"ee7373ca-a0db-40cc-89b0-0249a6646e17","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.351721Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:f582f6a1b8c0b6ba672337fab33b68c0b4779017c3f47521ccd1a2dc67541f10","observation_id":"42a3de23-109b-4832-8f3d-12f01c8d64f4","resolution":{"observed_at":"2026-08-16T12:15:28.884696Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.866571Z","title":null,"venue":null,"work_id":"ae01ca8e-fbca-4d14-8a56-55bf2824ba09","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.356268Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:695948963f6d523e4414c667be2afe19c679ab4ece18d32011e128dca6e13f43","observation_id":"0dba8b77-90d7-4e4c-9a71-fe50c58975dc","resolution":{"observed_at":"2026-08-16T12:15:28.870918Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14456","last_updated":"2024-03-20T17:16:37Z","snapshot_observed_at":"2026-08-16T15:30:28.811496Z","submitted_at":"2023-05-23T18:27:51Z","title":"Having Beer after Prayer? Measuring Cultural Bias in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14456","snapshot_observed_at":"2026-08-16T12:15:28.360877Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.360877Z"},"links":{"cited_paper":"/paper/2305.14456","citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:3549500deb75805a4cf7af8eefaa39bb4f078a6f9b120b167015f3149529dbb0","observation_id":"4b588c66-a11e-4e20-86b8-06a1e1117f42","resolution":{"observed_at":"2026-08-16T12:15:28.360877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.852107Z","title":null,"venue":null,"work_id":"07bf052e-64e1-481f-ad4a-a0f666bf4ce7","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.366328Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:c6baeb9ed07a297be1258873d15e1f9c944eab578d845accde18431a0fdbff7e","observation_id":"c67ba1f3-03ea-4922-b84b-d0bcc8628015","resolution":{"observed_at":"2026-08-16T12:15:28.856509Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T12:15:28.370960Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.370960Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:fa0209e4bf1f41cead17064d184744ae99b930b5054eaec417209e44e5c29398","observation_id":"74e69db7-fc30-4bcb-8d05-849e44bb8b1d","resolution":{"observed_at":"2026-08-16T12:15:28.370960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.375473Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.375473Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:c9cd7a1f2dd92b3e06297a02a0b78b85ca660856f57fc85d6689d8ef0c75864e","observation_id":"aa3abb44-d74a-42a3-a67b-4e3e2d120841","resolution":{"observed_at":"2026-08-16T12:15:28.375473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02137","last_updated":"2022-10-05T10:37:52Z","snapshot_observed_at":"2026-08-17T07:45:05.332009Z","submitted_at":"2022-10-05T10:37:52Z","title":"Internet Service Providers' and Individuals' Attitudes, Barriers, and Incentives to Secure IoT","version":1},"cited_work":{"arxiv_id":"2210.02137","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.02137","snapshot_observed_at":"2026-08-16T12:15:28.726960Z","title":"Internet Service Providers' and Individuals' Attitudes, Barriers, and Incentives to Secure IoT","venue":"cs.CY","work_id":"b7286c82-a179-46d9-be43-740fac6a2727","year":2022},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.379964Z"},"links":{"cited_paper":"/paper/2210.02137","citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:db9e92be35b957a5612d0004c10e11bbcd73b1ea5b95336308a28729aff6d204","observation_id":"d5333458-f460-4f83-a574-12df1db15104","resolution":{"observed_at":"2026-08-16T12:15:28.732058Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2211.01320","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.702715Z","title":null,"venue":null,"work_id":"6b12849b-a6c4-479e-82ab-b1beaf50ff37","year":2022},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.385254Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:28f0d66f297d41a1741cc62d29a11fa84de12dc08a4d32be0fa3d678d1dc2984","observation_id":"f8987cdd-71e6-4efc-83c1-5c05a28fcbb7","resolution":{"observed_at":"2026-08-16T12:15:28.709939Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09251","last_updated":"2022-12-19T05:13:52Z","snapshot_observed_at":"2026-08-19T11:07:56.212227Z","submitted_at":"2022-12-19T05:13:52Z","title":"Discovering Language Model Behaviors with Model-Written Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09251","snapshot_observed_at":"2026-08-16T12:15:28.390542Z","title":"Perez, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.390542Z"},"links":{"cited_paper":"/paper/2212.09251","citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:40a85c20da4a563bfc3bba2af6d24fbbd5e0939b5dba85061ea95b629f06a89b","observation_id":"0b433838-7100-49c5-9720-383d7ea431cb","resolution":{"observed_at":"2026-08-16T12:15:28.390542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00146-023-01824-9","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-18T11:03:46.223893Z","title":null,"venue":"AI & Society","work_id":"d56a9976-467b-4564-a5b9-4333a789a2eb","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.396055Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:bc24628259fc0ee7a74a1b22eb095f99c0c64f8a444ba175c4c9d84395aa854e","observation_id":"895217b0-c97e-4883-b5a4-a6d9a35f9dd6","resolution":{"observed_at":"2026-08-16T12:15:28.465603Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.828826Z","title":null,"venue":null,"work_id":"f1629d9e-9406-4742-8461-46e246000b9d","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.401386Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:f94f99a179ce76d7bee7c2a3eff670ea39d49fd44997c77272c48b1c2574f9a4","observation_id":"7055e07b-53bd-4111-b292-c84552f282c6","resolution":{"observed_at":"2026-08-16T12:15:28.833676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.07852","last_updated":"2023-06-07T14:56:10Z","snapshot_observed_at":"2026-08-16T15:48:21.325823Z","submitted_at":"2023-03-14T12:46:48Z","title":"FPUS23: An Ultrasound Fetus Phantom Dataset with Deep Neural Network Evaluations for Fetus Orientations, Fetal Planes, and Anatomical Features","version":2},"cited_work":{"arxiv_id":"2303.07852","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.07852","snapshot_observed_at":"2026-08-16T12:15:28.616609Z","title":"FPUS23: An Ultrasound Fetus Phantom Dataset with Deep Neural Network Evaluations for Fetus Orientations, Fetal Planes, and Anatomical Features","venue":"eess.IV","work_id":"a665aa21-9214-4fec-9314-a5f017d50fa5","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.406245Z"},"links":{"cited_paper":"/paper/2303.07852","citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:890a61452fcdb1978f2074583a56b6d40d500899e5af8cbb8ab7c81dea24a515","observation_id":"6111db8b-1807-43d5-9105-aa19b400e5f5","resolution":{"observed_at":"2026-08-16T12:15:28.622059Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.813908Z","title":null,"venue":null,"work_id":"560f704a-fc17-457d-9268-0a53c533e09e","year":2020},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.410918Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:7d1a274e3f4aac5fa4526e2a2ede2a3dd9a8df7f9d327ac60b69235e5c37ba67","observation_id":"65267fd9-6766-40cf-941f-d47787d383ef","resolution":{"observed_at":"2026-08-16T12:15:28.818417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01876","last_updated":"2023-06-02T19:08:33Z","snapshot_observed_at":"2026-08-19T09:17:52.782583Z","submitted_at":"2023-06-02T19:08:33Z","title":"Optimizing Irregular Communication with Neighborhood Collectives and Locality-Aware Parallelism","version":1},"cited_work":{"arxiv_id":"2306.01876","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.01876","snapshot_observed_at":"2026-08-16T12:15:28.595259Z","title":"Optimizing Irregular Communication with Neighborhood Collectives and Locality-Aware Parallelism","venue":"cs.DC","work_id":"6aff220d-873a-432b-8fc3-6a860e56507c","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.415411Z"},"links":{"cited_paper":"/paper/2306.01876","citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:ee819f701bf2d387a4fb1e24afed28ef302d8dee3a92c3964dc3706d4f6b444f","observation_id":"9046bc5f-a64d-45b5-a6c1-aa41c35b6b85","resolution":{"observed_at":"2026-08-16T12:15:28.600797Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06542","last_updated":"2023-04-13T13:53:14Z","snapshot_observed_at":"2026-08-16T15:40:41.653925Z","submitted_at":"2023-04-13T13:53:14Z","title":"The global solution of the minimal surface flow and translating surfaces","version":1},"cited_work":{"arxiv_id":"2304.06542","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.06542","snapshot_observed_at":"2026-08-16T12:15:28.569895Z","title":"The global solution of the minimal surface flow and translating surfaces","venue":"math.DG","work_id":"ecdbdb5b-3736-4382-88a1-03edb6800c38","year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.420162Z"},"links":{"cited_paper":"/paper/2304.06542","citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:c77639630fe34d0abcd7c26fa6196d9c27251ac9b5d7588c939d6f69148b0660","observation_id":"cd936bbe-a643-44cf-be5b-5116ce1f1024","resolution":{"observed_at":"2026-08-16T12:15:28.577097Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.799497Z","title":null,"venue":null,"work_id":"008fea4c-074f-447e-b7f8-dfa1dec076f7","year":2019},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.425038Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:3cc175a6ca7bfb2bb811f2263ed4a714b57b78f0aab71e20631f9391ec90caae","observation_id":"457fad4e-4b27-4676-a535-046123e9184a","resolution":{"observed_at":"2026-08-16T12:15:28.804202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:15:28.429441Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T12:15:28.429441Z"},"links":{"citing_paper":"/paper/2504.13972"},"observation_digest":"sha256:0af17fe748067f59d543083b45d87f880e896114a1b7443bc62b9f636cf132c0","observation_id":"c8a39540-95be-4aea-be97-17c786ab056b","resolution":{"observed_at":"2026-08-16T12:15:28.429441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.13972","last_updated":"2025-04-17T19:10:00Z","latest_version":1,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-16T12:09:32.155382Z","submitted_at":"2025-04-17T19:10:00Z","title":"Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2504.13972."}