{"as_of":"2026-08-21T01:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2172c79edf5170fab3c9fb288bd281312df39dbffb5727872a20d1d0b710182","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T17:33:56.918863Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T14:35:55.709732Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T04:50:57.028932Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"cited_work":{"arxiv_id":"1906.09624","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1906.09624","snapshot_observed_at":"2026-07-04T23:44:00.157209Z","title":"1906.09624 , primaryclass =","venue":null,"work_id":"86f9d1c0-2308-4355-9bb2-8b9345b8fa50","year":1906},"citing_paper":{"arxiv_id":"2605.06895","last_updated":"2026-05-07T19:54:25Z","snapshot_observed_at":"2026-08-15T05:26:08.190288Z","submitted_at":"2026-05-07T19:54:25Z","title":"Mitigating Cognitive Bias in RLHF by Altering Rationality","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-11T01:02:20.179748Z"},"links":{"cited_paper":"/paper/1906.09624","citing_paper":"/paper/2605.06895"},"observation_digest":"sha256:e32640ab8d88c96e922282b76d6d426b741497c5c7e9eab0ecfc9e61ca312ea7","observation_id":"c999d903-9ad4-4a83-8059-3382c556d2bf","resolution":{"observed_at":"2026-07-04T23:44:00.157209Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.09624","snapshot_observed_at":"2026-07-13T14:35:55.709732Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.00001","last_updated":"2026-04-01T17:12:42Z","snapshot_observed_at":"2026-08-13T21:55:05.244836Z","submitted_at":"2026-04-01T17:12:42Z","title":"Constructive Alignment: Governing Preference Dynamics in Human-AI Interaction","version":1},"reference_index":141,"source":"pdf_text","source_observed_at":"2026-07-13T14:35:55.709732Z"},"links":{"cited_paper":"/paper/1906.09624","citing_paper":"/paper/2607.00001"},"observation_digest":"sha256:44237e232de9d6df8bbd4f47b8867b66677438df157c9cfd2ee271f38465432e","observation_id":"e084806b-b6e8-4988-bfbb-7f96090ddea7","resolution":{"observed_at":"2026-07-13T14:35:55.709732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1906.09624/citation-record","integrity":"/paper/1906.09624/integrity","json":"/paper/1906.09624/citation-record.json","paper":"/paper/1906.09624"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:36:07.226215Z","title":"write newline","venue":null,"work_id":"8481976a-f196-4822-833d-e487ae5a1e81","year":null},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:b7da012a32670034b53c230210f51a404b6d41acfbab78ac52555dd1bb748b43","observation_id":"f9a6e9bf-9498-4f53-ac25-5f938ad5b4a3","resolution":{"observed_at":"2026-05-25T17:37:05.789061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Ng, A","venue":null,"work_id":"97e6c494-0e3b-4834-a690-b8b9e93187ff","year":2004},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:642179a02610a4318181d7fa86676ca5f0bfdf71c65e2cbb0bd39441881bdb53","observation_id":"26e2a86f-0512-48c5-8098-12ac539c5ded","resolution":{"observed_at":"2026-05-25T17:37:05.793004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning from human preferences","venue":null,"work_id":"6d4a0541-697a-4546-bcc4-2aa90a106fab","year":2017},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:dc15ea2672ef0e99554d63ddc7d42eb38b815266daa5334f77191b0a066b4a36","observation_id":"77b5de5f-6063-47de-a3d7-8c51bc312049","resolution":{"observed_at":"2026-05-25T17:37:05.785448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Mindermann, S","venue":null,"work_id":"c1524507-a168-4e8f-b36e-2b7165846d8e","year":2018},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:9421e8e48430dcfbdd3c3cdc7ef5a7ab08d02b4f26b6765aec255307755f185b","observation_id":"3c05d9c6-d592-418d-8463-a6316bf42b7a","resolution":{"observed_at":"2026-05-25T17:37:05.782048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c3d44ca6-2e3b-4e55-bafc-109fbf18a2d0","year":2006},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:94f3b09fc80e78a8da0300aed16f34ef8011d877c0c944879a52a4074d9a1fa2","observation_id":"193bf705-5cf7-4b4b-94b0-bd5ed66ddeb5","resolution":{"observed_at":"2026-05-25T17:37:05.772292Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4e6f5dfa-4f73-46dc-b222-1794edd0ccd6","year":2014},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:8ad7e0ebaf6421f3cf2b795f3408cae8de02135db88477b6d43c56dcb1f270f7","observation_id":"e8f101c9-350d-4682-95a6-d59e15f2a6a0","resolution":{"observed_at":"2026-05-25T17:37:05.769274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"planning fallacy","venue":null,"work_id":"35d54b22-fd2c-4706-974b-c1846c21caae","year":1994},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:3e777955fe7c793dbb2b3254f451e7a035867b08dd9ebe21c73ab0af703caaad","observation_id":"767671ce-bfbb-4b2e-a31e-8246bca7043f","resolution":{"observed_at":"2026-05-25T17:37:05.779163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Kim, K.-E","venue":null,"work_id":"31a06949-5575-4dae-aa71-7e743cfb38c1","year":2012},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:b3fa24ae49e997817765cb10156168b26d0a765ef1088cf30a6e172e164b97f8","observation_id":"f6fbc452-286f-4db7-8fdf-c5ca48d683bc","resolution":{"observed_at":"2026-05-25T17:37:05.739648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The easy goal inference problem is still hard","venue":null,"work_id":"8fa16287-e4c3-4f64-b776-c82c3b63dac9","year":2015},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:9940e3280d23a189330a702f8e91a382df60cd259f949419b1641500b283b307","observation_id":"1cbc551f-505a-4dc1-8ed9-abd5bfc600d7","resolution":{"observed_at":"2026-05-25T17:37:05.752233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Rothkopf, C","venue":null,"work_id":"28c01933-2546-4796-8580-582006bf49a7","year":2011},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:6fc13341de1a327abd4b2342abc6e605dd2ae706079e13eadda2d42e660f3171","observation_id":"735b2c2e-e947-4ac1-a3c1-2e3ce8f481dc","resolution":{"observed_at":"2026-05-25T17:37:05.751712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Goodman, N","venue":null,"work_id":"c2bfe316-4ee0-4c2a-801a-9067727f2a87","year":2015},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:01a7444aba41f4b1c73ae74c60d6c927648bbb5089a29b2f45bb139d0e29b1c5","observation_id":"a5013674-fbe8-4304-b25d-19923ddaa0ad","resolution":{"observed_at":"2026-05-25T17:37:05.748118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"255dd0d1-24c3-4808-b528-ccbcb8008685","year":2016},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:2ec395b80b9c8e6eb954690eb5d02bc2999cb97b267ce0f82019292379659003","observation_id":"1af2b87f-67d2-43f9-a3f8-20d5c74df4cd","resolution":{"observed_at":"2026-05-25T17:37:05.744590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guided cost learning: Deep inverse optimal control via policy optimization","venue":null,"work_id":"db66cddf-812e-4a0c-89c8-300004784fb2","year":2016},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:1a27361df7382e26bdd86ae66b9a60dd6ff9fbb8dad78ae1d02c2b7041ea3e1a","observation_id":"f514c3cb-791d-4a11-8073-adf486d44e67","resolution":{"observed_at":"2026-05-25T17:37:05.762312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Time discounting and time preference: A critical review","venue":null,"work_id":"79e5d767-f15c-4636-863c-2cb2ab449493","year":2002},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:9b45f4243baf58b1b6ba0548a7a0d97ad0e238d7a4e08d252f2b97da6e2e9713","observation_id":"d1604d1d-1c1d-4c7b-80d0-c23ebf32d61d","resolution":{"observed_at":"2026-05-25T17:37:05.729197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08882","last_updated":"2018-07-15T13:58:18Z","snapshot_observed_at":"2026-08-17T12:21:18.077205Z","submitted_at":"2018-05-22T21:57:34Z","title":"Multi-task Maximum Entropy Inverse Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1805.08882","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.08882","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-task Maximum Entropy Inverse Reinforcement Learning","venue":"cs.LG","work_id":"bc3f6fad-5839-4c4a-944a-198de8773c77","year":2018},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"cited_paper":"/paper/1805.08882","citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:8189fddc6d00e30f189f966787eb858742080f7d7d5f9d908462a8a7a79a22ca","observation_id":"e782b411-6eb1-48c9-8348-74b46bb0e138","resolution":{"observed_at":"2026-05-25T17:36:05.753031Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.04697","last_updated":"2018-07-17T14:16:12Z","snapshot_observed_at":"2026-08-17T13:24:33.904588Z","submitted_at":"2018-02-13T16:10:10Z","title":"Learning to Search with MCTSnets","version":2},"cited_work":{"arxiv_id":"1802.04697","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.04697","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to Search with MCTSnets","venue":"cs.AI","work_id":"be51c312-5ecb-4ef7-b2a1-91fbaff55451","year":2018},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"cited_paper":"/paper/1802.04697","citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:a2933901d4ea422f6b84f92674d02c647832035f5714f60ba72c5c70528489e6","observation_id":"693ac56f-77bf-4623-802d-636ac2ea1880","resolution":{"observed_at":"2026-05-25T17:36:05.718801Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"J., and Dragan, A","venue":null,"work_id":"12a798e5-e826-483c-a557-665f8e3a63ce","year":2017},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:76befa9128ee7706f74718e62c3c936fee7075976448ee00c95ef78b90208c54","observation_id":"3b4dbd0b-5ccd-4530-932f-e887ac9ad469","resolution":{"observed_at":"2026-05-25T17:37:05.775715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A perspective on judgment and choice: mapping bounded rationality","venue":null,"work_id":"b5afdc46-2480-4452-8d91-013f094fe84e","year":2003},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:ea9269113cdbe65bd8dbd04781088b7554daeecf74afcfd59ba075c78b8201e5","observation_id":"23bd822e-2431-4e82-9a7c-5b779ed17794","resolution":{"observed_at":"2026-05-25T17:37:05.755806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Specification gaming examples in ai","venue":null,"work_id":"b68c8ef2-08ea-447e-b309-2932689d7a9d","year":2018},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:c64e8e1e4878b9a77031914fde2aa55752e4837e13b33eb215ace4db8cb803b4","observation_id":"b887dcf2-7868-4167-bb9c-d3d702316007","resolution":{"observed_at":"2026-05-25T17:37:05.763279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Risk-sensitive inverse reinforcement learning via coherent risk models","venue":null,"work_id":"9e9e78d5-206f-4d34-972e-e4e7597f5154","year":2017},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:88f974cf2d5ad31b507988aba56422dc54dae4761d661d9c5f70b865006c6cdb","observation_id":"be275a38-9860-4fad-8a6e-eeb5ec6ff86c","resolution":{"observed_at":"2026-05-25T17:37:05.759451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Y., Russell, S","venue":null,"work_id":"a358e30b-65bc-457d-9e80-6f910f3ed702","year":2000},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:82428d55caec087788ab8ea139daf8ee22a2361609ac7f134fc92addb80585b4","observation_id":"56950a82-5761-4c44-a5aa-65a238e37afd","resolution":{"observed_at":"2026-05-25T17:37:05.741393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Feature visualization","venue":null,"work_id":"1fd0869a-2e23-4d09-b8b6-b9c8ee265381","year":2017},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:9d66da78fed4e71d0e35ff4e39c44443f3a6c4a035c846ec8b953a5535576dde","observation_id":"b9913298-4bcc-41a7-84c7-14f154df20e8","resolution":{"observed_at":"2026-05-25T17:37:05.795748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06170","last_updated":"2017-07-19T15:52:35Z","snapshot_observed_at":"2026-08-14T20:46:36.147890Z","submitted_at":"2017-07-19T15:52:35Z","title":"Learning model-based planning from scratch","version":1},"cited_work":{"arxiv_id":"1707.06170","doi":null,"metadata_source":"pith","pith_arxiv_id":"1707.06170","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning model-based planning from scratch","venue":"cs.AI","work_id":"51d52935-9794-480b-92ab-2785b6ab1ca6","year":2017},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"cited_paper":"/paper/1707.06170","citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:4ee49f83b962ee94eb80c39b6fbd60cd88acc315cdcffdfdeff54ea546254f2d","observation_id":"61ab85df-20b3-4953-a8d2-da32723ea0e3","resolution":{"observed_at":"2026-05-25T17:36:05.725294Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1712c5e8-c273-4208-b40e-3254dfe45fe1","year":2014},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:76c8a7855a895f2a4488a67c19b32701933f6aeacf38fce41c15c6b3968efe83","observation_id":"667b0124-3235-4e53-8c45-e53c9379e5a2","resolution":{"observed_at":"2026-05-25T17:37:05.784669Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.07740","last_updated":"2018-03-12T21:37:03Z","snapshot_observed_at":"2026-08-14T19:43:36.874529Z","submitted_at":"2018-02-21T19:00:10Z","title":"Machine Theory of Mind","version":2},"cited_work":{"arxiv_id":"1802.07740","doi":"10.1201/97813","metadata_source":"pith","pith_arxiv_id":"1802.07740","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Machine Theory of Mind","venue":"cs.AI","work_id":"d4a3aecc-9c78-4974-9de2-4e1ace8c0214","year":2018},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"cited_paper":"/paper/1802.07740","citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:9e74eb47431355dbdbb86890eaadc9393f1b17b6790f6e5a83ee37559cca7bf1","observation_id":"eab746cc-61e7-4515-ac5f-983210fa1049","resolution":{"observed_at":"2026-05-25T17:36:05.732608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Where do you think you're going?: Inferring beliefs about dynamics from behavior","venue":null,"work_id":"7ad59b3d-1858-4e62-bb0e-d2e373e019dc","year":2018},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:fab9a07cfdf4c37077c2f19f56c7cf6caaf59bd0e91331f6ae88c145d18cd893","observation_id":"6c41499b-dd99-4e74-924a-d000df67156f","resolution":{"observed_at":"2026-05-25T17:37:05.788935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning agents for uncertain environments","venue":null,"work_id":"fd6a4360-7551-49d9-b073-6c0b06d162b4","year":1998},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:22d4c5a707b9b71abc828fddd179dce2be4bb946921f35eb49f76a53425143f0","observation_id":"3646b5bd-076a-41c9-b119-87b7eb57b9ce","resolution":{"observed_at":"2026-05-25T17:37:05.702366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Inverse reinforcement learning from failure","venue":null,"work_id":"c1ee97d7-cac0-4111-9bb5-c95f5db0d420","year":2016},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:d17a48e6b4f42e114a1ae6c659f7e0b932a5c73b09f26934141ae5ebde2e453b","observation_id":"92b912de-f170-4396-939e-e930cb1c4b8a","resolution":{"observed_at":"2026-05-25T17:37:05.777621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.00645","last_updated":"2018-04-04T17:36:36Z","snapshot_observed_at":"2026-08-15T00:38:32.751888Z","submitted_at":"2018-04-02T17:51:53Z","title":"Universal Planning Networks","version":2},"cited_work":{"arxiv_id":"1804.00645","doi":null,"metadata_source":"pith","pith_arxiv_id":"1804.00645","snapshot_observed_at":"2026-07-02T17:07:12.914063Z","title":"Universal Planning Networks","venue":"cs.LG","work_id":"12d1df6e-e02d-4bc2-9d7e-1adfc87fa16c","year":2018},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"cited_paper":"/paper/1804.00645","citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:cd9a838c4f34ef4f60b2e2f8dd63acb237a352f76cc757c446d2ff173d7be584","observation_id":"f9cdf10e-d340-41ea-8a20-a6999f8d3d82","resolution":{"observed_at":"2026-05-25T17:36:05.739165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Latent variables and model mis-specification","venue":null,"work_id":"b032c4d2-6ac2-445f-a485-54faff428033","year":2017},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:319097db6a68d10809d40c01bfe33d5c49e4a5679785152bec890140ac44ada3","observation_id":"1af7be0c-c56d-45ce-b586-0bdd95715b6b","resolution":{"observed_at":"2026-05-25T17:37:05.781207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Evans, O","venue":null,"work_id":"f9847ccf-96fd-4219-a2fb-8f2b2fabbac3","year":2017},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:1736b5dcf1c7a502d9d232d404628f668276b92a4a9e50ee641df18d3a2ce360","observation_id":"3efd5067-b471-40a5-b3da-e36d7c46f49d","resolution":{"observed_at":"2026-05-25T17:37:05.792285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Value iteration networks","venue":null,"work_id":"cc3116b3-4694-4395-aea2-684d124e7c95","year":2016},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:f3cc229330db57d7d7128d8333cff05ca295455a105aa6ad255d6037baf8e74c","observation_id":"0f0ce870-7300-4a21-a28a-4061421fa776","resolution":{"observed_at":"2026-05-25T17:37:05.799617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Kahneman, D","venue":null,"work_id":"1077312f-cd83-4f9b-9ca5-065142fd2dae","year":1973},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:aa9dd8ba5705974971140c288d1aa1e804b41f3b757e53c623d46551011488b2","observation_id":"1f648b7b-962e-4888-ae17-5b08e458f425","resolution":{"observed_at":"2026-05-25T17:37:05.773711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.12573","last_updated":"2019-10-14T19:55:15Z","snapshot_observed_at":"2026-08-14T19:08:57.554303Z","submitted_at":"2018-05-31T17:29:25Z","title":"Learning a Prior over Intent via Meta-Inverse Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"1805.12573","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1805.12573","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning a prior over intent via meta-inverse reinforcement learning","venue":null,"work_id":"4a706bcd-dbf8-445f-8d8c-35b4b3c03f08","year":2018},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"cited_paper":"/paper/1805.12573","citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:8ce8994e3c67cdcfa335a002db33c1e0e0a70105a92f88b4f73c0896d5eef7c4","observation_id":"b36a48f2-a461-4f32-9728-0737055dbcde","resolution":{"observed_at":"2026-05-25T17:36:05.746471Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7c61cc00-d46a-4caa-96f0-1278be1ee070","year":2014},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:a8b1b4bf7cbd42f47e01bc3ac036a233080acf467ed43f3e8fe5d74ee15c3812","observation_id":"a4a2fe69-97b4-4d29-b5f0-32e14b136c93","resolution":{"observed_at":"2026-05-25T17:37:05.766595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"D., Maas, A","venue":null,"work_id":"4806e5ca-f980-4ebb-b6d5-2bc5e2c75764","year":2008},"citing_paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-25T17:33:56.918863Z"},"links":{"citing_paper":"/paper/1906.09624"},"observation_digest":"sha256:0b3bbda24efa4b96ca9dc6cd1b301701acb45e17caa53a5c753e804f1af78924","observation_id":"24f237e6-58b5-48dc-99c6-42b6b278deca","resolution":{"observed_at":"2026-05-25T17:37:05.770074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1906.09624","last_updated":"2019-06-23T18:41:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T15:08:36.986350Z","submitted_at":"2019-06-23T18:41:31Z","title":"On the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":6,"verified_fuzzy":25},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 2 inbound Pith citation observations for arXiv:1906.09624."}