{"as_of":"2026-08-20T15:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bdb45f2009b5031632d49e8f5edfd5fe96e8755d58096bb90709010e2c3a6ea8","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:20:49.524942Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.10151/citation-record","integrity":"/paper/2505.10151/integrity","json":"/paper/2505.10151/citation-record.json","paper":"/paper/2505.10151"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.772670Z","title":"A survey of demonstration learn- ing,","venue":null,"work_id":"83666ac3-4a07-439c-b42c-e2e9113c4eb8","year":2023},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.457423Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:a7a01c7bf1d1bf2ddbe4e21352c02a65a9d59e4c74afc66853a6c7b005c9506b","observation_id":"fab6465b-5489-4f14-9553-1c9a66e5b8ad","resolution":{"observed_at":"2026-08-15T21:20:49.776554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.760874Z","title":"An algorithmic perspective on imitation learning,","venue":null,"work_id":"c769e0c7-cc8e-4e71-970c-26ccf1c569fc","year":2018},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.461759Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:1442559be2e761f50caf58146fad6363a7c0993a6214e9e66368565e998d0cbb","observation_id":"a0473a5d-3524-4155-9722-5270bb3de240","resolution":{"observed_at":"2026-08-15T21:20:49.764492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.749566Z","title":"How can everyday users efficiently teach robots by demonstrations?","venue":null,"work_id":"5248d0bb-5aba-4333-8246-bd8d66bf6fa8","year":2023},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.465344Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:f7d9f456d4d87dcc501a911ce54899e9452a6baba8f0217734aab711d00b4fd5","observation_id":"3d93bc03-f1f0-4144-8f77-1bc21c468f73","resolution":{"observed_at":"2026-08-15T21:20:49.753040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.737983Z","title":"Using machine teaching to boost novices’ robot teaching skill,","venue":null,"work_id":"2c2f4602-fcd5-4ac9-9f31-c8674e8f39c7","year":2024},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.469342Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:f0455a6ec0106036fba46a507cd15d6d85d9e355a1c2a46a23095a1496a968f6","observation_id":"de6544aa-23e7-460d-b126-9989be965878","resolution":{"observed_at":"2026-08-15T21:20:49.741618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.725698Z","title":"When should we prefer offline reinforcement learning over behavioral cloning?","venue":null,"work_id":"f8b6c943-60be-4ee1-b787-e85a9218d806","year":2022},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.473368Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:5e66e6fc923125318248c25c3048a4128da5570993f7dd5346b21324ac874ce3","observation_id":"5d32237d-abc9-4e21-8eb0-23d49c916353","resolution":{"observed_at":"2026-08-15T21:20:49.729841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.712064Z","title":"Where machines could re- place humans-and where they can’t (yet),","venue":null,"work_id":"fec8bce8-6ed0-4661-97fb-293ea1901640","year":2016},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.477355Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:83c15e1e5f00f2b716525535fa5801220f6be696380a85b6eea583a9d575b4c0","observation_id":"13ad6d3c-59b4-41a0-9d27-48281d9f41b9","resolution":{"observed_at":"2026-08-15T21:20:49.716650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.698760Z","title":"Artificial intelligence and work: A critical review of recent research from the social sciences,","venue":null,"work_id":"422aada3-4470-4b35-a112-374d6204e555","year":2022},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.481433Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:457d8fdb554952f7e47e067895cf923fb428f9879244962dde425c369e39d6e4","observation_id":"7dfedc2f-28f3-4b29-a41c-d4571079989b","resolution":{"observed_at":"2026-08-15T21:20:49.702870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.686034Z","title":"Ai, robotics, and the future of jobs,","venue":null,"work_id":"93e3439f-bafa-41fb-a3cf-8de9a599c121","year":2014},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.485147Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:3711b22039a6e376024f43d9366e7860fef508e276a5ee33a11614abe4b7abef","observation_id":"ce79350c-b6d9-4edf-8ef6-a8058a64e666","resolution":{"observed_at":"2026-08-15T21:20:49.690110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.05927","last_updated":"2018-01-18T03:53:56Z","snapshot_observed_at":"2026-08-14T19:54:11.576186Z","submitted_at":"2018-01-18T03:53:56Z","title":"An Overview of Machine Teaching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.05927","snapshot_observed_at":"2026-08-15T21:20:49.489374Z","title":"An overview of machine teaching,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.489374Z"},"links":{"cited_paper":"/paper/1801.05927","citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:b587f485eb15a34c46a64b0484b64a21df60c6e46ecd03fd93f28dfc9b531769","observation_id":"fa767e03-5d89-422d-a13f-828790dede54","resolution":{"observed_at":"2026-08-15T21:20:49.489374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.672651Z","title":"Least-squares policy iteration algorithms for robotics: Online, continuous, and automatic,","venue":null,"work_id":"0fc4944f-0d92-4823-873b-7281ec7dd3b1","year":2019},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.493380Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:eb039488ad4254155a5f20c752cc8bd6ddf10e769e4dcf3002661c4656fb65b4","observation_id":"8566d782-fa0e-4e36-be7c-e8d3821b875e","resolution":{"observed_at":"2026-08-15T21:20:49.677275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.659766Z","title":"Locally weighted least squares policy iteration for model-free learning in uncertain environments,","venue":null,"work_id":"c9df6820-5fb4-4ff5-b582-7a30e444485e","year":2013},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.497064Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:70cf087e774aede7b03a7785dac20d3d26bee73e267744f1c6d6d467c9fa5bd6","observation_id":"bcdf8e0e-d600-4688-ac4f-6bb8b7d26f4e","resolution":{"observed_at":"2026-08-15T21:20:49.663974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.647733Z","title":"The teaching dimension of linear learners,","venue":null,"work_id":"6b9329d4-5743-4335-af6f-ecb626cff769","year":2016},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.500655Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:39fb505d02bdcdea07536fc3b71e6b1a1c71ea3fe1d1c34244c26c4f598cb6f3","observation_id":"1740758e-fb04-462b-aa2a-63bc33429e43","resolution":{"observed_at":"2026-08-15T21:20:49.651547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.504106Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.504106Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:7794b00c00e4bf9fd3a02553262aeb344b7e110012eed1b70bafbb39786748a8","observation_id":"8586b3d3-00cc-4cae-bff0-7be9ec709418","resolution":{"observed_at":"2026-08-15T21:20:49.504106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.626692Z","title":null,"venue":null,"work_id":"4ee28d37-cdbb-4251-b44d-f150b1ffa793","year":2000},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.507906Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:347d111dfeca29655b4a80384bb32f1fe9fd1b2e8b2bd6d9a6bd3ba3b222d4db","observation_id":"5b1aa9dd-06e6-4854-84e0-49ba7d619d8c","resolution":{"observed_at":"2026-08-15T21:20:49.630636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.614182Z","title":null,"venue":null,"work_id":"8ea946f8-aed8-4df0-b36e-e165ab18bfde","year":1988},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.511509Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:5782af5f6e031752400a59e37f8d78c153dd7a2a504b41aeadf07e21d2ad3b37","observation_id":"0070a10b-c597-4142-8f8a-c467a7c02bc6","resolution":{"observed_at":"2026-08-15T21:20:49.617789Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.601462Z","title":"A taxonomy of mixed reality visual displays,","venue":null,"work_id":"dc55090e-1929-425f-8421-7939bf6ba11c","year":1994},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.514945Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:a3744d465e7bb663e94077e6da018030b7ec342a83eea0bca6e612491963cce9","observation_id":"5b408ec6-884a-45ed-b422-bfa0c5dd2add","resolution":{"observed_at":"2026-08-15T21:20:49.605083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.589877Z","title":"How do humans teach: On curriculum learning and teaching dimension,","venue":null,"work_id":"39c5fa00-5099-4b8c-b4a0-f93b55d6cca9","year":2011},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.518163Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:2824dacb939596e15c384a98cb5fc1728552d12db664af242f7b6e4830abaaf8","observation_id":"541f4c8c-c008-4a38-9b17-cc1dd4388171","resolution":{"observed_at":"2026-08-15T21:20:49.593634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.577848Z","title":"Curriculum learning,","venue":null,"work_id":"c0f1f8d0-d776-48b2-886c-4c945904982b","year":2009},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.521552Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:343fcfcc37280d5578a0db5801a2f133f0c37473f7b64f5e53807c3e64975fd4","observation_id":"b00b1ef2-b393-4509-bf01-d523b3fc5145","resolution":{"observed_at":"2026-08-15T21:20:49.581713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:20:49.563737Z","title":"LQR-trees: Feedback motion planning on sparse ran- domized trees,","venue":null,"work_id":"fb24e7fd-c247-4d75-98fc-d1addc9f2d4e","year":2009},"citing_paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:20:49.524942Z"},"links":{"citing_paper":"/paper/2505.10151"},"observation_digest":"sha256:2e1e7f43549a4cd1705c17340ec9f2216086de00451a67014c346ac91a780cbb","observation_id":"80a4f14b-711e-4372-b97d-34888a808bc6","resolution":{"observed_at":"2026-08-15T21:20:49.569583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.10151","last_updated":"2025-05-15T10:23:56Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T21:13:07.887141Z","submitted_at":"2025-05-15T10:23:56Z","title":"Training People to Reward Robots"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2505.10151."}