{"as_of":"2026-08-12T08:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53fce9609374dfb3fcd89f1b7cebd25da29e535d434e01f25528c7448ebf6e05","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T04:00:47.056185Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08647/citation-record","integrity":"/paper/2607.08647/integrity","json":"/paper/2607.08647/citation-record.json","paper":"/paper/2607.08647"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-642-00982-2_1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URLhttps: //doi.org/10.1007/978-3-642-00982-2_1","venue":"Lecture notes in computer science","work_id":"13ea27f4-e2e2-4fea-9f79-d974ef3a7368","year":null},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:fe84566b5a4332fa96ae148ff574afafb72217c46c9491d7753db148e26a80f5","observation_id":"208e9110-1738-43dc-8668-0ea9739d0691","resolution":{"observed_at":"2026-07-10T04:06:44.494310Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-17T21:51:25.054703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T21:51:25.054703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.09712","last_updated":"2020-03-21T17:53:26Z","snapshot_observed_at":"2026-08-12T05:25:02.320874Z","submitted_at":"2020-03-21T17:53:26Z","title":"Understanding the Power and Limitations of Teaching with Imperfect Knowledge","version":1},"cited_work":{"arxiv_id":"2003.09712","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.09712","snapshot_observed_at":"2026-07-10T04:06:44.794035Z","title":"Understanding the Power and Limitations of Teaching with Imperfect Knowledge","venue":"cs.LG","work_id":"6e03c4bc-5bbe-472b-b3fc-b2533a83402d","year":2020},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/2003.09712","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:9e3698652c761e0ea9dfa72506f713657db0eef5e4e439a806830b3c96c86c8e","observation_id":"724bce8f-8f9f-4345-bdfe-4a3af69c8bed","resolution":{"observed_at":"2026-07-10T04:06:44.795817Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.11248","last_updated":"2018-08-13T18:33:24Z","snapshot_observed_at":"2026-08-10T07:11:22.809789Z","submitted_at":"2017-10-30T21:22:28Z","title":"Learning Robust Rewards with Adversarial Inverse Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1710.11248","doi":"10.48550/arxiv.1710.11248","metadata_source":"pith","pith_arxiv_id":"1710.11248","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning Robust Rewards with Adversarial Inverse Reinforcement Learning","venue":"cs.LG","work_id":"2564d6da-3b91-484b-8a81-b84704794698","year":2017},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/1710.11248","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:11b87cea87c3e7fda9c1c48e6723e6455c2e606d0ee67d4e6dcda1c0c5251222","observation_id":"89ae9dcb-9b29-4a60-bfdc-084100c778b2","resolution":{"observed_at":"2026-07-10T04:06:44.799707Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.254217Z","title":"The effect of modeling human rationality level on learning rewards from multiple feedback types","venue":null,"work_id":"2747165b-84b3-4d25-9aa6-5d7009ea9d39","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:8eedc53495579979ea1023792b9a49f4e13e9216d739008e98c8c2b8ac834797","observation_id":"0cfe838c-0d66-413a-bbbf-cf1ecf6df5d8","resolution":{"observed_at":"2026-07-10T04:06:45.255728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09884","last_updated":"2021-11-18T18:59:33Z","snapshot_observed_at":"2026-08-05T03:44:29.148008Z","submitted_at":"2021-11-18T18:59:33Z","title":"Assisted Robust Reward Design","version":1},"cited_work":{"arxiv_id":"2111.09884","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.09884","snapshot_observed_at":"2026-07-10T04:06:44.785062Z","title":"Assisted Robust Reward Design","venue":"cs.RO","work_id":"81f90cf0-03e1-4dc2-8f07-6c8940ac6889","year":2021},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/2111.09884","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:3195036d66937c527d0d99e81bdc9e92ea29c4e1b830e7be4083ae944f628d38","observation_id":"4bbd38d5-4249-47c0-bb47-2893f642f869","resolution":{"observed_at":"2026-07-10T04:06:44.786673Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.11867","last_updated":"2019-06-05T21:51:13Z","snapshot_observed_at":"2026-08-07T03:33:40.602047Z","submitted_at":"2019-05-28T15:03:14Z","title":"Interactive Teaching Algorithms for Inverse Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1905.11867","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.11867","snapshot_observed_at":"2026-07-10T04:06:44.791180Z","title":"Interactive teaching algorithms for inverse reinforcement learning","venue":"cs.LG","work_id":"67d5d17e-f48d-4eef-bf9e-f98ff4a53916","year":2019},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/1905.11867","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:8be5b2d16799f2c622ae690c6c693d21a01230d9afa3f6dd6b9f47dce309b0af","observation_id":"eab54314-22fd-4d18-8bc3-a2d7e765b742","resolution":{"observed_at":"2026-07-10T04:06:44.792911Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3623384","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mehta and Dylan P","venue":"ACM Transactions on Human-Robot Interaction","work_id":"e762a788-d67a-482b-ab6b-d9880bd0a0ac","year":2024},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:61deebfbb6d3ac8bf59541e23035d5bdffc3f7e485899f6d6b52cf8962273b0f","observation_id":"165abf34-3469-4981-a613-e4638b6b1fc0","resolution":{"observed_at":"2026-07-10T04:06:44.496762Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-17T21:51:25.561921+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T21:51:25.561921+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03515","last_updated":"2025-01-07T04:17:15Z","snapshot_observed_at":"2026-08-12T06:34:52.722705Z","submitted_at":"2025-01-07T04:17:15Z","title":"Effects of Robot Competency and Motion Legibility on Human Correction Feedback","version":1},"cited_work":{"arxiv_id":"2501.03515","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.03515","snapshot_observed_at":"2026-07-10T04:06:44.787718Z","title":"Effects of Robot Competency and Motion Legibility on Human Correction Feedback","venue":"cs.RO","work_id":"751fe732-7a69-4483-820c-ed7516267c69","year":2025},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/2501.03515","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:6416bc0265a07d0d786020a285cbe74d4a156ffe4a17e5b909b698a11c7938e3","observation_id":"f31d1d4c-ea9e-4b6a-856b-c57a00822c25","resolution":{"observed_at":"2026-07-10T04:06:44.789465Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.05927","last_updated":"2018-01-18T03:53:56Z","snapshot_observed_at":"2026-08-04T11:16:37.582177Z","submitted_at":"2018-01-18T03:53:56Z","title":"An Overview of Machine Teaching","version":1},"cited_work":{"arxiv_id":"1801.05927","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.05927","snapshot_observed_at":"2026-07-10T04:06:44.801053Z","title":"An Overview of Machine Teaching","venue":"cs.LG","work_id":"b50a2a87-b8af-4dd1-b5cf-94509fd0b38d","year":2018},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"cited_paper":"/paper/1801.05927","citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:de9076a4dee7ab4e343d0d52df2509331c5ce9ef8718cc505810f75210daf971","observation_id":"05e0804c-f802-43d4-803d-94241f7b81be","resolution":{"observed_at":"2026-07-10T04:06:44.803111Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.252353Z","title":null,"venue":null,"work_id":"6df9f929-4c2a-4cce-bd85-42853c8f9960","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:42cef90b6200602aeae593f1fc8e9c7ff6db770f5778ee210a1b8f07ed2f2c4b","observation_id":"395203d5-155b-44ed-8db4-dd4d596c1fd9","resolution":{"observed_at":"2026-07-10T04:06:45.253692Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.248644Z","title":null,"venue":null,"work_id":"341ffb3f-8468-4bf8-acf1-d3c782d84bbc","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:bd257dc89877e979f738a7eaa75e2fe55a59142b1154854a9f3e990f58713c47","observation_id":"db90686e-f1e6-4046-9935-59cf7cb9866c","resolution":{"observed_at":"2026-07-10T04:06:45.250108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.245037Z","title":"We use2×3gridworlds with two cell features (drawn gray and white) and a randomly placed terminal cellTthat may occupy either feature","venue":null,"work_id":"a302d248-994b-4cfc-abe3-7a6fd267771f","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:754213cf83b7d065b2cf0248ba48e715d220a8123ed3fa79bc55f3e268b0b0d6","observation_id":"f4b88810-7a0b-417d-ab89-bd2594532659","resolution":{"observed_at":"2026-07-10T04:06:45.246599Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.247067Z","title":null,"venue":null,"work_id":"8c6bcc14-86cb-430e-8adf-38e64bfff328","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:8a572f43c90d894ab9ff3dd18699ac31d874cf32c9089ff6a3bceff5aebdd0d9","observation_id":"8a7cab3b-aa36-43cc-a292-133c09631019","resolution":{"observed_at":"2026-07-10T04:06:45.248495Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:06:45.250541Z","title":"S1) 2:Restrict candidate atoms to those in environmentsK 3:D←Greedy Atom Selection(K,U)(Alg","venue":null,"work_id":"b54ed0c7-e538-415b-8411-a2e789690dd7","year":2026},"citing_paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-10T04:00:47.056185Z"},"links":{"citing_paper":"/paper/2607.08647"},"observation_digest":"sha256:f29470e870459e2b3a7286560c9b136eed2d425b6ee829eec8bdeb22fa22e88e","observation_id":"5a762f50-e6a9-4847-9796-477fb4079fb4","resolution":{"observed_at":"2026-07-10T04:06:45.252086Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.08647","last_updated":"2026-07-09T16:18:16Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T08:41:43.452519Z","submitted_at":"2026-07-09T16:18:16Z","title":"Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":4,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":1,"verified_exact":6,"verified_fuzzy":1},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2607.08647."}