{"as_of":"2026-08-23T23:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4638605b184f6e8d62c3a0882d1785660704ca40b5426f5f29f6f42ec939ce88","coverage":[{"denominator":185,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:21:38.978074Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.20573/citation-record","integrity":"/paper/2412.20573/integrity","json":"/paper/2412.20573/citation-record.json","paper":"/paper/2412.20573"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.348592Z","title":"Value preserving state-action abstractions","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.348592Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:0a9ff73d1c83b3519ba5008651253b948ff7cee6369b29d0094f2b942e386c44","observation_id":"1b56ea0d-5202-4ba8-b5fa-68aee91a4e98","resolution":{"observed_at":"2026-08-10T23:21:38.348592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.363234Z","title":"Andry, P","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.363234Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:7a16d1b9dfa421f86ae82bb18786c84d5e4d6ab2af62168a1a0bbee9055de350","observation_id":"b711d206-4b16-4956-b3f7-3a1d19c461d2","resolution":{"observed_at":"2026-08-10T23:21:38.363234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.377740Z","title":"Prerequisite structure discovery for an intelligent tutoring system based on intrinsic motivation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.377740Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:9d774b48dbb50a85d98e3fe2b1a481ce642ec9728b3367c1bcddce3ff11b4f57","observation_id":"d8b3505b-dbc9-40d4-9339-6e8614658f22","resolution":{"observed_at":"2026-08-10T23:21:38.377740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.383311Z","title":"Unsupervised motion retargeting for human-robot imitation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.383311Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:53dc0dfa9b0deb455b9ce2a464631146dfec97a6103714b6ba3a5283aa9d71d4","observation_id":"199ee879-f92a-40ed-88d7-f0275db13dc1","resolution":{"observed_at":"2026-08-10T23:21:38.383311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2014.23262","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:43.080964Z","title":"A computerized recognition system for the home-based physiotherapy exercises using an rgbd camera","venue":null,"work_id":"f79dc042-c3f9-4b3c-ab29-7c496f94d921","year":2014},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.388929Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:f255073628d82b26273bef6ee1c99ed8d449f169ad54a3018660185e28ce4540","observation_id":"9957cc68-7eff-426a-b75f-bd9ccb21b431","resolution":{"observed_at":"2026-08-10T23:21:43.088075Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.394288Z","title":null,"venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.394288Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:f335c37510b0e7ee5fb135b1a5a9d37eb3b392a84a450a15b94c58025888c08a","observation_id":"99e6772f-9d2a-4eec-a9eb-7e665bbf1dde","resolution":{"observed_at":"2026-08-10T23:21:38.394288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.397961Z","title":"Argall, Sonia Chernova, Manuela Veloso, and Brett Browning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.397961Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:d5837d8eefc23457b18103492b5a8c1a1f5c226c3c9813187050f86b4e2093b1","observation_id":"37a420ff-9069-42b6-b292-5caeac133898","resolution":{"observed_at":"2026-08-10T23:21:38.397961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.401706Z","title":"Argall, B","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.401706Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:7b75d783f133c4522e47411f073517435ba1ee613a33839d674e333ffe95d006","observation_id":"25e46aa2-6087-4398-8f89-142967e66083","resolution":{"observed_at":"2026-08-10T23:21:38.401706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.407145Z","title":"A survey on interactive reinforcement learning: Design principles and open challenges","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.407145Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:376e402269fbdac2202903d02986b31d7f566e9e08eabf86fafb1af042afd9c9","observation_id":"7aaad3ec-0c63-4d24-bc94-fa312f5de39b","resolution":{"observed_at":"2026-08-10T23:21:38.407145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0921-8890(01)00157-9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.867198Z","title":"MacDorman, Hiroshi Ishiguro, and Yasuo Kuniyoshi","venue":null,"work_id":"dde6f7e5-6d79-441e-9779-ce57e5284874","year":2001},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.412093Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:8d1ac1c2a2f142ac779be94b889b1c640d0071ce1ff04ab28378bf76178346cc","observation_id":"11a68608-195e-4310-96a1-1593a6eddaba","resolution":{"observed_at":"2026-08-10T23:21:39.871734Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.417295Z","title":"Cognitive developmental robotics: a survey","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.417295Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:65ba171a19864cd1509d4ad27aac899a62c9c0134f97efefc841d3a5f90584d1","observation_id":"561754fa-0123-4806-af09-d816b45871ea","resolution":{"observed_at":"2026-08-10T23:21:38.417295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.422536Z","title":"Online human activity recognition employing hierarchical hidden markov models, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.422536Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:e2c71f36706e278490432fac69aeda0fe7a6e48eac7a114d1a79ce9ffe8c77c0","observation_id":"20094c07-fae9-435e-b6b7-99fcf29c6383","resolution":{"observed_at":"2026-08-10T23:21:38.422536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.428099Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.428099Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:61a82782a0cc40e4b67f50a249427a19ac5d90f66b4eacd6f7092580effb2438","observation_id":"e9dc2ada-25a8-4e13-88d5-c22859f4054a","resolution":{"observed_at":"2026-08-10T23:21:38.428099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.432684Z","title":"Social learning theory, 1971","venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.432684Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:267f224ea1f5462c0481d51f3dd381fa4b9e333891bf072cba19df1d3601fa78","observation_id":"16b58725-60f8-4cbf-b37c-9be383ebb436","resolution":{"observed_at":"2026-08-10T23:21:38.432684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.437190Z","title":"Barto and Sridhar Mahadevan","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.437190Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:a467e1f8716bb1173f5e9d046595fe8b1826d04c49d75823f649bf879cc0a515","observation_id":"e4bc3a2f-b0aa-4441-9232-eafe46bb6402","resolution":{"observed_at":"2026-08-10T23:21:38.437190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.441386Z","title":"Behavioral hierarchy: exploration and representation","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.441386Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:fabe86e935cb93e5bb2251b46121a697512608a46a09688504864e820ec2f208","observation_id":"5e3d3227-a5ea-42a9-bd14-a333f9507cce","resolution":{"observed_at":"2026-08-10T23:21:38.441386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-77182-3_2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-13T11:03:48.094449Z","title":null,"venue":null,"work_id":"5ef451f4-4e30-4490-b78e-3ffa2e8e6839","year":2018},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.445733Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:d71ecb84b2bcc45efcee1a672076578fc4ab67c8a987ebee1c76287cede6879e","observation_id":"0835a0e7-a4a0-4ac9-b2f5-0ab94656a583","resolution":{"observed_at":"2026-08-10T23:21:39.848789Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1073/pnas.1603261113","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.829145Z","title":"Infants' preferences for native speakers are associated with an expectation of information","venue":null,"work_id":"0005ab0c-1b75-40db-bed9-70e480b71180","year":2016},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.449445Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:92326ed097bccd0c0574ccafbbe2ce56669e86749a4b0a08f5cf03c9390ef2d4","observation_id":"4f4cf086-de30-4738-9027-4fe333493367","resolution":{"observed_at":"2026-08-10T23:21:39.834198Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.454041Z","title":"Curriculum learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.454041Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:0100ae86ee6864235cb5a19be7310217a9425c32caf1b24f4b6447bd4bbde9c2","observation_id":"da412e14-f920-4f57-ac29-b4acacd89a1b","resolution":{"observed_at":"2026-08-10T23:21:38.454041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.458713Z","title":"Siegward","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.458713Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:37b62e1e05ad7d2dd68874cb9d2d4650ff48b657bf3717133b148f7e18043279","observation_id":"3a9f69c5-f7e3-4f61-bf73-d43dd4ce68a1","resolution":{"observed_at":"2026-08-10T23:21:38.458713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.463207Z","title":"Handbook of Robotics, chapter Robot Programming by Demonstration","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.463207Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:8ad841ac456a8794fb564d0e322646a11a9f143cd04cd4bb031f2d74de92339a","observation_id":"0a249c39-ba50-44ee-987e-7f3a7d41d831","resolution":{"observed_at":"2026-08-10T23:21:38.463207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1155/2022/5667223","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.816157Z","title":"Technical feasibility of supervision of stretching exercises by a humanoid robot coach for chronic low back pain: The r-cool randomized trial","venue":null,"work_id":"8868c1f5-ada7-4477-8350-a7762793878e","year":2022},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.468345Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:5bc7d3108ac3f52d70bbecbfc3215224f46f895acae870ba190822618bd23231","observation_id":"d3a2cf66-a007-45ac-800c-83846e077077","resolution":{"observed_at":"2026-08-10T23:21:39.820726Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3233/faia241075","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.803268Z","title":"Generative Pretrained Embedding and Hierarchical Irregular Time Series Representation for Daily Living Activity Recognition, pages 4764 -- 4771","venue":null,"work_id":"a7928e4f-ce63-4750-92f3-d7a8f48bf3c2","year":2024},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.473920Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:b1b9478aefb1894f5f3605be28c609231c3c9a65b4aa3202b61d700f26e4fdb7","observation_id":"4df506d3-e0a9-4172-9e1a-6c60571c9799","resolution":{"observed_at":"2026-08-10T23:21:39.807634Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-981-16-0575-8_9","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:08:50.044864Z","title":"Fully convolutional network bootstrapped by word encoding and embedding for activity recognition in smart homes","venue":"Communications in computer and information science","work_id":"7b7233df-1f19-49c0-874b-93cd3916fcaa","year":2021},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.478236Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:2d29795869c09c2d7f4430d18df3007faf9dd1709b8071f159fb05d1ed819753","observation_id":"a514e803-657e-43fe-8e8e-6295e04b7943","resolution":{"observed_at":"2026-08-10T23:21:39.795053Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/electronics10202498","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.775884Z","title":"Using language model to bootstrap human activity recognition ambient sensors based in smart homes","venue":null,"work_id":"0732cbf4-b7e2-488e-8c27-a81b06499702","year":2021},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.482446Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:5fa694e5fdba58e0fa05447510c13747c2b13faf534bfb804ef4023983173b35","observation_id":"fdf99d20-e55b-4546-a109-d0aca29b3143","resolution":{"observed_at":"2026-08-10T23:21:39.780763Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.486550Z","title":"A survey of human activity recognition in smart homes based on iot sensors algorithms: Taxonomies, challenges, and opportunities with deep learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.486550Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:5b00b9c4b922c3a6cfecb07307fc51626a1498ee0c256f4dc7c81ddae7d832e1","observation_id":"f4c441c8-bb8d-44c5-9eeb-c86ac0944743","resolution":{"observed_at":"2026-08-10T23:21:38.486550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.490885Z","title":"What if time, or past context, improved human activity recognition in smart homes? In IEEE ICCE, Da Nang, Viet Nam, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.490885Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:70245090d7d0ed98d0c7cfd2ac8eeaf4015fa99a5f5f4026f1d32260cb0e4b7f","observation_id":"5e717f40-9eb7-43df-8491-de7282a21ece","resolution":{"observed_at":"2026-08-10T23:21:38.490885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/s23177586","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.753327Z","title":"A smart home digital twin to support the recognition of activities of daily living","venue":null,"work_id":"88d395e9-c51a-4316-88c6-b89103173b94","year":2023},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.496101Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:4510a14f0ae48630cd9f0efe7565a96be202cc2ddf1f8dcb5d2cb12f15f82800","observation_id":"566d3568-7a45-4135-bc64-524caf6f58f3","resolution":{"observed_at":"2026-08-10T23:21:39.757834Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5802/roia.53","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.738425Z","title":"Reconnaissance d'activit \\'e s de la vie quotidienne au moyen de capteurs domotiques et d'apprentissage profond: lorsque syntaxe, s \\'e mantique et contexte se rencontrent","venue":null,"work_id":"c7623fdc-70e6-418f-9359-087899d0e643","year":2023},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.499983Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:a30678560820e7584f49bc8b46daf8c625f8a98b18fee074c893eb0c2fc16566","observation_id":"55965de5-641c-47ef-853e-4f0082f81f2d","resolution":{"observed_at":"2026-08-10T23:21:39.744574Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.504562Z","title":"Representation of irregularly sampled time series with generative language models for classification and transfer learning: a case study in activities of daily living recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.504562Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:ce589bd1ff1644f27160a2841c8d56a135efa1123f8ca6c18bb6ad4055b28797","observation_id":"55fd1bb2-7f1d-4a8a-a4a1-7594d44e4fc2","resolution":{"observed_at":"2026-08-10T23:21:38.504562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.509537Z","title":"Scassellati","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.509537Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:d1749bf9849e698173c5451fade1332df137d0437d68183040755caac987b974","observation_id":"bf7a1dfd-92cd-4d0b-9b07-84fc5c7182b5","resolution":{"observed_at":"2026-08-10T23:21:38.509537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.514279Z","title":null,"venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.514279Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:9e37654d85ee06ba3e2d3d8b6dcffd254be51cb3760e92cdbd6a794b4b86818c","observation_id":"136e5176-aecc-4282-86d3-4d7f4ed49566","resolution":{"observed_at":"2026-08-10T23:21:38.514279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.518643Z","title":"Robot Programming by Demonstration: A Probabilistic Approach","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.518643Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:caa7de757e18ae843d7d8c1791d738a2e19266b5cc8f4dc7a566059f46ce38a1","observation_id":"5cbe9cde-fcfe-4d58-9724-4ca75bb2be26","resolution":{"observed_at":"2026-08-10T23:21:38.518643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.522532Z","title":"Call and M","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.522532Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:b20bb99369023050a478ce865ce34dec2831085b6655284d4ad0ff1a7b383b74","observation_id":"2fe035b2-9ed2-4a4a-8957-30bdef712fe5","resolution":{"observed_at":"2026-08-10T23:21:38.522532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7551/mitpress/13780.001.0001","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.725599Z","title":"Cognitive Robotics","venue":null,"work_id":"2f387a26-351e-4492-a210-b7c221c30bef","year":2022},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.526533Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:afc9ab6666a3d7396d4eb7d56974f56d5ea304ea9bce36feb90269e000885cd4","observation_id":"8f447ec1-5c4b-4ad5-97d1-c07fc13c943e","resolution":{"observed_at":"2026-08-10T23:21:39.729910Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.531541Z","title":"Developmental robotics: From babies to robots","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.531541Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:db3a59343609a370239d84447559cf43b12b6189464b3e2a0d1a7d9362f962d2","observation_id":"014230e1-1cd5-4de0-9df0-365dec43dd0b","resolution":{"observed_at":"2026-08-10T23:21:38.531541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.535889Z","title":"The kimore dataset: Kinematic assessment of movement and clinical scores for remote monitoring of physical rehabilitation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.535889Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:3271d274e0a00a47e4b04dc26960009b5d64853afbb14162d44c99a408460812","observation_id":"49cf1f1d-7021-455f-96e0-3c107a7041e8","resolution":{"observed_at":"2026-08-10T23:21:38.535889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.539793Z","title":"Interactive policy learning through confidence-based autonomy","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.539793Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:b5c00837e696924d07d5290fcd455c6272f3caa4b7a4365498f9d45631934321","observation_id":"e444881d-76a9-4a0f-bfaf-d8ee03221b66","resolution":{"observed_at":"2026-08-10T23:21:38.539793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.544665Z","title":"Deep reinforcement learning from human preferences","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.544665Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:6765f737265f8f1ca6269992a9b1c7393edc19193d42065746ec25fae2410c00","observation_id":"74c73fc6-8ca2-4f8d-8bb5-8aa8976928fc","resolution":{"observed_at":"2026-08-10T23:21:38.544665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.550138Z","title":"On Integrating Apprentice Learning and Reinforcement Learning","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.550138Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:deebc3015dff0dcdd7bf3aa274a19d76ef645b9c6486ace01d9e5d8d06fa72c1","observation_id":"8a889890-f8ac-4db7-9220-736bc6d5123c","resolution":{"observed_at":"2026-08-10T23:21:38.550138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.555370Z","title":null,"venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.555370Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:6d515ed385eafca05316c1e8ae0c3656fdde6b02bfa369b2cfaffaac5b1e9cda","observation_id":"b45bec11-85d7-4dea-a15c-db6e5d2cda7d","resolution":{"observed_at":"2026-08-10T23:21:38.555370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.559605Z","title":"CURIOUS : Intrinsically motivated modular multi-goal reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.559605Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:e21667c1d9fe31d617cf602ad075ec4a1520f83b7a8bfefdad47cdd2d91a79b7","observation_id":"380c3863-c32a-4115-a5ab-6e04f4b93b26","resolution":{"observed_at":"2026-08-10T23:21:38.559605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.564633Z","title":"Casas: A smart home in a box","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.564633Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:845f37b4590556c55804fec0af8576793b8da1911d8dcdfdebc18dcdcfb0db26","observation_id":"4dc0cfa6-58dc-4f14-8255-8f33445ec3f7","resolution":{"observed_at":"2026-08-10T23:21:38.564633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.569300Z","title":"Teleological and referential understanding of action in infancy","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.569300Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:c81a962e1f9b39551e26f0d6dbc5e15c1fa6875a4cd9df47335e591b99ed04af","observation_id":"5142942d-368c-4416-88c2-bc752e163e99","resolution":{"observed_at":"2026-08-10T23:21:38.569300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.573088Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.573088Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:9dd0bd279ac10e717cecc62ef8cac14da04651c429caa91d3df0af0b2a8184c8","observation_id":"a502c1e6-7238-4f85-94dd-a5841b221bce","resolution":{"observed_at":"2026-08-10T23:21:38.573088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.576966Z","title":"Kaspar--a minimally expressive humanoid robot for human--robot interaction research","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.576966Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:03c306a0f66b47efa8241ec47f0df7f3ec3b1195588aa4ffceadd6a102b9f428","observation_id":"4a26c035-332b-40ba-9b46-03185b2c0e19","resolution":{"observed_at":"2026-08-10T23:21:38.576966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.580696Z","title":"Feudal reinforcement learning","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.580696Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:6a816a211d92a0d1d9ea9566b7c82edc21dae9c2eee708315f8b9bc5b6f720da","observation_id":"f0fe6e6a-46c2-45f8-8d00-72c8c093d553","resolution":{"observed_at":"2026-08-10T23:21:38.580696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.585626Z","title":"Multi-level motion analysis for physical exercises assessment in kinaesthetic rehabilitation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.585626Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:802ab02f1919408e992ea96d01d70c9d911de8cead21362300a597532be346e7","observation_id":"b33086f7-ce58-4e6d-be04-770699771fea","resolution":{"observed_at":"2026-08-10T23:21:38.585626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-11012-3_15","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:03:20.376878Z","title":"Generating shared latent variables for robots to imitate human movements and understand their physical limitations","venue":"Lecture notes in computer science","work_id":"cd79b928-2ded-4b87-af46-eea8a23aa032","year":2018},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.590330Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:3f568203ba35af02e41f6cd1c5527aba3587ccb8bb3f1b0cd43c4e1c75584ae2","observation_id":"65cdc3b7-d725-43c4-b210-11aeab0c69a2","resolution":{"observed_at":"2026-08-10T23:21:39.717500Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.596188Z","title":"A co-design approach for a rehabilitation robot coach for physical rehabilitation based on the error classification of motion errors","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.596188Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:511e32489e384ce9308b5bb84b573cf59b77ed702a95d238487fc35ba9d8a27f","observation_id":"9867f845-44e9-4ffa-b042-186884d43bb0","resolution":{"observed_at":"2026-08-10T23:21:38.596188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.89144","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:42.426010Z","title":"Recognition of activities of daily living via hierarchical long-short term memory networks","venue":null,"work_id":"a2627ef3-0ffb-44b5-be55-8664c5c64b12","year":2019},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.600513Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:65df289798be918066deb76ee1710bd2c790cddc0effd1089be79c3a2c3d227c","observation_id":"1de6dd10-2ae1-42cb-9148-367017d75a57","resolution":{"observed_at":"2026-08-10T23:21:42.432710Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.604484Z","title":"The toronto rehab stroke pose dataset to detect compensation during stroke rehabilitation therapy","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.604484Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:f0a3e5b1d29a8e703f6226577ce6c8397db74dc75dc654e905508d40ef1bb226","observation_id":"6f222a46-cdd2-4027-bdb7-33815e2b0321","resolution":{"observed_at":"2026-08-10T23:21:38.604484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.608888Z","title":"Roijers, Beno \\^ t Girard, Nicolas Perrin, and Olivier Sigaud","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.608888Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:853e4a1536823700e7656f27b77d2506695bfc1d5ea4dd5a2bcd6cbd3e5cd9fc","observation_id":"8eb27ec0-781e-43e2-b984-614aba24d60b","resolution":{"observed_at":"2026-08-10T23:21:38.608888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.78468","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:42.162114Z","title":"Strategic and interactive learning of a hierarchical set of tasks by the Poppy humanoid robot","venue":null,"work_id":"065db869-ae78-4f3f-a833-5ace3639ca78","year":2016},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.613310Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:2c075a5775176909c4b9f315118e4bf509952c911d3126dc96fb0dad888c7ae4","observation_id":"ed85afb3-4c3b-4b0c-9e3e-151767028f51","resolution":{"observed_at":"2026-08-10T23:21:42.168621Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.618007Z","title":"Learning sequences of policies by using an intrinsically motivated learner and a task hierarchy","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.618007Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:6629f47eb0bcc9f4eb7f4c5f208f7321d860a42c14cc57a8c6b9a6130c3467e9","observation_id":"1e3e411b-6d1e-4762-a8ae-59fc643031b0","resolution":{"observed_at":"2026-08-10T23:21:38.618007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.622682Z","title":"Effects of social guidance on a robot learning sequences of policies in hierarchical learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.622682Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:d85b07313785c7817ac848367ae9cbc34f1e36997dd1682e5c9252e7c22ce171","observation_id":"68fcde28-f2f1-486f-b929-35f5e12cf60e","resolution":{"observed_at":"2026-08-10T23:21:38.622682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.630266Z","title":"Learning a set of interrelated tasks by using sequences of motor policies for a strategic intrinsically motivated learner","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.630266Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:dd67fe4e7f11eafe0b29a513fcba180493efaea41b58913edb893ea4443f488c","observation_id":"508ca71d-ed73-4b04-90ae-2375d4fe50ac","resolution":{"observed_at":"2026-08-10T23:21:38.630266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.636030Z","title":"Learning a set of interrelated tasks by using a succession of motor policies for a socially guided intrinsically motivated learner","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.636030Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:6d62788a1a7ed26453de784d52d7b204f0d869660be7c3f6ba92bb8f17f49ed7","observation_id":"80c4ff54-cc2c-4eb7-a8a8-525431091c0b","resolution":{"observed_at":"2026-08-10T23:21:38.636030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.640503Z","title":"Intrinsically motivated open-ended multi-task learning using transfer learning to discover task hierarchy","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.640503Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:328dea336ee477cd00b3545e01f3f486e8add715bd6745cc85b3138542e0d761","observation_id":"1bf101da-6d3a-4289-9918-d74da0c4fda5","resolution":{"observed_at":"2026-08-10T23:21:38.640503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.645207Z","title":"How the mind creates structure: Hierarchical learning of action sequences","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.645207Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:eaba64e670b73f01be0c818905fb0373b5a08642df046b36a59fddd38bddd499","observation_id":"5e624ed8-c87c-4169-9445-8f7382f75bf4","resolution":{"observed_at":"2026-08-10T23:21:38.645207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.650848Z","title":"Search on the replay buffer: Bridging planning and reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.650848Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:0a4eb54f594a301b641eb170f340ff25ad0d7eba859b2b50ea8d670090862070","observation_id":"25182d42-17f7-43b2-acc1-f925490ce16d","resolution":{"observed_at":"2026-08-10T23:21:38.650848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.00267","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:41.841430Z","title":null,"venue":null,"work_id":"3381b630-9309-4a85-b4b5-7c24973e2f83","year":2016},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.656567Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:764e9d0440717247b9899830f299cbd8437ea6ee695724399359b7e4b481a7d2","observation_id":"507db700-69b5-4cf4-aa72-e22c9b2e5b5b","resolution":{"observed_at":"2026-08-10T23:21:41.853107Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.660776Z","title":null,"venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.660776Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:bd8438f64dbe438478ee11f432cb7fc27779c5d7b6de2a7e67a7185ade85f98f","observation_id":"df25dbaa-c13d-4161-88ee-ec17fbb50294","resolution":{"observed_at":"2026-08-10T23:21:38.660776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.664535Z","title":"Clic: Curriculum learning and imitation for object control in non-rewarding environments","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.664535Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:a167c46d15de6a623b95704a16ecb07bc907ffd3f008de7ab7a1d11b830f50c1","observation_id":"30659cdb-bdaf-4dcb-bdc1-0587738e4734","resolution":{"observed_at":"2026-08-10T23:21:38.664535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.827630Z","title":"El-Yacoubi, and Ons Jelassi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.827630Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:759131e8c8f39d0068bbff566fe2bc362a2e8e74bbfc3a5d2ea372c1d1eb383c","observation_id":"66dffd5a-0c92-4156-b80e-81b8e4df0eca","resolution":{"observed_at":"2026-08-10T23:21:38.827630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.832359Z","title":"El-Yacoubi, Eric Fenaux, and Stephan Clemencon","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.832359Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:fcceaec67b90605a1cfb8c5947148c2ba2f4cd688a56877eb1ce45a78c82b1fa","observation_id":"1323b569-d5ec-4817-8f39-d05ea5bf5bf5","resolution":{"observed_at":"2026-08-10T23:21:38.832359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.836181Z","title":"Towards deep symbolic reinforcement learning, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.836181Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:0736d63c3284a09bb32d3b231d3b7fcce569e70a40e6217040f0f325203a3f14","observation_id":"0b938948-4f2a-4a44-90ea-a291bdcadae5","resolution":{"observed_at":"2026-08-10T23:21:38.836181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.840416Z","title":"Learning actionable representations with goal conditioned policies","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.840416Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:da58bca739dc6fea7880400ec1d188cd223b5f47e613a19752512e688699c8a4","observation_id":"f80a9365-c30c-4eeb-80c9-75ca705f1bea","resolution":{"observed_at":"2026-08-10T23:21:38.840416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.844412Z","title":null,"venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.844412Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:5d5d48e1379c9f5cb5b34bae5c8bf7bd05bb4dc10687b0ee01eaa26866c0512b","observation_id":"0a62db0b-1201-40be-8170-65285c852e51","resolution":{"observed_at":"2026-08-10T23:21:38.844412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.848614Z","title":"Information-seeking, curiosity, and attention: computational and neural mechanisms","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.848614Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:50b20eca0791420ab831234201fea27d54c8af8477bd54263894bb5fea329b12","observation_id":"158fdb4a-15a3-4117-99fa-21374da2a8b5","resolution":{"observed_at":"2026-08-10T23:21:38.848614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.852908Z","title":"Grafton and Antonia F","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.852908Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:6f7991981696783f7eff49e269240d87228a8f76f3a65f0b738c285f985bb999","observation_id":"f7b0ac00-b79d-417d-9f2c-d74879689ce7","resolution":{"observed_at":"2026-08-10T23:21:38.852908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.857196Z","title":"Evidential fusion of sensor data for activity recognition in smart homes","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.857196Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:d99a8a3423452e3b26a0861e2a1729018899a6ed4ded668ba05c528772d7f098","observation_id":"20712f61-0cdf-47b1-a095-e3921612e1db","resolution":{"observed_at":"2026-08-10T23:21:38.857196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/icaps.v30i1.6750","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.668981Z","title":"McIlraith","venue":null,"work_id":"3bd4ad47-afa4-403d-84f6-283d0297d7ce","year":2020},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.861529Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:2e2d8d1c2ab6f2953506bfdf1faaf005fbfbb6022a73686ae3882d1f6d390059","observation_id":"2a1ba99c-6eeb-46b4-aea1-8ba0a01cd40c","resolution":{"observed_at":"2026-08-10T23:21:39.673021Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2013.22806","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:41.678034Z","title":"Object learning through active exploration","venue":null,"work_id":"1aafc8c7-3bf1-4860-8fd5-0bd0f0a9a055","year":2013},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.865972Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:c1c7fc98e529db06f0a806425e2ae1ce5d44914a59821ea66d8606f07a7d8d61","observation_id":"dde46bdc-ee95-467b-925a-86789b2469c0","resolution":{"observed_at":"2026-08-10T23:21:41.688540Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.869944Z","title":"Bridging natural language and emergent representation in hierarchical reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.869944Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:9aefa2c9357a08bd0fe333cd36887858817cf5e8d0b1cd36310675c81be4dcf3","observation_id":"2b1152a2-f0df-4176-b813-0cab60fcfb61","resolution":{"observed_at":"2026-08-10T23:21:38.869944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.873776Z","title":"Llm to bridge human instructions with a dynamic symbolic representation in hierarchical reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.873776Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:2da7bab44c5660a152aba7f57e4d414e26247c28ff0b038ae256dea3cc3e19cb","observation_id":"c07b29d2-904a-4240-8f17-f46eca8b77d4","resolution":{"observed_at":"2026-08-10T23:21:38.873776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.878299Z","title":"Dynamic symbolic representation and LLM to enhance task abstraction in hierarchical reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.878299Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:2f7c2d8141cdf10a61d8586466c6388b000d059134c9aec990987ad5794b03c8","observation_id":"192df395-5646-4f0e-831c-276ef361cd74","resolution":{"observed_at":"2026-08-10T23:21:38.878299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.883414Z","title":"The body in the mind: The bodily basis of meaning, imagination, and reason","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.883414Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:b54724f3a30a328cb93809110015bd1f79675405876216390d5eec3b823ff72a","observation_id":"c282a45f-dcf2-4954-ba31-99d3e67087f0","resolution":{"observed_at":"2026-08-10T23:21:38.883414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1186/s13034-017-0154-7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.654498Z","title":"Goliah (gaming open library for intervention in autism at home): a 6-month single blind matched controlled exploratory study","venue":null,"work_id":"3d60e29c-0a99-414a-ba2b-689950b6fc11","year":2017},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.887417Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:090a0e36e7b278bcca84ec624e46f47b31f3ac1c3ba144145bbd5de64d226c19","observation_id":"97876def-784c-4a96-b0e5-783698bb3db9","resolution":{"observed_at":"2026-08-10T23:21:39.660522Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.891749Z","title":"Fern, Thomas G","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.891749Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:7b35936826f496421b3edfb5eb40b22701f201727dbced3c4aee0598df45a08c","observation_id":"b8abdcf8-d41e-49d9-842e-df6b5b991a11","resolution":{"observed_at":"2026-08-10T23:21:38.891749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.rasd.2009.11.004","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.640315Z","title":"Mirroring effect in 2- and 3-year-olds with autism spectrum disorder","venue":null,"work_id":"d161a4ed-f899-42f1-b297-b1282c28b215","year":2010},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.896093Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:9969ab71dad4b8ba7afe3fb4b5b8979dbf48d6f3afc1fa5d923ddd01eb017b92","observation_id":"55bc069f-8494-4868-b051-af9dc3ec647c","resolution":{"observed_at":"2026-08-10T23:21:39.645594Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.900217Z","title":"Assessing self-maintenance: activities of daily living, mobility, and instrumental activities of daily living","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.900217Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:d03036ea71945b8aa7248ca3722e189941c788d6c0d9dd0b60c7c1e2b334930d","observation_id":"ea01137e-caa2-491d-8a89-485b0fb9ec66","resolution":{"observed_at":"2026-08-10T23:21:38.900217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.904030Z","title":"e s, Fabrice Gzil, Ben Hicks, Anthea Innes, Sao Mai Nguyen, Louise Nyg rd, Maribel Pino, Guillaume Sacco, Eric Salmon, Henri \\","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.904030Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:2f8da921703d28f89d7f477d72e11057e51a156bcbe4f2a24ad6b2c41f2e9fdd","observation_id":"28309206-0263-4a99-96d3-f4aa6e95a6ed","resolution":{"observed_at":"2026-08-10T23:21:38.904030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-02675-6_46","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-13T11:03:48.094449Z","title":"Bradley Knox, Peter Stone, and Cynthia Breazeal","venue":"Lecture notes in computer science","work_id":"e8e29d4d-428a-41c6-a655-74243a0a5409","year":2013},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.908538Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:932705004343b9afc28fd204ee98e45c27e1c6ca3f923140bcf7d291440b278d","observation_id":"dd2b085e-f32e-4b62-9647-92d0da700503","resolution":{"observed_at":"2026-08-10T23:21:39.630960Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.912917Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.912917Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:89885efad464b748cc852f982840e463f32041951b41677e3c3be0d2d161c1ad","observation_id":"a011e6e4-697e-47e6-8ad3-0d70f3e65010","resolution":{"observed_at":"2026-08-10T23:21:38.912917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0079-6123(06)65024-3","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:39.613101Z","title":"Krakauer and Reza Shadmehr","venue":null,"work_id":"3c1763f7-192f-43a3-8c9a-50ac124db513","year":2007},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.917643Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:031bf168904c6fef3fd508adf57f6b98b6e9d5702d823392e8712f724cac8ba6","observation_id":"cc31fa65-53f5-4a7d-9d99-c036a02758aa","resolution":{"observed_at":"2026-08-10T23:21:39.616965Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.921941Z","title":"Combining social and intrinsically motivated learning for multitask robot skill acquisition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.921941Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:3404227b0b0f5c22db4027c28562574d64dec46bd044e1b0c9033ae82f976855","observation_id":"f2baecb5-66e7-42e5-b0bb-65c8f6418092","resolution":{"observed_at":"2026-08-10T23:21:38.921941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.926108Z","title":"Hierarchical deep reinforcement learning: Integrating temporal abstraction and intrinsic motivation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.926108Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:2f6ef5684bfd86ed132597c9e5010ff4d0214a58edea2ac388d5ed8d01723b5d","observation_id":"12222618-e29e-4310-b6bb-cb4919fee09e","resolution":{"observed_at":"2026-08-10T23:21:38.926108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.930225Z","title":"Benchmarking human motion analysis using kinect one: An open source dataset","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.930225Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:92dafd0b3833ef70b581d419a2f9e3da85e5df80da61a4e3a77e14c42c2e6391","observation_id":"5aa1a6a0-365e-415d-8fbd-cdcc5b5aa2db","resolution":{"observed_at":"2026-08-10T23:21:38.930225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.934075Z","title":"Active hierarchical exploration with stable subgoal representation learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.934075Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:8fd3eb97191122dacd26e4a28c28d1c50286c8286778929fd3b10f5686b986de","observation_id":"adb85eea-fbfd-4072-9768-1a9bee5f5cd5","resolution":{"observed_at":"2026-08-10T23:21:38.934075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.938110Z","title":"Blending imitation and reinforcement learning for robust policy improvement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.938110Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:689f8f4dcb6814e45194d155a592c3d498d95ac055d2a8637e67bf4cc5aeb6f2","observation_id":"83a90cc5-ddd9-434d-beac-f751a5e94122","resolution":{"observed_at":"2026-08-10T23:21:38.938110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.942348Z","title":"From Motor to Interaction Learning in Robots, chapter Abstraction Levels for Robotic Imitation: Overview and Computational Approaches","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.942348Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:072d96a144631e9dbe5e5db9d5cd2211ea881e565646b089a60a669659a85404","observation_id":"3dfda276-ddb1-46bd-bd5e-353635370f67","resolution":{"observed_at":"2026-08-10T23:21:38.942348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.946613Z","title":"Lungarella, Giorgio Metta, R","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.946613Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:e9fffcac3a3ebc698909f6ae318abf385842a11bd6d798edfdf625f2e574eec4","observation_id":"7eeec9e3-8e81-4806-a34d-681b06178b90","resolution":{"observed_at":"2026-08-10T23:21:38.946613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-08-14T11:25:08.505775Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.03298","snapshot_observed_at":"2026-08-10T23:21:38.950962Z","title":"What matters in learning from offline human demonstrations for robot manipulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.950962Z"},"links":{"cited_paper":"/paper/2108.03298","citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:c3deef9bef68fa7feedf72894fd504860e4c3bfe5f90602ff5d90b78920b93ac","observation_id":"c446ebf3-a344-4c01-b3b9-966a3695e789","resolution":{"observed_at":"2026-08-10T23:21:38.950962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.955456Z","title":"Chime: An adaptive hierarchical representation for continuous intrinsically motivated exploration","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.955456Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:f03638319fafa26652b09e653c245aa002231d86a66e1f6e95345a0a38ba7317","observation_id":"d2dca8ae-252d-4333-9c93-cf0b671ea4e4","resolution":{"observed_at":"2026-08-10T23:21:38.955456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9537.33518","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:41.437336Z","title":"Hierarchical affordance discovery using intrinsic motivation","venue":null,"work_id":"6e26c98c-2db8-4b70-b186-e230457bb821","year":2019},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.959670Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:b1b13f48b15cfe49383742fca3af7762c39dd8dae2cc403f258aefa3904b586b","observation_id":"5451f5c0-d977-4247-bdc0-2f9bfe4e1291","resolution":{"observed_at":"2026-08-10T23:21:41.444132Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.965512Z","title":"Analyzing data efficiency and performance of machine learning algorithms for assessing low back pain physical rehabilitation exercises","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.965512Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:e8152d918858ccdfa31a9be5d96bfbe13d68304c468909cc0140a8a00d8ff403","observation_id":"4db93423-958f-4f13-91b6-6f863f1af99b","resolution":{"observed_at":"2026-08-10T23:21:38.965512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.970162Z","title":"Evaluating kinect, openpose and blazepose for human body movement analysis on a low back pain physical rehabilitation dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.970162Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:907124da5beff78267bc624985e648ac3c241ed4c250820df9d0dd811053cb04","observation_id":"af58865b-c249-4ebd-b09b-87bd4136d0e6","resolution":{"observed_at":"2026-08-10T23:21:38.970162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.974181Z","title":"Physioformer: A spatio-temporal transformer for physical rehabilitation assessmen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.974181Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:3a9db4d1dcee915c4d816c001ac5522449e4121939fa835489f8d204cdb58c13","observation_id":"a542a7ac-7841-4ddb-b242-5a115f5579c6","resolution":{"observed_at":"2026-08-10T23:21:38.974181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:38.978074Z","title":"Intellirehabds (irds) - a dataset of physical rehabilitation movements","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:38.978074Z"},"links":{"citing_paper":"/paper/2412.20573"},"observation_digest":"sha256:c7b9d6901900829e778214e7b93c7af451e59a56e65d7358c2c3626aeb1e120c","observation_id":"5e9e0fd2-b7d2-4698-bcdf-30a11f62164a","resolution":{"observed_at":"2026-08-10T23:21:38.978074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.20573","last_updated":"2024-12-29T20:44:59Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T13:13:21.653294Z","submitted_at":"2024-12-29T20:44:59Z","title":"The intrinsic motivation of reinforcement and imitation learning for sequential tasks"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":78,"verified_exact":17,"verified_fuzzy":0},"total_outbound_references":185},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 100 of 185 outbound references and 0 inbound Pith citation observations for arXiv:2412.20573."}