{"as_of":"2026-08-11T06:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9a4e4cff417d113e52f3fc2da05c656cb0099aa5f9edbf0079f9a38d0b81249b","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T17:09:59.692161Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17760/citation-record","integrity":"/paper/2607.17760/integrity","json":"/paper/2607.17760/citation-record.json","paper":"/paper/2607.17760"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:54.684498Z","title":"1990 , doi =","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:54.684498Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:903bad18c34fff1552aa217e97f565203bfce4d050d41ab0be11523d1b221f1f","observation_id":"ed4851a7-4f04-4232-811b-8e244ad42bc8","resolution":{"observed_at":"2026-08-01T17:09:54.684498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:54.748574Z","title":"Journal of Basic Engineering , volume=","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:54.748574Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:41e0714ffff299ddc939da553cb84df3c0b34ca466f1fedcb7d839415a7a512b","observation_id":"145b0cdc-7475-49d2-ae9c-3f8cea3d12ce","resolution":{"observed_at":"2026-08-01T17:09:54.748574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:54.836991Z","title":"Scaling Learning Algorithms Towards","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:54.836991Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:270e810220152dad4f2b95fee13fe30680868ea6dffec34c30b704fcf23bb55b","observation_id":"c9f5b4f5-087c-435f-805a-507a70486bc2","resolution":{"observed_at":"2026-08-01T17:09:54.836991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:54.925116Z","title":"and Osindero, Simon and Teh, Yee Whye , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:54.925116Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:c71fe825bdf0b8cade9affb224d00384d4ab72aaac85ef2888723b93e9418d61","observation_id":"1a008e90-dad3-466b-a021-8bf5810a4be9","resolution":{"observed_at":"2026-08-01T17:09:54.925116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:55.041382Z","title":"2016 , publisher=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.041382Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:800d7b1e4b34c55ce22304e569f99b006be729972f6054270d9a6c2e034d1aec","observation_id":"98f7329c-a5a7-416b-bf0b-552960a556d2","resolution":{"observed_at":"2026-08-01T17:09:55.041382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:55.167794Z","title":"2018 , publisher=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.167794Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:019dfdbd5c99b64c22258611641ac54cb81216bb65133cdb8ae11b877b42e02c","observation_id":"30bfb89e-3fbd-4eba-b344-b8d93285b072","resolution":{"observed_at":"2026-08-01T17:09:55.167794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:55.252911Z","title":"and Russell, Stuart J","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.252911Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:dcaba51b05906d4685a1f3977b52ca4f71672a4bbaefc5076a63c490a0e3251c","observation_id":"f5234d46-996c-4379-a284-061db527c00b","resolution":{"observed_at":"2026-08-01T17:09:55.252911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:55.349099Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.349099Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:619a4abd65fc7135eb8c2ac61145b10d19ee52ba949d4e0140e10ee69778e297","observation_id":"83f9554e-75e2-4751-8da5-2d593751a66e","resolution":{"observed_at":"2026-08-01T17:09:55.349099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:55.438682Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.438682Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:bdbe4a08aacdc3fe0032114a31c84ce900078620f67fffd0f880ea925a9116e4","observation_id":"2b42e777-8c35-4118-b247-ba39adbd6969","resolution":{"observed_at":"2026-08-01T17:09:55.438682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:55.517017Z","title":"2016 , eprint=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.517017Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:d9d9d90fd84f813b1315b266008ea943028f59fb9fc47acb42c1bc0f4704c7c4","observation_id":"4baecfa6-466f-4b8f-b9db-04adab1df920","resolution":{"observed_at":"2026-08-01T17:09:55.517017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:55.615140Z","title":"Advances in Neural Information Processing Systems , editor=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.615140Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:24e85fcc96f82b6329e78ab6788362ecd752271f5b3674bac16e4b8743841344","observation_id":"3da0040a-582e-47e7-b255-74b8820e0961","resolution":{"observed_at":"2026-08-01T17:09:55.615140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:55.707480Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.707480Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:2a932df4110eee79e6869b8e047ddaa877e3000c865954d79995323a08e716b4","observation_id":"2dcd94bc-24fc-4a5b-bd06-63dfaedb0ff1","resolution":{"observed_at":"2026-08-01T17:09:55.707480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:55.791863Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.791863Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:f2105111fc06c841d569289498b8f73610205b204d47a8ea49de508741ac9995","observation_id":"fa04c3d8-987f-4bbe-965b-711e182214bb","resolution":{"observed_at":"2026-08-01T17:09:55.791863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-01T17:09:55.877253Z","title":"arXiv preprint arXiv:2004.07219 , year=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.877253Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:f212accddbba52557147c921ae3052f5499b7aec404c6b78d7c9f2b64d808d4c","observation_id":"eeeca7d3-d2e3-444f-bc3d-783746d44ba5","resolution":{"observed_at":"2026-08-01T17:09:55.877253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:55.961422Z","title":"2024 IEEE International Conference on Robotics and Automation (ICRA) , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:55.961422Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:e66bae06fbd3a6447a2e0718fd854fb998711c7c2f1bf2db9372ce2998b99664","observation_id":"bdf8ccc1-50d9-4737-b4b1-382d9bea0b30","resolution":{"observed_at":"2026-08-01T17:09:55.961422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.057675Z","title":"Conference on robot learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.057675Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:d792510e50289ea3617f3009b0b96aae2e7fa1ed3fc82f81a4557a861adc4479","observation_id":"9a614bc0-45e2-43ea-9500-fc52255c1916","resolution":{"observed_at":"2026-08-01T17:09:56.057675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.165952Z","title":"2020 , url =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.165952Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:c6b4059746491a836adf53c0673a69d74297db47f4829c796ee12ca99e17f239","observation_id":"5c89edee-61a3-479c-8f33-09684b0e64f2","resolution":{"observed_at":"2026-08-01T17:09:56.165952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.251640Z","title":"Conference on robot learning , pagesfu2018airl=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.251640Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:881aacac3450b736b698de45270b891e7b48d5094320234fe3c935c919d2b371","observation_id":"3e371397-935e-4fa2-878f-226b70d6a26e","resolution":{"observed_at":"2026-08-01T17:09:56.251640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.329556Z","title":"Proceedings of the 38th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.329556Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:e937ff7c71be7aac65859aaed6f26a7354e658c82dba6da22a748393ad6d8c95","observation_id":"f5965891-aa36-43d8-b866-e321867e46ef","resolution":{"observed_at":"2026-08-01T17:09:56.329556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.395372Z","title":"Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.395372Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:4d81a31d09ae28bacec6b2e968624c573f51b1ce14e7a35cd9f96a65a339e64f","observation_id":"ca9f53ad-4ccc-4ea4-be52-f77719301f04","resolution":{"observed_at":"2026-08-01T17:09:56.395372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.480894Z","title":"Dragan and Sergey Levine , booktitle=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.480894Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:22643f698f1f50a468e2e7849dc95d4098f40c376c333620d2d30fcf75283113","observation_id":"9c9f290f-70f7-45f4-8dd4-dad648fef37f","resolution":{"observed_at":"2026-08-01T17:09:56.480894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.563308Z","title":"2021 , url=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.563308Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:b13541c74eb0773f34592a4eaff2b41d0fd8e56a220750ee124b035905a01536","observation_id":"02726ff4-49ef-42c7-be18-38fac7c05aad","resolution":{"observed_at":"2026-08-01T17:09:56.563308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.642459Z","title":"Deep RL Workshop NeurIPS 2021 , year=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.642459Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:bab135f3c30dfa74964ddedeca510d7d512ad57d2059f4914146094d343c95be","observation_id":"46d758b9-bfaa-4f70-b4fc-d5ad5265cc10","resolution":{"observed_at":"2026-08-01T17:09:56.642459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.702847Z","title":"Proceedings of the 39th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.702847Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:4c3014605a232e0be01b55160ad01041dfbda55fd4b89f1c7823631aaeab0291","observation_id":"8a678b3f-475c-425e-9198-7efcb65f1f51","resolution":{"observed_at":"2026-08-01T17:09:56.702847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.782034Z","title":"Proceedings of the 40th International Conference on Machine Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.782034Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:6832fb4abe95dabd0f3d60e38ba063ef2a6f56784997a907fba2e918d4f5e49f","observation_id":"f448c726-385f-429a-acda-c276ca681972","resolution":{"observed_at":"2026-08-01T17:09:56.782034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.866280Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.866280Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:89f0768395f1a443f549731a892d218f1624497594466784659de9691b225c0d","observation_id":"19635bc5-f388-401f-ac98-e1d89af84d96","resolution":{"observed_at":"2026-08-01T17:09:56.866280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:56.957932Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:56.957932Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:244581c01ac38392fc9d5bb23ab215f8bf24470834d547e41bb24819eebe6636","observation_id":"f2187602-b055-4215-875c-3dd93a80a367","resolution":{"observed_at":"2026-08-01T17:09:56.957932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.032565Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.032565Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:1c624a36a6131a15962c6bd1f99cef1b9f3e07d327d6e749c278a7f170c2f838","observation_id":"e71173d9-2272-4b83-bfc7-01d9b07a44ef","resolution":{"observed_at":"2026-08-01T17:09:57.032565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.145288Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.145288Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:fb8e6f38d485e4e54734e6bb202c66793cbd87f7be5e8c99e2e3c9e01d5d5b25","observation_id":"fd33467c-72e8-4e5a-86d3-82b8393ef5c2","resolution":{"observed_at":"2026-08-01T17:09:57.145288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.233163Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.233163Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:d2bd0b37d8d99f38c57173d55e46850e19d1e2cb842373c681a781cabbb3abb7","observation_id":"9a6d5318-6d45-48b1-b5e3-a37593624a16","resolution":{"observed_at":"2026-08-01T17:09:57.233163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.321730Z","title":"Proceedings of the 39th International Conference on Machine Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.321730Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:50c58fb828e0cc15d80b2159673103f5bce3a7d0a9361ba079ad397a7eb7fb0a","observation_id":"42fb8990-ed7e-44ae-9717-23a6d41ad606","resolution":{"observed_at":"2026-08-01T17:09:57.321730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.394768Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.394768Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:b41eba0e223e665ead15d8697d6af0151cc4fd0d7dae51241b88ddedf74e60f0","observation_id":"6bcbc127-9687-4eb9-911c-e31587ad68b2","resolution":{"observed_at":"2026-08-01T17:09:57.394768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.456304Z","title":"Advances in Neural Information Processing Systems , editor=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.456304Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:d574e65efc20abc3d5f6a498d0ae6627ee40e86a15ba568ac554840fcdf205c4","observation_id":"ac4ec188-4b73-4f70-b01b-8a878c6f626f","resolution":{"observed_at":"2026-08-01T17:09:57.456304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.525580Z","title":", author=","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.525580Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:09df1c7d46b38fce7a644f61a12da5c96064d1ff391feb7b09e707b95b21b368","observation_id":"90e97231-995f-438e-9252-e0b26587f322","resolution":{"observed_at":"2026-08-01T17:09:57.525580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.646821Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.646821Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:1e3cacbdb6710002351345fcbb4e2ea236ed02ab75b1e5ef1b3279d553e26462","observation_id":"ea12df81-3c0b-4786-b567-75fcd3f21cbc","resolution":{"observed_at":"2026-08-01T17:09:57.646821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.16817","last_updated":"2021-03-31T05:25:05Z","snapshot_observed_at":"2026-08-04T13:03:06.497574Z","submitted_at":"2021-03-31T05:25:05Z","title":"Learning Generalizable Robotic Reward Functions from \"In-The-Wild\" Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.16817","snapshot_observed_at":"2026-08-01T17:09:57.739341Z","title":"in-the-wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.739341Z"},"links":{"cited_paper":"/paper/2103.16817","citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:ee8450383318ad20200adb907297886dc689d2515286e5b5cfb403bd5d48c070","observation_id":"d07a7f70-cb26-415f-9aa5-0c985b13e7f5","resolution":{"observed_at":"2026-08-01T17:09:57.739341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.825867Z","title":"2nd Conference on Robot Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.825867Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:a382f45f9feff53a911930e90cb34f8e7d15f3023ac3034feb91aeeb3aa9c88e","observation_id":"41142d47-1ae0-474d-bf18-7f28945f2f28","resolution":{"observed_at":"2026-08-01T17:09:57.825867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.911706Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.911706Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:d8733a5038140f148bd5413165a89c9d24b6888ca16dca3b4afa30ca950dd5de","observation_id":"dc7bfc09-67dc-4ce0-a557-7f276775133c","resolution":{"observed_at":"2026-08-01T17:09:57.911706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:57.996038Z","title":"Proceedings of the 38th International Conference on Machine Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:57.996038Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:1c8050a3eff4e155f675ddbfbe83f8f10b43c389026ba2c6adf503e99c67be9e","observation_id":"fa3b6d2d-dbb8-4e18-ac6f-385908cbddd4","resolution":{"observed_at":"2026-08-01T17:09:57.996038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:58.086878Z","title":"Conference on robot learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.086878Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:0b4e5b4c91854ae6134d2cd93587a62f96412e421e0f26b141a001523b155901","observation_id":"03d432a9-786b-4d11-9a23-bed7bd6fb696","resolution":{"observed_at":"2026-08-01T17:09:58.086878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:58.170870Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.170870Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:baa6cdf376534a13ba87f6a76418212bef48a8d939cd0adc37a342c6f31ed80b","observation_id":"abbc73c2-9c23-4335-afcd-d254db6bdb59","resolution":{"observed_at":"2026-08-01T17:09:58.170870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.01557","last_updated":"2018-02-05T18:36:19Z","snapshot_observed_at":"2026-08-08T14:18:15.699217Z","submitted_at":"2018-02-05T18:36:19Z","title":"One-Shot Imitation from Observing Humans via Domain-Adaptive Meta-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.01557","snapshot_observed_at":"2026-08-01T17:09:58.264345Z","title":"arXiv preprint arXiv:1802.01557 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.264345Z"},"links":{"cited_paper":"/paper/1802.01557","citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:eb6acd00fdb0ba61220195415b8057093e85d2f977e9f2575296ac50aa2cb60f","observation_id":"6df95de4-3235-4d91-9e19-c8e4366c83d6","resolution":{"observed_at":"2026-08-01T17:09:58.264345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:58.343078Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.343078Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:f780c17a9f5b7217f05fb7c2fb501c98d3d2937f5101baf5bcf3c295db66cf64","observation_id":"d5090d62-7bfc-47ce-a40c-c6bcbdcd7ac3","resolution":{"observed_at":"2026-08-01T17:09:58.343078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:58.426664Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.426664Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:d9355f30610efed77e1e906f206a1edc0479cb78dd784e5909c5777fc163fd2e","observation_id":"e773526f-6a99-4e7e-8b4b-aacc54b7472c","resolution":{"observed_at":"2026-08-01T17:09:58.426664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:58.518394Z","title":"6th Annual Conference on Robot Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.518394Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:547d01f0a50133ddcb7e14c772effd3b49ad879a475486c93ebe7ce408e201ef","observation_id":"7b7db707-62a2-4377-b004-572a32f13e8e","resolution":{"observed_at":"2026-08-01T17:09:58.518394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:58.571350Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.571350Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:9f054ddee7af95e5a34ecd242e6473a8bceca7fcd9e297d4240dd8a1c01c44dc","observation_id":"638ecf4b-38c6-46ab-8375-b8f391043699","resolution":{"observed_at":"2026-08-01T17:09:58.571350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:58.657100Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.657100Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:af971b1d861b8f68784b83f95795a4198acc1cc2785a065f9f50842fd96ab55e","observation_id":"772d3b7a-4514-4978-b7f2-c9c822b39ec1","resolution":{"observed_at":"2026-08-01T17:09:58.657100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:58.756024Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.756024Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:6b2cd977ed95bfbc828b9d8f60cf2811965a04b7ce6231b9dec5c7115f20019c","observation_id":"67770ddc-8f52-4ef6-9cce-d2583d3c1e41","resolution":{"observed_at":"2026-08-01T17:09:58.756024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:58.837656Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.837656Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:fc804b4189c03325bfa2e764d6d47286e4853a5578651f7d029d8e29758f60b2","observation_id":"5decf9e6-fb01-487a-b515-ac1233f6c478","resolution":{"observed_at":"2026-08-01T17:09:58.837656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:58.937556Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:58.937556Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:c30d2c03ae02c36be47a295d7d9bf32c1e94d9d838850165382367bb1f223599","observation_id":"dc49dc7a-d1eb-4469-8cbe-8eed3a084e26","resolution":{"observed_at":"2026-08-01T17:09:58.937556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:59.021724Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:59.021724Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:793cabf369ac096764535f9ad54f304ec7f62511b8c39f3340aa90e4d73c75ad","observation_id":"8ef9b015-621c-4459-b4a8-0da76857d944","resolution":{"observed_at":"2026-08-01T17:09:59.021724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:59.045807Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:59.045807Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:940f5b071f4256456fabade1367e32ee049b9b1e51496ece5c137b0cba474245","observation_id":"41d0aba9-2e18-4870-9067-6a7c787f821f","resolution":{"observed_at":"2026-08-01T17:09:59.045807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:59.106387Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:59.106387Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:a9244b5bc99c31e967ff58eb9314090ef2267ecd4320ec7ae56110a389bcb596","observation_id":"f3acf74e-2024-4613-9ab9-b9d4745650dc","resolution":{"observed_at":"2026-08-01T17:09:59.106387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:59.229452Z","title":"ICML , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:59.229452Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:f8565a8fc601f63d7f27b8abf7bd8a61d227e91a5845d4f69a2d3e0ad71c7532","observation_id":"480f40bd-8175-4398-8773-a64f323a98c5","resolution":{"observed_at":"2026-08-01T17:09:59.229452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:59.325365Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:59.325365Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:a0294965e9e5b4513788b7cf8e38c2eb32501a98033e3fd4a568ec6469778858","observation_id":"1681649f-a104-462b-8bc7-11be0fa1c5bb","resolution":{"observed_at":"2026-08-01T17:09:59.325365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:59.393379Z","title":"Proceedings of the 37th International Conference on Machine Learning , articleno =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:59.393379Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:72181c9e5106051d9ac2fd9f4dd9babb5b03ceca2e53b18544f699812973195b","observation_id":"2504735c-d598-4ecc-b211-05bb61618a97","resolution":{"observed_at":"2026-08-01T17:09:59.393379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:59.478563Z","title":"Proceedings of the 37th International Conference on Machine Learning , articleno =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:59.478563Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:166e955e8375d5abad675e233a9a7646ea2ad01ccff1f35a8f471478a8b33c1a","observation_id":"cb613ac1-407c-45c4-9459-5a729fd09c32","resolution":{"observed_at":"2026-08-01T17:09:59.478563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T17:09:59.570679Z","title":"arXiv preprint arXiv:1707.06347 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:59.570679Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:4a2986e988c9e2dda33962bd8986015ebf1d2add5dcf6533753bb38fd487c095","observation_id":"ff3f9f21-7086-4c93-acea-b5e6ccfc1d4c","resolution":{"observed_at":"2026-08-01T17:09:59.570679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:09:59.692161Z","title":"Conference on Robot Learning (CoRL) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T17:09:59.692161Z"},"links":{"citing_paper":"/paper/2607.17760"},"observation_digest":"sha256:9fcd285da1291b59b0242b62e7e4bb6fdb7026ceaf7caac3f80441502ec2e378","observation_id":"10c40e40-8a22-49f3-9843-afda982a4d98","resolution":{"observed_at":"2026-08-01T17:09:59.692161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17760","last_updated":"2026-07-20T09:51:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T02:31:05.472670Z","submitted_at":"2026-07-20T09:51:02Z","title":"Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2607.17760."}