{"as_of":"2026-08-20T11:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:663eed91a6998da0560b7ead2746899f84b0b5ddbce82805401ac4c19a252eca","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:28:59.018485Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03753/citation-record","integrity":"/paper/2608.03753/integrity","json":"/paper/2608.03753/citation-record.json","paper":"/paper/2608.03753"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:02.956588Z","title":"Policy invariance under reward transformations: Theory and application to reward shaping,","venue":null,"work_id":"a8c7fa03-9fe5-424e-ad04-d2c1bf699cec","year":1999},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:55.766491Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:13a14036e8d8a49ab87570a3685296d1cca530740495a5100c2fcef8d688b84a","observation_id":"43746d9c-b4ea-492b-9e5f-7bad0a2816e8","resolution":{"observed_at":"2026-08-05T13:29:03.025051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:28:55.878454Z","title":"Recent advances in robot learning from demonstration,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:55.878454Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:f4206bba6fb71a0bc6775bf0cdf73fcb3e6ceecf5f741af9c45f2cc23d9c65a0","observation_id":"0d79435e-88ae-42e6-ba54-e09b0614cd4d","resolution":{"observed_at":"2026-08-05T13:28:55.878454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:02.814939Z","title":"Learning by watching: A review of video-based learning approaches for robot manipulation,","venue":null,"work_id":"36a85911-31ed-4e7a-b392-1a8efe890bee","year":2025},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:56.021102Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:860e2e9b98bc037ee0b2c9175e108d154b150ff11a8ed563d9f952f77f580784","observation_id":"61db427f-5a54-472b-8026-6bb91a80dfc2","resolution":{"observed_at":"2026-08-05T13:29:02.876201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:02.682854Z","title":"Xirl: Cross-embodiment inverse reinforcement learning,","venue":null,"work_id":"92e8853c-38b5-4aca-8353-8e5942e47c3e","year":2022},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:56.146719Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:2e0523b69cea061bd2d9b1d2091503c7e69b2acdd503b600f60b7f9a0433713c","observation_id":"4058901c-69a2-4466-b37b-253bad6ed30c","resolution":{"observed_at":"2026-08-05T13:29:02.752237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:02.557037Z","title":"Hierarchical rein- forcement learning: A comprehensive survey,","venue":null,"work_id":"30de33b7-0122-4933-8888-f989b1700584","year":2021},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:56.275251Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:3d8b14675e2cc5727bdf80a04c6175687d76529b24050432ec27eb1eaf1b5ac2","observation_id":"36637702-3da0-4118-84ae-902f6365dc40","resolution":{"observed_at":"2026-08-05T13:29:02.607907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:02.420040Z","title":"Graph inverse reinforcement learning from diverse videos,","venue":null,"work_id":"b98c6700-9175-47d8-a4f5-9bbcbe019241","year":2023},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:56.413900Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:1c08975973b68d853848c960104d380d55f18140aaf6f3ab1a0ba4b174bbc08d","observation_id":"bfb40785-5915-4fcd-9ed9-6c9800c7e64d","resolution":{"observed_at":"2026-08-05T13:29:02.499103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:02.227336Z","title":"Maniskill3: Gpu parallelized robotics simulation and rendering for generalizable embodied ai,","venue":null,"work_id":"d7b56aff-8a44-4e04-a289-7431b0702039","year":2025},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:56.520643Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:5054b44c2bdcc2dc9c1ba9e37e76b26670fa9d4172be41f105e24b57c782d2b8","observation_id":"4b828829-bcf5-4293-961a-c5e838fc0d28","resolution":{"observed_at":"2026-08-05T13:29:02.286484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:02.088561Z","title":"Time-contrastive networks: Self-supervised learning from video,","venue":null,"work_id":"22ec7db4-7221-4211-820b-9efbf2d00287","year":2018},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:56.619559Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:bf433b340a60b0a48fa161baca8b121d5d15711efc1a38a23784ed71897dd859","observation_id":"e1838f07-ba6f-4aa1-8184-b547bdaca0b3","resolution":{"observed_at":"2026-08-05T13:29:02.144740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:01.878241Z","title":"Temporal cycle-consistency learning,","venue":null,"work_id":"6d9999da-2274-4711-a800-4eed6c635992","year":2019},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:56.717175Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:bd7f2a8a5657d79ce97632f97b1b9472cde50b7672ee0c3b82f5481f2c607ba4","observation_id":"71387b7c-2690-4ca4-a581-18f8582a0e9c","resolution":{"observed_at":"2026-08-05T13:29:01.965500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:01.770510Z","title":"Learning reward functions for robotic manipulation by observing humans,","venue":null,"work_id":"8a9c4d33-50ac-439c-8625-ec006e71c828","year":2023},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:56.815765Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:fee5e0ca7c834d6f593d5f74ddc26a40e5aa5d30330aa6a7c9d82ada0d4331f9","observation_id":"1312b98a-5ea3-4e95-8700-12a9588bfa7b","resolution":{"observed_at":"2026-08-05T13:29:01.826215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-11T15:42:16.204049Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-05T13:28:56.958309Z","title":"Vip: Towards universal visual reward and representation via value- implicit pre-training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:56.958309Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:aae173bf918e644f72351b6900b199006877d9481d330dd829c283ce9058b48f","observation_id":"5d2b0d4e-38b0-4c6f-8b3d-d57a6c510fa1","resolution":{"observed_at":"2026-08-05T13:28:56.958309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:01.648462Z","title":"Liv: Language-image representations and rewards for robotic control,","venue":null,"work_id":"217f05a6-453c-4840-8626-cfd6e349dae1","year":2023},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:57.039984Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:c66701473b676125dc9405425e4f649db25586e661a0777a128a69980210954f","observation_id":"77192bce-9238-4171-b0b1-2f38aa98215c","resolution":{"observed_at":"2026-08-05T13:29:01.707603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:01.511074Z","title":"Shadow: Leveraging segmentation masks for cross-embodiment policy transfer,","venue":null,"work_id":"9c0c5c4e-aa83-41f4-b706-ad498bbc8c55","year":2025},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:57.119425Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:fc6183a12714307b81287dc55066e7ce957d602cc094b25b8b44c7afe809899c","observation_id":"51be2870-4581-4d7f-acfb-f102bb68b4fe","resolution":{"observed_at":"2026-08-05T13:29:01.574806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:01.337985Z","title":"Augmented reality for robots (arro): Pointing visuomotor policies towards visual robustness,","venue":null,"work_id":"cbe941ae-bde8-4d35-9d22-2072c2ff6679","year":2026},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:57.214084Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:091b5806246d867ccbc5d1f0743588bfa65661a3ab7edde8d04f2a695b365bdc","observation_id":"8a6b1dc3-27a9-4627-a6ed-ce6a08289def","resolution":{"observed_at":"2026-08-05T13:29:01.439488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:01.099111Z","title":"Relay pol- icy learning: Solving long-horizon tasks via imitation and reinforcement learning,","venue":null,"work_id":"38eb70ed-d2e8-44a8-9e0c-a9fa31845fe8","year":2020},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:57.299692Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:f44d209963a450a89dda6c4320ec00f013f238a6c15961dc34290231da2a9035","observation_id":"9f5eee01-10e3-492a-8dad-5da09a919572","resolution":{"observed_at":"2026-08-05T13:29:01.193167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:00.918012Z","title":"Taco: Learning task decomposition via temporal alignment for control,","venue":null,"work_id":"98a95d0f-aef0-4364-86df-f0a54f171110","year":2018},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:57.453169Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:3ba44764ba549eae595306bcacd26bcfef07c2dd22bec2f265da1c419b14fe74","observation_id":"440ee1b4-e931-4f33-89d4-53f14afa9c31","resolution":{"observed_at":"2026-08-05T13:29:00.977857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:00.773028Z","title":"Sequential dexterity: Chain- ing dexterous policies for long-horizon manipulation,","venue":null,"work_id":"c91d01d3-628b-48d4-b850-5afe54a9a061","year":2023},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:57.561313Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:6e47932e0ef29d4afe94ee22261a866e5f733a9fcbd65aca3ab3e78a7c44b1a7","observation_id":"b1a97fdf-3329-44f5-80d3-cc1a5514466e","resolution":{"observed_at":"2026-08-05T13:29:00.839721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:00.604723Z","title":"Universal visual decomposer: Long-horizon manipu- lation made easy,","venue":null,"work_id":"83dc6888-7391-4acc-b562-ba31b4785ebc","year":2024},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:57.694668Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:afb66bbc9d6427c65e5287f56daac18af25b23a28341d36872e6abd43e03e550","observation_id":"0dadbb69-86a7-43d5-9c64-9da354f0a724","resolution":{"observed_at":"2026-08-05T13:29:00.677189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-08-18T11:44:22.813405Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-05T13:28:57.814979Z","title":"Do as i can, not as i say: Grounding language in robotic affordances,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:57.814979Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:b3a7c0f7441f46b65af71a8b7e0d8058affc5168cbdca1a3fc7c615aa1bbb8a9","observation_id":"9fccc9fc-38d3-432e-9a31-df76b144a621","resolution":{"observed_at":"2026-08-05T13:28:57.814979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:00.466125Z","title":"RoboGen: Towards unleashing infinite data for auto- mated robot learning via generative simulation,","venue":null,"work_id":"bc72874e-9222-42b5-be36-0ebbce391e3c","year":2024},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:57.938137Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:12f92f826871c51c6b9eb668a21d08ccd2a9e0131c330d817b34274b439eaafa","observation_id":"ab241ba7-957a-45f7-8383-457fd954c7e5","resolution":{"observed_at":"2026-08-05T13:29:00.528056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06605","last_updated":"2025-01-24T13:29:33Z","snapshot_observed_at":"2026-08-20T03:30:31.494970Z","submitted_at":"2025-01-11T18:11:07Z","title":"RoboHorizon: An LLM-Assisted Multi-View World Model for Long-Horizon Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06605","snapshot_observed_at":"2026-08-05T13:28:58.085261Z","title":"Robohorizon: An llm-assisted multi-view world model for long-horizon robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:58.085261Z"},"links":{"cited_paper":"/paper/2501.06605","citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:7716ffe5a159f50fa04147f48b2064931eed9e19019bfc3446215bf3245ea241","observation_id":"95221821-878f-4cb2-8a39-0cf7709fe922","resolution":{"observed_at":"2026-08-05T13:28:58.085261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:00.309222Z","title":"Deco: Task decomposition and skill composition for zero-shot generalization in long-horizon 3d manipulation,","venue":null,"work_id":"2e87daa7-2313-4299-abcc-3c8ad8b1ecef","year":2026},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:58.212697Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:2e1ca5c8fc882c278d5f046a0f6203665117bebd93cc0c5005d31826eddde14d","observation_id":"b1adfc05-3f3a-4804-af3c-4226bff78d06","resolution":{"observed_at":"2026-08-05T13:29:00.415566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:29:00.068694Z","title":"Subtask-aware visual reward learning from segmented demonstrations,","venue":null,"work_id":"70d2152c-55c2-44de-88c8-f669de947c3b","year":2025},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:58.311872Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:d6acb3e86c910f448766e64c5ff7b5a40a48aa3e7e906d2f7500f545c2ae2d05","observation_id":"ac624e5f-4399-4b46-a4a2-3a3436fffb19","resolution":{"observed_at":"2026-08-05T13:29:00.186836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:28:59.809888Z","title":"Egtr: Extracting graph from transformer for scene graph generation,","venue":null,"work_id":"6104504c-5a2c-46fa-9378-bc2e189ef9bf","year":2024},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:58.404488Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:140b5066357b473545e9df21690009bd73a6b8c86b3fcf48da6468adba1fd746","observation_id":"24548f0f-d283-47cc-ae15-d4b4f3c497e8","resolution":{"observed_at":"2026-08-05T13:28:59.911520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:28:59.563624Z","title":"The magical benchmark for robust imitation,","venue":null,"work_id":"13881f9c-34a5-4a2b-b564-f047e100b22e","year":2020},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:58.576140Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:4e9805677d72a7b152df77526bfae8811747853078e3485bcce4fb37f246f705","observation_id":"cb654b4e-b095-4044-9723-eda3874091b6","resolution":{"observed_at":"2026-08-05T13:28:59.644349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:28:58.710531Z","title":"Rlbench: The robot learning benchmark & learning environment,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:58.710531Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:ac9d55ec32da4d6c911cba0c023fd5872f21584e24ce24ffc96d902bdbaeef4f","observation_id":"62fc6244-3c7e-4d47-b090-c0ce1fad3bc6","resolution":{"observed_at":"2026-08-05T13:28:58.710531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:28:59.403226Z","title":"Soft actor-critic: Off- policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":"ec3bb4ef-348a-42f8-9bab-aa181a526a8c","year":2018},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:58.796384Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:d6a3aac9d5bff48ed7ac3f765470b64579e94840370dbac341881f18b37f27c9","observation_id":"810ff14c-eb9c-439e-bb70-95964814fb44","resolution":{"observed_at":"2026-08-05T13:28:59.512614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:28:59.174847Z","title":"Graph transformer networks,","venue":null,"work_id":"3edddb2f-994c-46e3-bd10-a7f3526939e6","year":2019},"citing_paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:28:59.018485Z"},"links":{"citing_paper":"/paper/2608.03753"},"observation_digest":"sha256:602358f588bd864ee8f1263ac962e0543923e85db752ed805646247e33b85487","observation_id":"c4d12e7b-167a-43f1-bd1e-950c97a1e81e","resolution":{"observed_at":"2026-08-05T13:28:59.277875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03753","last_updated":"2026-08-04T14:43:41Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-12T01:48:37.161698Z","submitted_at":"2026-08-04T14:43:41Z","title":"GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2608.03753."}