{"as_of":"2026-08-18T22:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2ba38cb50eb13debc36d0f1f4357afffbae38b223b91941f53206e95616a8b17","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:57:41.917887Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.00178/citation-record","integrity":"/paper/2509.00178/integrity","json":"/paper/2509.00178/citation-record.json","paper":"/paper/2509.00178"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:49.363629Z","title":"Memmel, A","venue":null,"work_id":"a21563fc-1107-404b-aec9-1b7a49a2b3f9","year":2024},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:37.059715Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:83ee5b333aa71bcba3d978f61b446b85df3eaab20aa47b24aadf603648dbf0c4","observation_id":"99a4ca28-9b93-4dac-ad61-be5f950c2af3","resolution":{"observed_at":"2026-08-05T13:57:49.422340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10610","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:44.213646Z","title":null,"venue":null,"work_id":"ba17cb2c-0e12-4b0c-a9ec-20daba219469","year":2024},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:37.140180Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:18fa9a47ab7fd66256ab7db081cc2aeff3d079f398420fc506d1b193118eb1bc","observation_id":"8633e27a-ab0c-44be-a79b-e0f54f33e944","resolution":{"observed_at":"2026-08-05T13:57:44.281714Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:49.166235Z","title":"Saito, N","venue":null,"work_id":"079639ca-59b0-48e8-be0b-576536275f35","year":null},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:37.243658Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:72617dd51313d3d3f4dd80fc3f76045011147e08552d3960271d4a3fc2772658","observation_id":"e705fb8c-d54e-4c88-8ea7-f28d42d502fb","resolution":{"observed_at":"2026-08-05T13:57:49.254523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:37.480149Z","title":"Lopez-Guevara, R","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:37.480149Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:713b0a4ba788c8bc92cb46f44ccc5f99562db4baacb9fc19bb5620c54b348f74","observation_id":"5b0d2e18-85f5-45e6-9300-18aa3453f37e","resolution":{"observed_at":"2026-08-05T13:57:37.480149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:37.652223Z","title":null,"venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:37.652223Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:4f5d8aeef45502ef2c1ae4b03314038ad3453145413310c814aed411d617d3a1","observation_id":"d310dd89-d0aa-4337-9de7-2222ad98735d","resolution":{"observed_at":"2026-08-05T13:57:37.652223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:48.942242Z","title":null,"venue":null,"work_id":"62c27dcc-9662-4b34-bcc7-d6b43d179357","year":2023},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:37.784306Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:18a19bae8e1fcb6dd79e4927e77edcf15f55f8a1233371366703d1206aac4c49","observation_id":"16ba88f0-768a-4dbb-b3a1-95c0643a8c12","resolution":{"observed_at":"2026-08-05T13:57:49.029638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.31573","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:43.724446Z","title":"Antonova, J","venue":null,"work_id":"e19cd697-043a-439b-9556-862ca338001a","year":2022},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:37.943575Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:69c6b62c4997100d31b18cdc832c30778f76597969380cd660ea5bc9ed021765","observation_id":"80083326-d370-43f2-bcfd-600802da4006","resolution":{"observed_at":"2026-08-05T13:57:43.824457Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:38.093354Z","title":"Saito, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:38.093354Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:ce9fc2d09280178cea5dcef0b2d9150dc6f13bf457ab29449771c8f1cb3f909b","observation_id":"d17ce37b-1a0f-4706-9a31-2b40c19dd104","resolution":{"observed_at":"2026-08-05T13:57:38.093354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:38.254076Z","title":"Liang, S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:38.254076Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:5d39bb2004aa1503238cbcd2c7f50357d897aaa6599d11b586ad3cd7e5310249","observation_id":"142c376a-41b3-423e-8969-8d0a53697373","resolution":{"observed_at":"2026-08-05T13:57:38.254076Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:38.340621Z","title":"Tobin, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:38.340621Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:f5c9678f6363a96b0cecbc5bf014f0420996c4f262fed8a3a5fb19c2e853d866","observation_id":"7ad2e2e4-4165-40fd-bfa5-7566bc255415","resolution":{"observed_at":"2026-08-05T13:57:38.340621Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07113","last_updated":"2019-10-16T00:59:05Z","snapshot_observed_at":"2026-08-02T15:37:37.200292Z","submitted_at":"2019-10-16T00:59:05Z","title":"Solving Rubik's Cube with a Robot Hand","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07113","snapshot_observed_at":"2026-08-05T13:57:38.461762Z","title":"Akkaya, M","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:38.461762Z"},"links":{"cited_paper":"/paper/1910.07113","citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:185ef88a8a4a6a9c00bbfa6bfbee04d1b1a537ea8ac5d28b02bd63dd7702349e","observation_id":"56cfb495-9e16-417e-ab88-d0508732f2a7","resolution":{"observed_at":"2026-08-05T13:57:38.461762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:48.726471Z","title":"Ramos, R","venue":null,"work_id":"5f083d56-599e-464e-80fb-24aeb986f94a","year":2019},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:38.547399Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:eab0eee8e4e24dbe1282794997e329b445769695a73d51a40e483b1e53ecede7","observation_id":"037b948d-2213-4d6d-a42c-5174d5929087","resolution":{"observed_at":"2026-08-05T13:57:48.821356Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:38.669685Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:38.669685Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:5c7ccb405c863c893ce53f2f49e7fa5781bd8f81bd2a79e0083d48c77733ebe5","observation_id":"075d6638-06de-4b5c-a8a2-e8fcf73bd957","resolution":{"observed_at":"2026-08-05T13:57:38.669685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:48.505668Z","title":null,"venue":null,"work_id":"325a36eb-9686-4dae-924e-c1ea5cfd1489","year":1999},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:38.736009Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:65105382eb03090fee7ec8af6efb7a7e134c1d2d8af14bd0c541dad639801451","observation_id":"f031431c-4302-4a0c-b260-4c7bc8187eea","resolution":{"observed_at":"2026-08-05T13:57:48.605239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:38.837071Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:38.837071Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:f7055fb1f70dc3f593c29a44c34bf413756c7d71473c9dc6d15e283a5a61d8f4","observation_id":"41669647-a90e-4389-9c18-ef03967384f3","resolution":{"observed_at":"2026-08-05T13:57:38.837071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:38.907993Z","title":"Kolev and E","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:38.907993Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:7fc0348228e174ee0302afe0b3edc44a16aae90025d06796b866a82d2141d4d1","observation_id":"bed2a898-d7a6-4c71-96ca-b1ad21dce9f0","resolution":{"observed_at":"2026-08-05T13:57:38.907993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:48.292294Z","title":null,"venue":null,"work_id":"d74bdf33-6fd8-49d2-935d-04ce2e522352","year":2023},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:39.003792Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:4602c59a4d18c0679594136d4ce0ca68cd773e47d3f294d916bf0ba03005ff94","observation_id":"eadb5cbb-efc5-459e-a49d-325f3f3f327d","resolution":{"observed_at":"2026-08-05T13:57:48.389706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/02783649231201201","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"The International Journal of Robotics Research","work_id":"8482a03d-fe47-4df3-ae26-ccc1f3e4936e","year":2024},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:39.100143Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:cd27a59a740a647d42577c98b9bf80dc07d41e9b41515affb421b10079d3dc84","observation_id":"d4d0e1cc-55d0-422d-8edc-7061e6ad4e1e","resolution":{"observed_at":"2026-08-05T13:57:42.263524Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:48.073585Z","title":null,"venue":null,"work_id":"4514265e-bcab-4f28-ba88-427b4c3ec97b","year":2020},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:39.186500Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:b7d6757d9e5d74400027806c52a2490ac899f82435cfb8305e7e65d696346f9f","observation_id":"09ac6cb5-2630-428e-99b0-eb1111e13e95","resolution":{"observed_at":"2026-08-05T13:57:48.179839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:47.887372Z","title":null,"venue":null,"work_id":"f033b38d-4d43-4927-a5a1-418d14e161be","year":2019},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:39.239673Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:e040ee950f4aa57c771f1422238f28c7bf236b7d64065bd2329e954fc9abc2fa","observation_id":"939ffd56-2db2-41a1-a8c4-1619d8fb266e","resolution":{"observed_at":"2026-08-05T13:57:47.981249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:47.695642Z","title":null,"venue":null,"work_id":"a71d0d70-13ba-48c8-b6f9-f0e87a9afa58","year":2024},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:39.298222Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:a281b027b74e6176983625c935a1fd09adcaa0dab8249eaef668c907879150af","observation_id":"d5f017ac-e043-4f71-8dd2-529372140e4a","resolution":{"observed_at":"2026-08-05T13:57:47.757325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:47.440878Z","title":"Pechyony and V","venue":null,"work_id":"9570de62-778a-4436-a590-cc9058e0cd34","year":null},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:39.368325Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:6c61ee1200adc39f6538758b84fffca0d89ce47e85eaa92c269cc901811c6b68","observation_id":"1097a14c-9e9e-4bdc-a826-79c2b4db257c","resolution":{"observed_at":"2026-08-05T13:57:47.565207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:47.116089Z","title":null,"venue":null,"work_id":"84f64b2a-07d2-4f45-a7ad-91d847bc84a7","year":2020},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:39.605356Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:15bd69481dc82620b60a19f46b7ef3fc4b8102b86330fe96b52033261a030a6a","observation_id":"2d9caea1-457c-4446-a23c-280b8e3ad8bb","resolution":{"observed_at":"2026-08-05T13:57:47.172659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:39.809300Z","title":"Fuchioka, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:39.809300Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:9a4d3ea116d61092da764e5e821428e5bde201b0c30540970daec14d1c5c81d9","observation_id":"225760e5-0e53-4833-b756-72dae5356919","resolution":{"observed_at":"2026-08-05T13:57:39.809300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:46.966007Z","title":null,"venue":null,"work_id":"3964e28d-b805-4ce2-8ab9-37e239644dc9","year":2020},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:39.995012Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:5d5ddfe81c6b1f80e3eb107fe528e27f24e51e2f0b9038fee9eca0c2efade162","observation_id":"ea952ab2-12ce-427d-89e2-1f8326a738f2","resolution":{"observed_at":"2026-08-05T13:57:47.013534Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:46.825342Z","title":null,"venue":null,"work_id":"4df30db8-281c-4afe-bdf2-81406af0e0a4","year":2023},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:40.137009Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:3df50b0fec0251fb85969ce585d4a0c51e0e814f75346505c748375dc387ef51","observation_id":"99e0796d-ab56-4995-b4a2-a43231b93cc8","resolution":{"observed_at":"2026-08-05T13:57:46.901102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:46.669699Z","title":null,"venue":null,"work_id":"1dbcc4ff-28b4-4e9e-8aab-dba506e7f31b","year":2022},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:40.283578Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:b5c7fe0fe8f8a2b17f8e4faa30e347ced0d912d189af00e594cac2a6926f58d6","observation_id":"8a0a542c-9a3a-41e0-98b8-29a84f559dab","resolution":{"observed_at":"2026-08-05T13:57:46.770342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:46.150656Z","title":"Del Aguila Ferrandis, J","venue":null,"work_id":"8614af63-6cbc-432e-bf3a-61494f220180","year":2024},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:40.450120Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:8c84696af6c243059fae0865249aa77230345bff214bbdc25fc04466e086af15","observation_id":"f3c6c28b-74db-44c5-b046-91462ad3e0a1","resolution":{"observed_at":"2026-08-05T13:57:46.393204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:40.588727Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:40.588727Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:c16a1efd76e4ff381b76c7d86a91b65e89e888d3b433447086019dfafe92d5f1","observation_id":"4b5a3dab-9896-4124-8267-4d97fdaf1f8c","resolution":{"observed_at":"2026-08-05T13:57:40.588727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:45.754146Z","title":null,"venue":null,"work_id":"391d0b13-d658-492d-b7ec-ac5efd3fa983","year":2024},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:40.736254Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:1ddbfbe70a77c25080f8a11984d9a816a49dc6192665085d71888e4978d8f44c","observation_id":"0ba0093d-8138-4192-9c1c-1387d050d02d","resolution":{"observed_at":"2026-08-05T13:57:45.938551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:40.922696Z","title":"R ¨ostel, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:40.922696Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:6d5d7377a7d5b40dc01f01a9699107ef169867445c58a0057e6a0922984799cc","observation_id":"a068219d-79e2-4554-bd74-b128bb37faad","resolution":{"observed_at":"2026-08-05T13:57:40.922696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:45.477106Z","title":"Pinto, M","venue":null,"work_id":"6ed23c82-95ec-4f5d-a2a9-ff26d1c4eb77","year":2018},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.077715Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:6979fd2bf810971d4b2f35927eb4cb31a8465d8fb2b2c0affaf114928d4458bb","observation_id":"fc1782a6-8c1c-4386-a1b3-63f2bf808e2b","resolution":{"observed_at":"2026-08-05T13:57:45.599056Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:41.154339Z","title":"Hochreiter and J","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.154339Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:cddb1e7c9316492e260b2b5cc12bb2a18000491113a90f82451a62d92f761ce3","observation_id":"482a2d9c-433b-4ffb-b63f-db45c8df1574","resolution":{"observed_at":"2026-08-05T13:57:41.154339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:45.227123Z","title":"Shyam, W","venue":null,"work_id":"f240dc93-e6e2-4948-a0eb-7f3abef0c6f9","year":2019},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.208211Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:53fb056da34b6af90d9f40404602ddb98e0a6b72dd3d934314efa914dd91d12a","observation_id":"b14cbb01-6aa2-41b9-bcdb-1fc2989e77be","resolution":{"observed_at":"2026-08-05T13:57:45.338031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:41.271867Z","title":"Gawlikowski, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.271867Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:53960b83366dec369f589482d0f0139c7e422967ec783504a03b25114c008a1e","observation_id":"3bfc25ec-9c45-4de0-8e0d-cc5e31151d3c","resolution":{"observed_at":"2026-08-05T13:57:41.271867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1994.37413","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:42.669845Z","title":"Nix and A","venue":null,"work_id":"a7e2c2ee-c229-40ff-a265-86a37c0a0878","year":1994},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.377373Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:21dc3898256773e257ef3945faaf3a669ca967f771d44e76dd0a2b151612355a","observation_id":"962d9aea-b701-45c4-be34-dc3973f06f80","resolution":{"observed_at":"2026-08-05T13:57:42.757579Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:44.935268Z","title":"Lakshminarayanan, A","venue":null,"work_id":"173af6d5-bf5d-46a0-b909-e3dae93e5512","year":2017},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.447767Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:7f2b2fc9d7479cd3e0bf91979213f7d686f484ead7015638d36a1dc15e49c183","observation_id":"35134edf-aa27-45bf-bc5e-990c4a6df257","resolution":{"observed_at":"2026-08-05T13:57:45.100427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:41.523197Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.523197Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:565315bed620273d87b77ccae09e681bdafaca056c63d8c1dfa17dcbbfe33358","observation_id":"0a7640f6-f252-4942-a06c-bc0c32046f6e","resolution":{"observed_at":"2026-08-05T13:57:41.523197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:41.572346Z","title":"Kumar, Z","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.572346Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:111997e02122a458d4de76a352063a7046326b8cb0c8222f72bd29669689ad2b","observation_id":"caec12be-0cab-4405-872a-0ba2187e2770","resolution":{"observed_at":"2026-08-05T13:57:41.572346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:44.652282Z","title":"Makoviychuk, L","venue":null,"work_id":"f633f896-0c20-45d4-8251-3d563afedf29","year":2021},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.621457Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:c2aa832fbbb913cce7990bdc3aff5a7adfd49cea30f156296fe91a65b473055b","observation_id":"7b347de2-4eb5-4dea-971c-f10b8aa1ddde","resolution":{"observed_at":"2026-08-05T13:57:44.783577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:41.738426Z","title":"Mittal, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.738426Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:063919515ac367f790c364f01770625807920e8e7576a886b0367a3a72abdff2","observation_id":"046393f1-7cfc-44d4-85a5-adb5bbba92e5","resolution":{"observed_at":"2026-08-05T13:57:41.738426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:44.417583Z","title":"Coumans and Y","venue":null,"work_id":"bab926d8-4ea4-44c9-a86c-b5ca97f6a82e","year":2016},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.826785Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:e5c0495a2ecd69fecb67832edd5e23c7619a4aa4b43e8ecb223b00f5ae1fb6f3","observation_id":"6024f623-92ed-4c05-8e9d-f8c57598a56e","resolution":{"observed_at":"2026-08-05T13:57:44.480765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T13:57:41.917887Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:41.917887Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:5252ee1c55ebcf21c7ca231c0e1268d603d43aa785ada170975847c54c21850f","observation_id":"d71874bf-23ee-47c2-ad6b-ec8e5997e302","resolution":{"observed_at":"2026-08-05T13:57:41.917887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:47.248675Z","title":null,"venue":null,"work_id":"6761fc36-a6ee-4907-b565-e78bf75ce816","year":2010},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:39.426108Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:e45da04a32ae28c069f997a546d337aa8bc14daae20e2ada04f2e960b58a3e62","observation_id":"745a8507-15ae-4447-98cd-ea7e62b39360","resolution":{"observed_at":"2026-08-05T13:57:47.355762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:57:37.365992Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T13:57:37.365992Z"},"links":{"citing_paper":"/paper/2509.00178"},"observation_digest":"sha256:d9f35798f78d5b6da30868ab1c34527bd548c1655810a131dbed9d036907a227","observation_id":"a1b0295b-a3e6-43c7-998b-bc70643dff96","resolution":{"observed_at":"2026-08-05T13:57:37.365992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.00178","last_updated":"2025-08-29T18:26:05Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T09:41:24.245975Z","submitted_at":"2025-08-29T18:26:05Z","title":"Poke and Strike: Learning Task-Informed Exploration Policies"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":5,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":28,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2509.00178."}