{"as_of":"2026-08-07T02:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:84becfd023919a2cfc800a5c76b4eb261ddaabfd91798ae476c630007e2cfbae","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":46,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:15:22.321330Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":39,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2307.05973","last_updated":"2023-11-02T06:53:37Z","snapshot_observed_at":"2026-08-05T01:03:23.456778Z","submitted_at":"2023-07-12T07:40:48Z","title":"VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-13T08:57:22.299028Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2307.05973"},"observation_digest":"sha256:6dfc990a4a194bdd93a7cf546d22843fbd11e9ca43ac563f77027d4fe011cba0","observation_id":"4485a3e3-d36e-4933-8e16-4ef134db797f","resolution":{"observed_at":"2026-05-13T08:57:22.346925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"reference_index":238,"source":"pdf_text","source_observed_at":"2026-05-19T20:28:38.900026Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2307.06435"},"observation_digest":"sha256:681daefb3a34b01b12c695df9acb69eb78f8c2a10f6eaaed63125eacaf7c94e0","observation_id":"bbfd1523-8049-438c-bf99-3b29f4d0d1f2","resolution":{"observed_at":"2026-05-19T20:28:39.072643Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2401.03568","last_updated":"2024-01-25T21:20:27Z","snapshot_observed_at":"2026-07-30T06:39:40.880794Z","submitted_at":"2024-01-07T19:11:18Z","title":"Agent AI: Surveying the Horizons of Multimodal Interaction","version":2},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-05-18T14:25:58.876978Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2401.03568"},"observation_digest":"sha256:220ca9d6a8d468ba4a9915d3a6963a88c758fbcef3f7e4fcde435452fbae18a2","observation_id":"8072d747-791a-4e4a-8c8b-94b0528f86c3","resolution":{"observed_at":"2026-05-18T14:25:59.511826Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-05-11T04:42:31.555355Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2408.06292"},"observation_digest":"sha256:0f74bab407abfa27518b90a7a3480967fffedbb20cc24c7e0b0981f5af5ecaf9","observation_id":"59cd022e-4dc6-471d-94d3-291d033c800e","resolution":{"observed_at":"2026-05-11T04:42:32.118153Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2409.02428","last_updated":"2026-05-16T08:13:28Z","snapshot_observed_at":"2026-07-06T19:10:12.721500Z","submitted_at":"2024-09-04T04:15:14Z","title":"Language Models as Efficient Reward Function Searchers for Custom-Environment Multi-Objective Reinforcement","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-23T21:02:03.017690Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2409.02428"},"observation_digest":"sha256:336ddc072badd596952028766f501d482d5d045a864e255a912efceee42b981a","observation_id":"9fb7ffba-bd1b-4e03-a479-4de07da1c058","resolution":{"observed_at":"2026-05-23T21:03:26.377798Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2409.07429","last_updated":"2024-09-11T17:21:00Z","snapshot_observed_at":"2026-07-30T13:07:16.440141Z","submitted_at":"2024-09-11T17:21:00Z","title":"Agent Workflow Memory","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-15T00:51:28.398311Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2409.07429"},"observation_digest":"sha256:216976b8bce8714bc8681eb518aae40c260f1969389aba51ecef52e3c226a2fd","observation_id":"601b4ca6-7ad3-4ab0-b277-0ec3f2a6a0b3","resolution":{"observed_at":"2026-05-15T00:51:28.457802Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2503.22020","last_updated":"2025-03-27T22:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T22:23:04Z","title":"CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-16T05:21:44.903048Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2503.22020"},"observation_digest":"sha256:7ec96094c305cbcfe592f6ae341288176406a23ce9c8b33b60c4de656876ffc0","observation_id":"cd1dbb4e-a13b-408a-bce8-6d3f4c70a20d","resolution":{"observed_at":"2026-05-16T05:21:45.143391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-07T00:13:37.188094Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14763","last_updated":"2025-06-17T17:57:37Z","snapshot_observed_at":"2026-08-07T01:42:03.528128Z","submitted_at":"2025-06-17T17:57:37Z","title":"RobotSmith: Generative Robotic Tool Design for Acquisition of Complex Manipulation Skills","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:37.188094Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2506.14763"},"observation_digest":"sha256:f8d43072d08d3058ad86a7ce009308b7706755098b2558b44063389b5e27d629","observation_id":"ae0b7640-be5b-4f5d-9402-c4eaba497d5b","resolution":{"observed_at":"2026-08-07T00:13:37.188094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-07T00:15:22.321330Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14968","last_updated":"2025-06-27T16:48:18Z","snapshot_observed_at":"2026-08-07T00:07:19.631591Z","submitted_at":"2025-06-17T20:30:11Z","title":"FEAST: A Flexible Mealtime-Assistance System Towards In-the-Wild Personalization","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:22.321330Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2506.14968"},"observation_digest":"sha256:4c520b488e3cafb962e0d4702faee553bd9097d606628439ae1a1eefb520c60e","observation_id":"46cd2feb-7740-4a6a-8b00-6b5ee804ad30","resolution":{"observed_at":"2026-08-07T00:15:22.321330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-06T22:34:07.558279Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-06T22:27:01.217524Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.558279Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:793b8b2f9f67100c2f5dea446979c2375a1456feda78ddbbb2ede152e5936f11","observation_id":"9ac9f634-29b9-4390-89fc-1d9dc1a80649","resolution":{"observed_at":"2026-08-06T22:34:07.558279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-06T17:39:45.182765Z","title":"Language to rewards for robotic skill synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10284","last_updated":"2025-07-14T13:51:28Z","snapshot_observed_at":"2026-08-06T17:32:32.735913Z","submitted_at":"2025-07-14T13:51:28Z","title":"Prompt Informed Reinforcement Learning for Visual Coverage Path Planning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:39:45.182765Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2507.10284"},"observation_digest":"sha256:f7718b3661b51d79dc406419bc3346ed980360b66d0fadf0eeb54d2be348a06f","observation_id":"f5278c0b-30a0-4f7e-a5ad-23a2f833e66a","resolution":{"observed_at":"2026-08-06T17:39:45.182765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-06T16:48:59.846352Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12644","last_updated":"2025-07-16T21:30:05Z","snapshot_observed_at":"2026-08-06T16:40:19.084593Z","submitted_at":"2025-07-16T21:30:05Z","title":"VLMgineer: Vision Language Models as Robotic Toolsmiths","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:48:59.846352Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2507.12644"},"observation_digest":"sha256:92bff1970d6c6e2a0c703834fa76152c5c31d6a593dfcb8235df68168e7ec52b","observation_id":"95a92f59-0f4f-49cc-9247-4211e82f381d","resolution":{"observed_at":"2026-08-06T16:48:59.846352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-06T16:42:30.008389Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12855","last_updated":"2025-07-17T07:26:22Z","snapshot_observed_at":"2026-08-06T16:34:29.463565Z","submitted_at":"2025-07-17T07:26:22Z","title":"DEMONSTRATE: Zero-shot Language to Robotic Control via Multi-task Demonstration Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:30.008389Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2507.12855"},"observation_digest":"sha256:a4f5c3a81210e04e939f1c1c9b3d11fdc256372c0c666d04cd78f0b7b45be0e7","observation_id":"c6c10f6b-9231-42e3-89c1-5a6461a56315","resolution":{"observed_at":"2026-08-06T16:42:30.008389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-06T13:17:07.278935Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20870","last_updated":"2025-07-28T14:22:31Z","snapshot_observed_at":"2026-08-06T13:16:18.436280Z","submitted_at":"2025-07-28T14:22:31Z","title":"A Human-in-the-loop Approach to Robot Action Replanning through LLM Common-Sense Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:17:07.278935Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2507.20870"},"observation_digest":"sha256:2861493689ac2a4aeb45946aacf990edf05475d8e72ae6f80aba2c5de77b47a3","observation_id":"0d2359ed-e86c-48bf-8be6-15a5c3fecf22","resolution":{"observed_at":"2026-08-06T13:17:07.278935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T23:30:47.896896Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05298","last_updated":"2026-07-19T07:48:14Z","snapshot_observed_at":"2026-08-05T23:30:37.693434Z","submitted_at":"2025-08-07T11:55:46Z","title":"GhostShell: Streaming LLM Function Calls for Concurrent Embodied Programming","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T23:30:47.896896Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2508.05298"},"observation_digest":"sha256:c3bc9b59861b7562d2e280f5b3a6946d84b0f16a84a26e2a17554a892038aea7","observation_id":"6403afed-e422-4f5f-a27d-c2159ee75ae8","resolution":{"observed_at":"2026-08-05T23:30:47.896896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T20:31:55.927393Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10399","last_updated":"2025-08-14T06:56:16Z","snapshot_observed_at":"2026-08-06T07:55:46.567033Z","submitted_at":"2025-08-14T06:56:16Z","title":"Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning","version":1},"reference_index":215,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:55.927393Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2508.10399"},"observation_digest":"sha256:7e77130678a43cd40795ce0442de04e6065ba523c761d28aa077a768c95eae8f","observation_id":"448ad640-4dc2-4e2d-9e0d-1f432652e372","resolution":{"observed_at":"2026-08-05T20:31:55.927393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T14:20:41.754771Z","title":"Language to rewards for robotic skill synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21378","last_updated":"2026-07-21T12:16:52Z","snapshot_observed_at":"2026-08-05T14:20:35.593238Z","submitted_at":"2025-08-29T07:47:17Z","title":"RoboInspector: Unveiling the Unreliability of Policy Code for LLM-enabled Robotic Manipulation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T14:20:41.754771Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2508.21378"},"observation_digest":"sha256:415db4057d0a0a78331d5dc0f39af491877ffd32a214246ebf81795ca57500da","observation_id":"d501f1bb-1e69-4b08-b6d6-2d3745075ebb","resolution":{"observed_at":"2026-08-05T14:20:41.754771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-04T22:16:14.200202Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07445","last_updated":"2025-09-09T07:10:39Z","snapshot_observed_at":"2026-08-06T20:26:56.108937Z","submitted_at":"2025-09-09T07:10:39Z","title":"Text2Touch: Tactile In-Hand Manipulation with LLM-Designed Reward Functions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T22:16:14.200202Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2509.07445"},"observation_digest":"sha256:6507bf31304ca8517cfeaa50f3b6ef79df4f513a66583fcd637448fd6670653a","observation_id":"39a0252b-85b0-4774-b7ff-05f5fa6c793e","resolution":{"observed_at":"2026-08-04T22:16:14.200202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-04T21:06:12.152973Z","title":"Language to rewards for robotic skill synthesis.arXiv preprint arXiv:2306.08647, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08222","last_updated":"2025-09-10T01:39:51Z","snapshot_observed_at":"2026-08-04T21:06:10.771999Z","submitted_at":"2025-09-10T01:39:51Z","title":"Exploratory Retrieval-Augmented Planning For Continual Embodied Instruction Following","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T21:06:12.152973Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2509.08222"},"observation_digest":"sha256:55ede2840188bc232e69ab52de0bc0d8ad496a2dcca610d1dfff2847ae4182b8","observation_id":"e07873b9-6cc9-4a4f-8d3a-b534774fef2a","resolution":{"observed_at":"2026-08-04T21:06:12.152973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-04T17:46:05.064762Z","title":"Language to rewards for robotic skill synthesis.Arxiv preprint arXiv:2306.08647, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10660","last_updated":"2025-09-12T19:38:46Z","snapshot_observed_at":"2026-08-06T08:16:28.613366Z","submitted_at":"2025-09-12T19:38:46Z","title":"ZapGPT: Free-form Language Prompting for Simulated Cellular Control","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T17:46:05.064762Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2509.10660"},"observation_digest":"sha256:848fba45748d7f6af5490931aa1e2c28049ac2724f27d978554062fcac5938e0","observation_id":"7db59076-6e9b-41d0-8479-5298be540dcb","resolution":{"observed_at":"2026-08-04T17:46:05.064762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-04T16:06:58.564069Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.16136","last_updated":"2026-06-06T20:56:22Z","snapshot_observed_at":"2026-08-06T11:44:23.885368Z","submitted_at":"2025-09-19T16:35:27Z","title":"Reward Evolution with Graph-of-Thoughts: A Bi-Level Language Model Framework for Reinforcement Learning","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T16:06:58.564069Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2509.16136"},"observation_digest":"sha256:0b4d6029168a0f6cd67ecdefbdda33c0589190d5a14d81c6c2e4864f9fb97748","observation_id":"4bba9fdf-fd86-4a88-8042-e143e09511e8","resolution":{"observed_at":"2026-08-04T16:06:58.564069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2509.19349","last_updated":"2025-09-17T17:49:02Z","snapshot_observed_at":"2026-08-04T18:42:43.786371Z","submitted_at":"2025-09-17T17:49:02Z","title":"ShinkaEvolve: Towards Open-Ended And Sample-Efficient Program Evolution","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-16T13:58:58.627748Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2509.19349"},"observation_digest":"sha256:99029c36d4e57b0bf99423bed4398bf2f00bcc6d50f449451b46ad537bf38796","observation_id":"d6666f7d-6dfd-4b32-8e5e-e4c7304c732b","resolution":{"observed_at":"2026-05-16T13:58:58.801754Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-04T07:27:03.953190Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.25850","last_updated":"2026-06-23T00:18:36Z","snapshot_observed_at":"2026-08-04T07:26:34.329205Z","submitted_at":"2025-10-29T18:00:16Z","title":"Debate2Create: Robot Co-design via Multi-Agent LLM Debate","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T07:27:03.953190Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2510.25850"},"observation_digest":"sha256:3435fa5ab7f6e8b717daec802ef4162bc31b04fdba2858288a9d3b2bf6b7020b","observation_id":"0e915944-7e6e-4289-9b4f-67d547764ee2","resolution":{"observed_at":"2026-08-04T07:27:03.953190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-03T15:29:16.815306Z","title":"Language to rewards for robotic skill synthesis.Arxiv preprint arXiv:2306.08647,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.16861","last_updated":"2026-07-10T01:13:15Z","snapshot_observed_at":"2026-08-06T17:18:06.471264Z","submitted_at":"2025-12-18T18:32:39Z","title":"ReinforceGen: Hybrid Skill Policies with Automated Data Generation and Reinforcement Learning","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:16.815306Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2512.16861"},"observation_digest":"sha256:9f36add9a53041976e0e9d01efd532aff27e673dada23c85d62aa9d0cec7bba2","observation_id":"7fdc6b1f-60d2-43d1-b0aa-1ecf0104c8d2","resolution":{"observed_at":"2026-08-03T15:29:16.815306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2602.10154","last_updated":"2026-02-09T21:28:02Z","snapshot_observed_at":"2026-07-06T22:45:20.365624Z","submitted_at":"2026-02-09T21:28:02Z","title":"PRISM-XR: Empowering Privacy-Aware XR Collaboration with Multimodal Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-16T05:05:41.709469Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2602.10154"},"observation_digest":"sha256:44d4b2dd3f7eb20296daa04b708959ce0e6f4ba6ce9d37424cece886f97bcf31","observation_id":"0824365d-b3eb-4fa2-8742-48835417d541","resolution":{"observed_at":"2026-05-16T05:07:20.574223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2604.08508","last_updated":"2026-04-12T20:12:01Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:49:40Z","title":"Sumo: Dynamic and Generalizable Whole-Body Loco-Manipulation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T17:38:49.399967Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2604.08508"},"observation_digest":"sha256:6bdabad21888581ab8002e42709a78ff84c51e7a108f32300cac7625426c5cad","observation_id":"f7af31f6-665c-4958-9a75-37f05281bddd","resolution":{"observed_at":"2026-05-11T06:25:58.866230Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2604.25496","last_updated":"2026-06-24T16:12:26Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:56:54Z","title":"Improving Zero-Shot Offline RL via Behavioral Task Sampling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-07T16:27:15.347522Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2604.25496"},"observation_digest":"sha256:109144a40eeaa9cf6b671ad5c422ff96540c71b17d7d58b231ed697ff53863b2","observation_id":"4305bdb9-6863-4d46-b3b8-cc2b09eb4208","resolution":{"observed_at":"2026-05-11T23:41:18.595209Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2605.02073","last_updated":"2026-05-08T17:11:09Z","snapshot_observed_at":"2026-08-02T23:23:17.487808Z","submitted_at":"2026-05-03T22:01:25Z","title":"Enhanced LLM Reasoning by Optimizing Reward Functions with Search-Driven Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T19:14:22.162163Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2605.02073"},"observation_digest":"sha256:3cdb647051860be9922a6456695194bc47c6b190e12c139c4d80ac3f51a20089","observation_id":"a8c43925-e26e-4f5b-bd86-c23a4441fc47","resolution":{"observed_at":"2026-05-09T06:00:35.200137Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2605.02073","last_updated":"2026-05-08T17:11:09Z","snapshot_observed_at":"2026-08-02T23:23:17.487808Z","submitted_at":"2026-05-03T22:01:25Z","title":"Enhanced LLM Reasoning by Optimizing Reward Functions with Search-Driven Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T02:10:46.725354Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2605.02073"},"observation_digest":"sha256:cbad24a95438093bc6b454470adb1dfc27e280beef6b70fca397e5914f0cb698","observation_id":"ae951a6e-0a0d-441b-92e0-2a7dd7b6d549","resolution":{"observed_at":"2026-05-11T03:50:57.918220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2605.11859","last_updated":"2026-05-12T09:43:21Z","snapshot_observed_at":"2026-07-06T23:23:39.723268Z","submitted_at":"2026-05-12T09:43:21Z","title":"EvoNav: Evolutionary Reward Function Design for Robot Navigation with Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T05:19:38.587352Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2605.11859"},"observation_digest":"sha256:f98004fd433fca91e9a9d2f99b7d96369997e2981ae4da98a18fc50db7ccafed","observation_id":"d686d8f1-a8b7-422a-9fd5-875676b4e26f","resolution":{"observed_at":"2026-05-13T05:27:18.896581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2605.19259","last_updated":"2026-05-19T02:10:04Z","snapshot_observed_at":"2026-08-01T22:38:05.142647Z","submitted_at":"2026-05-19T02:10:04Z","title":"ERFSL: An Efficient Reward Function Searcher via Language Models for Custom-Environment Multi-Objective Optimization (Student Abstract)","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-20T05:03:28.824500Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2605.19259"},"observation_digest":"sha256:ca117aa28205ea59bb443ac9c973198c46a52ec40bd083c180c78f6e4c43f16e","observation_id":"a88313d2-debd-4d30-a6c3-1e5b0c1ae666","resolution":{"observed_at":"2026-05-20T05:08:05.277461Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2605.22123","last_updated":"2026-05-21T07:55:35Z","snapshot_observed_at":"2026-08-02T20:57:21.864024Z","submitted_at":"2026-05-21T07:55:35Z","title":"Beyond Pixels: Learning Invariant Rewards for Real-World Robotics From a Few Demonstrations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T05:32:17.780012Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2605.22123"},"observation_digest":"sha256:bad3b20fff507cd647847a7276fcd121f02b105d902f8f87d6c477d6b3684220","observation_id":"7787d8f2-017b-4a25-9c1f-8a0de03ab920","resolution":{"observed_at":"2026-05-22T05:34:40.294628Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2605.28232","last_updated":"2026-05-27T09:45:14Z","snapshot_observed_at":"2026-07-06T23:37:50.157617Z","submitted_at":"2026-05-27T09:45:14Z","title":"PIRS: Physics-Informed Reward Shaping for SAC-Based Building Energy Management","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T12:17:41.705218Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2605.28232"},"observation_digest":"sha256:075eb5283c3546056cf13a647eae5b071cc5c9586339161d8869cba99f0488e1","observation_id":"517f6d7d-4ab3-4e67-b090-1a83758dcff7","resolution":{"observed_at":"2026-06-29T12:23:23.904827Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2606.05660","last_updated":"2026-06-04T03:43:09Z","snapshot_observed_at":"2026-08-03T21:53:08.948703Z","submitted_at":"2026-06-04T03:43:09Z","title":"Safe Embodied AI for Long-horizon Tasks: A Cross-layer Analysis of Robotic Manipulation","version":1},"reference_index":204,"source":"arxiv_source","source_observed_at":"2026-06-28T01:46:36.081851Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2606.05660"},"observation_digest":"sha256:153b24d99b4c31e63fc097f6440507e3500bf10617835edce0edcd6e8cc98dba","observation_id":"1da2b404-d440-4232-9112-da39b3a41554","resolution":{"observed_at":"2026-07-02T12:56:56.738569Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2606.19980","last_updated":"2026-06-18T09:21:27Z","snapshot_observed_at":"2026-08-02T17:59:36.162113Z","submitted_at":"2026-06-18T09:21:27Z","title":"ENPIRE: Agentic Robot Policy Self-Improvement in the Real World","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-26T17:25:29.469359Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2606.19980"},"observation_digest":"sha256:41f99981ad13cfaba045518c00189d4698a258abb7dbb9dc29f04ca6ee6e7ae6","observation_id":"edd7a058-da00-4aae-b0cd-11dd3f2f9eaa","resolution":{"observed_at":"2026-07-04T03:59:33.466912Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2606.21228","last_updated":"2026-06-23T04:40:39Z","snapshot_observed_at":"2026-08-02T19:24:45.644999Z","submitted_at":"2026-06-19T08:47:40Z","title":"Sakana Fugu Technical Report","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-06-26T14:22:37.596720Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2606.21228"},"observation_digest":"sha256:71e1e182b76f41a74c3d40df64684722b2855d83bf05bc688a6606e6745c32f9","observation_id":"0207fc36-28ac-46e9-a6bf-9df72ca2ab8d","resolution":{"observed_at":"2026-07-04T06:39:36.895230Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2606.22319","last_updated":"2026-06-21T03:28:26Z","snapshot_observed_at":"2026-08-03T07:11:18.264652Z","submitted_at":"2026-06-21T03:28:26Z","title":"EmbodiedUS-FS: Fast Slow Intelligence for Ultrasound Robotics","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T10:43:35.766229Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2606.22319"},"observation_digest":"sha256:be2ad2f9a9c7edf8649f3d94b5a7d93079306e28e5d37371c94545827aea01a2","observation_id":"aedced29-181b-4cb6-b901-e68cb4e20aab","resolution":{"observed_at":"2026-07-04T08:59:42.632679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2606.27871","last_updated":"2026-06-26T09:11:59Z","snapshot_observed_at":"2026-08-02T18:28:08.474220Z","submitted_at":"2026-06-26T09:11:59Z","title":"LocalNav: Distilling Frontier VLMs and Embodied RL for On-Device Object Goal Navigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T04:46:12.483085Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2606.27871"},"observation_digest":"sha256:9dd1ff65e22b25c6c184631aa66f9b1a577ad84d6cf4cee1f7e6b91288e28b94","observation_id":"a79d7254-6add-42be-bd93-2719168175a5","resolution":{"observed_at":"2026-06-29T19:23:54.290524Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2607.00483","last_updated":"2026-07-02T01:53:18Z","snapshot_observed_at":"2026-07-07T00:06:09.887791Z","submitted_at":"2026-07-01T06:11:59Z","title":"VLM-AR3L: Vision-Language Models for Absolute and Relative Rewards in Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-02T11:52:25.035266Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2607.00483"},"observation_digest":"sha256:4b904bc380e61afb406af886542de751d94538e15595473f5b27c28331be8315","observation_id":"1fec7aa6-adc0-43fd-9d3a-d0cfdebf69b2","resolution":{"observed_at":"2026-07-02T11:56:54.897603Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2607.00483","last_updated":"2026-07-02T01:53:18Z","snapshot_observed_at":"2026-07-07T00:06:09.887791Z","submitted_at":"2026-07-01T06:11:59Z","title":"VLM-AR3L: Vision-Language Models for Absolute and Relative Rewards in Reinforcement Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-03T20:43:34.222848Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2607.00483"},"observation_digest":"sha256:f8651a2044e4226be9e02fd4a7551a60dab333e1489555b7c9ed97e7d4253492","observation_id":"f293187d-0996-4e81-a3e4-de94ddd6f1bd","resolution":{"observed_at":"2026-07-03T20:48:55.284136Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08647","doi":"10.48550/arxiv.2306.08647","metadata_source":"pith","pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language to rewards for robotic skill synthesis","venue":"cs.RO","work_id":"a81c2275-4069-4b98-a760-8da052c9083a","year":2023},"citing_paper":{"arxiv_id":"2607.05391","last_updated":"2026-07-07T17:26:37Z","snapshot_observed_at":"2026-08-06T03:00:58.001418Z","submitted_at":"2026-07-06T17:59:35Z","title":"LLM-as-a-Verifier: A General-Purpose Verification Framework","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-07T12:47:29.552283Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2607.05391"},"observation_digest":"sha256:078eee1c3ef15495de15e4231ad6cfa46f6751794cdad958c4e5424d1f9b02b6","observation_id":"c5067fdb-cc59-4039-bdef-edb1a229f603","resolution":{"observed_at":"2026-07-07T12:53:50.182171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-07-11T07:02:51.850836Z","title":"Language to rewards for robotic skill synthesis, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05391","last_updated":"2026-07-07T17:26:37Z","snapshot_observed_at":"2026-08-06T03:00:58.001418Z","submitted_at":"2026-07-06T17:59:35Z","title":"LLM-as-a-Verifier: A General-Purpose Verification Framework","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-11T07:02:51.850836Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2607.05391"},"observation_digest":"sha256:f0d0ef24e71b20f3e41b922052aee593fdeecc4a2ad8472b280a37c8758a3078","observation_id":"0e5994b9-f181-4ccf-8356-9aeb00c7c3af","resolution":{"observed_at":"2026-07-11T07:02:51.850836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-02T06:21:26.191346Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12818","last_updated":"2026-07-15T10:55:41Z","snapshot_observed_at":"2026-08-02T18:26:00.940065Z","submitted_at":"2026-07-14T14:30:24Z","title":"Breaking D\\'ej\\`a Vu: Independent Auditing of Visual Place Recognition through Vision-Language Reasoning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T06:21:26.191346Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2607.12818"},"observation_digest":"sha256:577dabdc3281df082c92e56c45d351118be2ed3fb042625c0a7a544bb1806171","observation_id":"944e2d6b-e7be-44df-b0b9-35142ba50594","resolution":{"observed_at":"2026-08-02T06:21:26.191346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-07-30T20:27:55.866736Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-03T02:35:13.597871Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.866736Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:69501e765e3a29b7d9cf1c4797e3f91b5d8c5d856fd61e95beff690732d07d30","observation_id":"ced2984c-f95b-4194-8157-8f7abbb51cce","resolution":{"observed_at":"2026-07-30T20:27:55.866736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-04T19:45:35.417818Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-06T23:33:18.970298Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":288,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:35.417818Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:e53a9e49c4982c3b8b6f9f9af1389c12aec1e2280c5e674cd9728c60b831d1c5","observation_id":"9cf112c2-7a81-40f8-a41c-221863c23e67","resolution":{"observed_at":"2026-08-04T19:45:35.417818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-05T15:25:40.214411Z","title":"Language to","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03644","last_updated":"2026-08-04T13:29:00Z","snapshot_observed_at":"2026-08-07T02:26:31.614765Z","submitted_at":"2026-08-04T13:29:00Z","title":"Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algorithms to Implementation Details","version":1},"reference_index":200,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:40.214411Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2608.03644"},"observation_digest":"sha256:dda3d4a420e141ec53d6299ae4b0fe568ec05964313208ce70d11d5ddd6b3802","observation_id":"e4c2528b-55c1-4978-9fd4-6a10b37996a0","resolution":{"observed_at":"2026-08-05T15:25:40.214411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.08647/citation-record","integrity":"/paper/2306.08647/integrity","json":"/paper/2306.08647/citation-record.json","paper":"/paper/2306.08647"},"outbound":[],"paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-31T01:35:59.440637Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 46 inbound Pith citation observations for arXiv:2306.08647."}