{"as_of":"2026-08-09T15:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c90d215d9a00a6507ea73fc8ddf8cca3c42d901ff324f583e8d380f4547cb13f","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T20:27:56.698753Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23515/citation-record","integrity":"/paper/2607.23515/integrity","json":"/paper/2607.23515/citation-record.json","paper":"/paper/2607.23515"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1802.09464","last_updated":"2018-03-10T18:11:25Z","snapshot_observed_at":"2026-08-02T00:57:15.173797Z","submitted_at":"2018-02-26T17:20:14Z","title":"Multi-Goal Reinforcement Learning: Challenging Robotics Environments and Request for Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09464","snapshot_observed_at":"2026-07-30T20:27:55.219376Z","title":"Multi-goal reinforcement learning: Challenging robotics environ- ments and request for research,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.219376Z"},"links":{"cited_paper":"/paper/1802.09464","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:46b03a4c1d76e6eaab76dcac74ff3ca73707cedb59b363d4cc665a4a8c6e4bf8","observation_id":"321c0160-8f4f-46e7-bfd8-74891cc3e7f7","resolution":{"observed_at":"2026-07-30T20:27:55.219376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:55.274866Z","title":"Learning dexterous in-hand manipulation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.274866Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:c7479c10f4266b576e1f8e75413e928c7cce389db4431d37361956d16f5bc82c","observation_id":"c6575c8a-b3f2-4ac1-ba87-1ba9c7e18e5f","resolution":{"observed_at":"2026-07-30T20:27:55.274866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:55.315776Z","title":"Deep reinforcement learning for robotics: A survey of real-world successes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.315776Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:737d390752491be35f205c42368279bdb3b5e7f99d6ca5e18f114af6f330848a","observation_id":"8908b724-1a27-4b35-9923-a2f80862f396","resolution":{"observed_at":"2026-07-30T20:27:55.315776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04664","last_updated":"2020-05-28T20:51:40Z","snapshot_observed_at":"2026-08-09T01:09:42.786424Z","submitted_at":"2020-03-10T12:38:31Z","title":"Automatic Curriculum Learning For Deep RL: A Short Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04664","snapshot_observed_at":"2026-07-30T20:27:55.365340Z","title":"Automatic curriculum learning for deep rl: A short survey,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.365340Z"},"links":{"cited_paper":"/paper/2003.04664","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:5aec14db89b29835d746fa1d062132aded68658f9fd84fa6226ff834e7d72d27","observation_id":"c4c19512-aab4-4b2c-b876-1a0ef6a62a59","resolution":{"observed_at":"2026-07-30T20:27:55.365340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:55.431543Z","title":"Curriculum learning for reinforcement learning domains: A framework and survey,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.431543Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:b069a588666d7dfec37ace5a253d4817756c52048a0258c8cb4d0e9c5bea67e4","observation_id":"faee6432-1654-4ef1-b939-cb1666f369be","resolution":{"observed_at":"2026-07-30T20:27:55.431543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:55.466822Z","title":"Teachmya- gent: a benchmark for automatic curriculum learning in deep rl,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.466822Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:aef5384167005d0ccfa9a33f3de423efce8f20ca77377f2de24d57d6067f2e5b","observation_id":"aca2d95e-81a4-4e9c-8ddd-b76359471af6","resolution":{"observed_at":"2026-07-30T20:27:55.466822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.00350","last_updated":"2021-03-18T08:53:32Z","snapshot_observed_at":"2026-08-07T13:51:31.536024Z","submitted_at":"2020-07-01T09:38:51Z","title":"Adaptive Procedural Task Generation for Hard-Exploration Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.00350","snapshot_observed_at":"2026-07-30T20:27:55.515799Z","title":"Adaptive procedu- ral task generation for hard-exploration problems,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.515799Z"},"links":{"cited_paper":"/paper/2007.00350","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:eec4049b88858016635cbf75ea3429f68b8875a0ed40b5c388eb07d35d57cddb","observation_id":"b3e9485c-03bd-434a-a1e6-aedb49475534","resolution":{"observed_at":"2026-07-30T20:27:55.515799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:55.618016Z","title":"Integrated task and motion planning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.618016Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:585b6333ba03e6a645af33bd4e25bb73f10befba339e433a293995272ff192c8","observation_id":"60b2066d-46a7-4443-8f60-cb0a76d50422","resolution":{"observed_at":"2026-07-30T20:27:55.618016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:55.664596Z","title":"League: Guided skill learning and abstraction for long-horizon manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.664596Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:3412f1a957969d8afc23367bebdbfbdd25803631474342c0fb228dcb7a9c1b4b","observation_id":"ba848fe0-ee2a-4d70-992f-b219afd81d36","resolution":{"observed_at":"2026-07-30T20:27:55.664596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11477","last_updated":"2023-09-27T07:29:44Z","snapshot_observed_at":"2026-08-01T15:58:01.346044Z","submitted_at":"2023-04-22T20:34:03Z","title":"LLM+P: Empowering Large Language Models with Optimal Planning Proficiency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11477","snapshot_observed_at":"2026-07-30T20:27:55.708052Z","title":"Llm+ p: Empowering large language models with optimal planning proficiency,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.708052Z"},"links":{"cited_paper":"/paper/2304.11477","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:109e43ec142c549ea04bee0606e9c6bfe468cc74320848ba047050b1298ce41c","observation_id":"ec1e76df-e260-4d29-b698-8d237861a99d","resolution":{"observed_at":"2026-07-30T20:27:55.708052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:55.771822Z","title":"League++: Empowering continual robot learning through guided skill acquisition with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.771822Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:264177634ec49072f0163cefb291d547a9416e864b0fbbb598a1375005374a0e","observation_id":"dc4b6e49-de66-41bd-b3dd-c0636a36c8a6","resolution":{"observed_at":"2026-07-30T20:27:55.771822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-08-07T14:05:45.642543Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-07-30T20:27:55.866736Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.866736Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:07c79ea55ce6e2277464a7bea40b648fd2c54bcdac7c9563766e4c7638058a65","observation_id":"ced2984c-f95b-4194-8157-8f7abbb51cce","resolution":{"observed_at":"2026-07-30T20:27:55.866736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12931","last_updated":"2024-04-30T21:35:53Z","snapshot_observed_at":"2026-08-02T10:40:03.816188Z","submitted_at":"2023-10-19T17:31:01Z","title":"Eureka: Human-Level Reward Design via Coding Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12931","snapshot_observed_at":"2026-07-30T20:27:55.914370Z","title":"Eureka: Human- level reward design via coding large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.914370Z"},"links":{"cited_paper":"/paper/2310.12931","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:b66a40a70ac45cbaa90a602e658253003c2e09418b494517ab6f3fa6684d50ee","observation_id":"6978979b-9490-4f83-a153-4198a055011f","resolution":{"observed_at":"2026-07-30T20:27:55.914370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01967","last_updated":"2024-06-04T04:53:05Z","snapshot_observed_at":"2026-08-06T02:17:45.601842Z","submitted_at":"2024-06-04T04:53:05Z","title":"DrEureka: Language Model Guided Sim-To-Real Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01967","snapshot_observed_at":"2026-07-30T20:27:55.959639Z","title":"Dreureka: Language model guided sim-to-real transfer. arxiv 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.959639Z"},"links":{"cited_paper":"/paper/2406.01967","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:1c7b219b0c0189695b7c5e0a41ed043888ebb110c7c044f214fcfd56987de5d2","observation_id":"1f7bddc4-0155-4378-97e7-42058ae87c6c","resolution":{"observed_at":"2026-07-30T20:27:55.959639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-07-30T20:27:55.988732Z","title":"Do as i can, not as i say: Grounding language in robotic affordances,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:55.988732Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:d2210ac9196071cf8234bab03ca02564dfd8364c3857103d8128ad8a2911d8ae","observation_id":"7547f621-f55b-41f9-a429-1089d128a17d","resolution":{"observed_at":"2026-07-30T20:27:55.988732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06135","last_updated":"2023-09-27T23:17:28Z","snapshot_observed_at":"2026-07-06T15:53:11.310262Z","submitted_at":"2023-07-12T12:37:55Z","title":"SayPlan: Grounding Large Language Models using 3D Scene Graphs for Scalable Robot Task Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06135","snapshot_observed_at":"2026-07-30T20:27:56.042565Z","title":"Sayplan: Grounding large language models using 3d scene graphs for scalable robot task planning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.042565Z"},"links":{"cited_paper":"/paper/2307.06135","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:c6fefbee993a7df864d39adc61ff419182cd55b44a563da8b45afbddb6cb2b59","observation_id":"3969548e-c33a-478b-bcde-b60800432059","resolution":{"observed_at":"2026-07-30T20:27:56.042565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.100695Z","title":"Progprompt: Generating situated robot task plans using large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.100695Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:90d823d036b149a8c7faf50e76f8d2c07cc7c9ab8e181a95b55cca4f1b96415f","observation_id":"845e559d-5e72-4f41-ad84-ec21666dd2a9","resolution":{"observed_at":"2026-07-30T20:27:56.100695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.170009Z","title":"Language models as zero-shot planners: Extracting actionable knowledge for embodied agents,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.170009Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:822ed28f032c99741f1a46ce855ffadfa8e3907d94d4f0ca43d578404b0d9108","observation_id":"e8d63b76-87ea-42f4-877f-f76e59174cf7","resolution":{"observed_at":"2026-07-30T20:27:56.170009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.331901Z","title":"Code as policies: Language model programs for em- bodied control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.331901Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:92cdac71bb98957c0814ded768675bf9ca2322e3159d739861fec7ba9795870c","observation_id":"bceca78e-35fe-4089-a8fe-1e1234a32de9","resolution":{"observed_at":"2026-07-30T20:27:56.331901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.392352Z","title":"Text2reward: Reward shaping with language models for reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.392352Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:f592fb8a7df5398046703a5d1b5da5fe52d83728364bdd10207c5a270be5181d","observation_id":"c82f244d-d096-4415-96aa-74025a04d4a9","resolution":{"observed_at":"2026-07-30T20:27:56.392352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.500191Z","title":"Towards autonomous reinforcement learning for real-world robotic manipulation with large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.500191Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:6dd78a7c08b22e7743e105d4554a54ad36ad4b2a0642bb1cc5e97b3932c970ab","observation_id":"9b494a07-2dd1-4e07-8866-85b4c31b85f8","resolution":{"observed_at":"2026-07-30T20:27:56.500191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.560137Z","title":"Curricullm: Automatic task curricula design for learning complex robot skills using large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.560137Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:34e120ccfe6d9124d4a4e499b8c2159baeba2e69ca4b95fda2cd2c2e31fa6549","observation_id":"afc0a706-bf7f-47b9-acb9-c93e5aafad3d","resolution":{"observed_at":"2026-07-30T20:27:56.560137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08643","last_updated":"2025-02-18T16:45:59Z","snapshot_observed_at":"2026-08-09T11:31:44.840528Z","submitted_at":"2025-02-12T18:57:22Z","title":"A Real-to-Sim-to-Real Approach to Robotic Manipulation with VLM-Generated Iterative Keypoint Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08643","snapshot_observed_at":"2026-07-30T20:27:56.604936Z","title":"A real-to-sim-to-real approach to robotic manipulation with vlm-generated iterative keypoint rewards,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.604936Z"},"links":{"cited_paper":"/paper/2502.08643","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:0da4864d6b90143520a488e06fa9d68f4c0825d3a190b060d5f0390f2a9e1e91","observation_id":"fabdcdc1-322a-45ad-9cbf-33661fd7b2f2","resolution":{"observed_at":"2026-07-30T20:27:56.604936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-07T08:29:46.650400Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-07-30T20:27:56.609928Z","title":"V oyager: An open-ended embodied agent with large language models, 2023,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.609928Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:5a65490da3b913578f4ccf149de035492bad13c16eea3ddcd98eea1f3f4f110b","observation_id":"7b8356bc-3dff-4cad-85cc-98a74a8fc249","resolution":{"observed_at":"2026-07-30T20:27:56.609928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01775","last_updated":"2024-11-04T03:54:00Z","snapshot_observed_at":"2026-07-06T19:44:34.642049Z","submitted_at":"2024-11-04T03:54:00Z","title":"Eurekaverse: Environment Curriculum Generation via Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01775","snapshot_observed_at":"2026-07-30T20:27:56.614512Z","title":"Eurekaverse: Environment curriculum generation via large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.614512Z"},"links":{"cited_paper":"/paper/2411.01775","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:dd3b359ab125d990d41ec84648e7a856a065ecc3b2261c1ae22e2eee84533a13","observation_id":"e075bbba-c7b8-4282-beda-bbdf3e4e2b5d","resolution":{"observed_at":"2026-07-30T20:27:56.614512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.619062Z","title":"Reinforcement learning for classical planning: Viewing heuristics as dense reward generators,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.619062Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:68f6b1dc181e92167f057b6df391fa18d12685502c4f10988df2e2970ced8aa0","observation_id":"641b07a2-acca-47e0-aa43-f36fe3257da0","resolution":{"observed_at":"2026-07-30T20:27:56.619062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.623532Z","title":"Pddl— the planning domain definition language,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.623532Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:bc3b0d9d0d711cdf25823e79e461e2d9f2a7b53f5fe2bd8a72a578af828b7105","observation_id":"fb924ccc-4ec4-4a43-bd92-d05a0271adc4","resolution":{"observed_at":"2026-07-30T20:27:56.623532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03188","last_updated":"2023-08-30T03:47:34Z","snapshot_observed_at":"2026-07-06T16:03:10.517945Z","submitted_at":"2023-08-06T18:38:52Z","title":"Automatically Correcting Large Language Models: Surveying the landscape of diverse self-correction strategies","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03188","snapshot_observed_at":"2026-07-30T20:27:56.628437Z","title":"Au- tomatically correcting large language models: Surveying the landscape of diverse self-correction strategies,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.628437Z"},"links":{"cited_paper":"/paper/2308.03188","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:39b8ad925bbf4d137eb4de7666391120308cc1879ec28bcb815acb7952076abc","observation_id":"b247f5d4-ff8f-45e0-a3f7-d2e6eb77ec96","resolution":{"observed_at":"2026-07-30T20:27:56.628437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.633506Z","title":"Position: Llms can’t plan, but can help planning in llm-modulo frameworks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.633506Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:cadf8f44928e6d4c3a22458c8ea499b199257d3bacb2c9c066bbc932e81d9da6","observation_id":"e0235542-805c-4fb5-8f4c-18073bdb8462","resolution":{"observed_at":"2026-07-30T20:27:56.633506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.638041Z","title":"Teacher algo- rithms for curriculum learning of deep rl in continuously parameterized environments,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.638041Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:50851c946921bf0f7dd452ac1fea3d116207c05ed29d8684c6ef85068736a6c9","observation_id":"bb4af504-1cc2-4a96-82e0-a793dad6289a","resolution":{"observed_at":"2026-07-30T20:27:56.638041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.642786Z","title":"Prioritized level replay,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.642786Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:1eca0ddca28319f2b1909b8770ba2a6f8911d53727c69cb38fb2b3ce661d9f26","observation_id":"b067b816-995c-487f-a971-855f58309073","resolution":{"observed_at":"2026-07-30T20:27:56.642786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.647097Z","title":"Active domain randomization,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.647097Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:162c030684e772856efe623e0a825c932b7304e4ec033aa8c2d66b72e12aa346","observation_id":"4663ea1b-3fd8-4a2c-b439-c15da9e83d4a","resolution":{"observed_at":"2026-07-30T20:27:56.647097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.651576Z","title":"Self-organization of early vocal development in infants and machines: the role of intrinsic motivation,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.651576Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:75b55554f3788784691d948135525b4b02fd7fa723b54e36a4d6d43f44a970fb","observation_id":"be855369-26db-419e-a439-3d5e6fe1d3d1","resolution":{"observed_at":"2026-07-30T20:27:56.651576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.655937Z","title":"Automatic goal gen- eration for reinforcement learning agents,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.655937Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:0e2de930eee55466f0666c51847d1f1d1cb9412e8e6a88a4413e06f452a1c9bb","observation_id":"c2bf66fe-1ce1-4951-a76a-0adadae111fa","resolution":{"observed_at":"2026-07-30T20:27:56.655937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.660461Z","title":"R-iac: Robust intrinsically motivated exploration and active learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.660461Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:03a6526dec172bd5806bf5aee88bbc6a21df16b989da4032eb970d64acf4bc80","observation_id":"a170c149-ab82-4d32-9efb-916a0c80bb33","resolution":{"observed_at":"2026-07-30T20:27:56.660461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.665311Z","title":"Self-paced deep reinforcement learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.665311Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:6233a900c5a0cb742014bccd1b272d9d4eba9fd59d411975997233fd02be6de0","observation_id":"b6f2551f-da31-4c6c-94aa-4f9afd0d3ac5","resolution":{"observed_at":"2026-07-30T20:27:56.665311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.12892","last_updated":"2020-01-22T00:01:48Z","snapshot_observed_at":"2026-08-04T20:15:01.354750Z","submitted_at":"2019-09-27T20:11:12Z","title":"Automated curricula through setter-solver interactions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.12892","snapshot_observed_at":"2026-07-30T20:27:56.669813Z","title":"Automated curricula through setter-solver inter- actions,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.669813Z"},"links":{"cited_paper":"/paper/1909.12892","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:96e332c72059ed07e8568416c1643d045e5b305bbe703a860658c104d999e95a","observation_id":"d588c317-bf96-4b83-96b0-c18383de83d8","resolution":{"observed_at":"2026-07-30T20:27:56.669813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.674552Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.674552Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:05da03a61ddf5e64bf6ca75d570430e0037fa2d02d75cc69ef68b2549f21a736","observation_id":"8b0dc604-cac9-43ed-b3c8-da7fe4154e56","resolution":{"observed_at":"2026-07-30T20:27:56.674552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.679407Z","title":"Mujoco: A physics engine for model-based control,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.679407Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:2d112f3b090947e161037b0598fbda30f63ccf691dedc32efad4a787e419febc","observation_id":"01a4751f-d3d1-4be6-9d4d-6d4374bfb075","resolution":{"observed_at":"2026-07-30T20:27:56.679407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.683995Z","title":"Curriculum learning in reinforcement learning for multi-step manipulation tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.683995Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:6940a99624b3ff606dab9d88803ee2d3b77e27a60469a0bba3e29453c8578d78","observation_id":"a71133a2-eefc-4cfc-99f2-f7a42969148c","resolution":{"observed_at":"2026-07-30T20:27:56.683995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-30T20:27:56.688674Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.688674Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:e97d2f04ed452ac6ca15f500c1693c20e92efff122ab50755dfd04774a7a17a4","observation_id":"231dd5c1-cf06-4e8e-a5a4-055dc64a9d17","resolution":{"observed_at":"2026-07-30T20:27:56.688674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.694187Z","title":"Stable-baselines3: Reliable reinforcement learning implementations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.694187Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:492ab6925d2ebb502710d7a29b6c486485491bab4af0aa27fdb9f1e46038da17","observation_id":"91e553b2-408f-49db-912d-f8e378573fb2","resolution":{"observed_at":"2026-07-30T20:27:56.694187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:27:56.698753Z","title":"Gpt-4o mini: Advancing cost-efficient intelligence,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:56.698753Z"},"links":{"citing_paper":"/paper/2607.23515"},"observation_digest":"sha256:50cb966236a65ebdfa07ec5cc4a8b0dcf321a4a62417ef3c1c3cb9f0d663dc29","observation_id":"3dc95a22-a90b-4371-8d91-5a0e51d2a4e9","resolution":{"observed_at":"2026-07-30T20:27:56.698753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23515","last_updated":"2026-07-26T07:31:07Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T13:51:28.618124Z","submitted_at":"2026-07-26T07:31:07Z","title":"LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2607.23515."}