Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-07T14:10:10.212302Z
Paper Citation Record · LEDGER
As of 8 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 5 inbound Pith citation observations for arXiv:2505.19761.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-07T14:10:10.212302Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-06-28T22:15:13.878078Z
A source-named dated measurement, never combined with another source.
Source: arxiv_reference, observed 2026-07-01T19:36:09.116821Z
64 of 64 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation 9d07db5a-7295-42cb-bea6-e8b0e9b31242 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Do as I can, not as I say: Grounding language in robotic affordances
Reference 1
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation a722c448-b34b-4697-9588-f06d6c6dd6c1 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning The option-critic architecture
Reference 2
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation d2be6b60-0de8-46f4-9a21-1aef512d2deb · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning $\pi_0$: A Vision-Language-Action Flow Model for General Robot Control
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 289307af-8d95-485a-974e-6b20dfc44ac0 · outbound
Reference 4
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 796fa1f8-143f-4981-b713-bcf9fcb9e3c4 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Exploration by random network distillation
Reference 5
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 4e07b629-aa8e-4ecc-a5f4-db57fc4ab08d · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning FireAct: Toward Language Agent Fine-tuning
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9b6de2aa-24f4-4e91-a5d9-3fefab329281 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning AgentVerse : Facilitating multi-agent collaboration and exploring emergent behaviors
Reference 7
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation d32de7ba-44ca-4ab5-b97d-ec22890804e2 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Unresolved cited work
Reference 8
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation e4be9148-0eb1-43e9-9027-29071750a07c · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning M., Hao, B., and Van Roy, B
Reference 9
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation db524625-8384-4c06-a8fb-106df05b7656 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Off-policy deep reinforcement learning without exploration
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7bbc3abe-c7af-42c5-8d23-92ae46e2969b · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Strategic Reasoning with Language Models
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6328885d-5939-4bae-8b6e-560f21a47f00 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8fd853a4-a4a7-4bf4-a975-3bd33e9d9a63 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0b40f5b6-f192-4a5e-bde9-97e46e2562ac · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor
Reference 14
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 819c0c3a-020b-45fb-b08b-477d2d69551a · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning J., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., et al
Reference 15
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 613b845b-1b4d-4796-bece-74af77b6b1e3 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Mistral 7B
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f18cde6b-72fc-4d04-965b-ffc3fc988e3b · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning and Tsitsiklis, J
Reference 17
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 0b34ae5e-466c-4a74-8511-892be0c26f13 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Offline reinforcement learning with fisher divergence critic regularization
Reference 18
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 319fa590-4745-4bd9-a996-5baecd7a2daf · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Offline reinforcement learning with implicit Q -learning
Reference 19
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation a908e7ec-780d-4ac8-aeef-94c2b913ce61 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Conservative q-learning for offline reinforcement learning
Reference 20
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 78a1cb6c-17e3-4867-bdc6-02a0c6111f80 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Offline-to-online reinforcement learning via balanced replay and pessimistic Q -ensemble
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 9058df54-5295-4725-90ea-4206a20bccf9 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7b5689fc-12fe-4cb2-a50c-3a77ace1c66f · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Learning multi-level hierarchies with hindsight
Reference 23
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 487df6e2-9e17-43f1-a4e9-1eb6f6c52caf · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Sub-policy adaptation for hierarchical reinforcement learning
Reference 24
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation d53069d9-d50c-46d0-9dcc-8da3b2ef9c00 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Pre-trained language models for interactive decision-making
Reference 25
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 3ff69c08-a549-4fb5-b8aa-830304fb34d3 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Optimus-1: Hybrid multimodal memory empowered agents excel in long-horizon tasks
Reference 26
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 57fd0717-282a-4b0a-ae9a-27b6bedfb48d · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Y., Fu, Y., Yang, K., Brahman, F., Huang, S., Bhagavatula, C., Ammanabrolu, P., Choi, Y., and Ren, X
Reference 27
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation ae985a6f-8e1c-4c2b-ab7d-149aa6803a82 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning WizardCoder : Empowering code large language models with evol-instruct
Reference 28
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 7ccabb6a-d1e4-4962-a23a-1c4c0de5c182 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Large language models play StarCraft II : Benchmarks and a chain of summarization approach
Reference 29
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation fcb8a6c0-db08-4d4e-874d-382e06b90512 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Random latent exploration for deep reinforcement learning
Reference 30
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation f9aae58d-80e1-4cee-a254-a3518ae47105 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Introducing Meta Llama 3 : The most capable openly available LLM to date, 2024
Reference 31
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 29f99d6a-2af5-42a3-a2f9-da319bea9f49 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning S., Lee, H., and Levine, S
Reference 32
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation bc381cf7-0efb-4f86-95dc-7ecc932b2e4f · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning AWAC: Accelerating Online Reinforcement Learning with Offline Datasets
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3ace0f39-234c-43ff-af15-f5797e3e83f5 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Training language models to follow instructions with human feedback
Reference 34
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation b1de15fc-17b2-4ff3-a9bd-8c415313b8ef · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Agent planning with world knowledge model
Reference 35
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 4776b385-8e62-47de-be6c-8e28b200137b · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning D., Ermon, S., and Finn, C
Reference 36
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 3952f539-f130-45db-85cc-da379d8d9b3e · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Vision-language models are zero-shot reward models for reinforcement learning
Reference 37
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 2cc8757b-1210-4607-8608-cc1de01707c5 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning LM-Nav : Robotic navigation with large pre-trained models of language, vision, and action
Reference 38
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 89449e9f-520f-42e1-858c-fdd1e180e67a · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning R., and Yao, S
Reference 39
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 4018fc4c-3c74-48ab-b043-127f74412a6d · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning ALFWorld : Aligning text and embodied environments for interactive learning
Reference 40
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 990d2e2e-6975-4aca-bd16-f1b701435349 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning J., Guez, A., Sifre, L., et al
Reference 41
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 7516a701-86be-4265-a00b-2e4f71025de2 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Unresolved cited work
Reference 42
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1c81e55a-07b8-4f71-aee3-d8adf7f4f5ff · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning V., Kostrikov, I., Su, Y., Yang, S., and Levine, S
Reference 43
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation e495eefc-6550-4c38-92f0-d13fa9830d83 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Unresolved cited work
Reference 44
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation cf82ee6d-9e04-4a2e-a65f-775399f8cedb · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning S., Precup, D., and Singh, S
Reference 45
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation d5382900-7b59-461f-b1dd-80846282a29d · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning D., and Toshev, A
Reference 46
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 0101f403-ec39-4b99-84e6-c1ecfc1f4cf3 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning True knowledge comes from practice: Aligning large language models with embodied environments via reinforcement learning
Reference 47
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 33c33ad7-14a3-4e3f-86f5-90945701cb48 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Gemma: Open Models Based on Gemini Research and Technology
Reference 48
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1723885e-f9f5-4c7b-b879-4d449a030dbe · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning K.-W., and Lim, E.-P
Reference 49
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 86cd567c-16ef-4247-afda-fe2b444cd59a · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning ScienceWorld : Is your agent smarter than a 5th grader? In Proceedings of Empirical Methods in Natural Language Processing, pp.\ 11279--11298, 2022
Reference 50
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 748cf0a8-fb8c-4516-882a-c84645db6add · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Learning From Failure: Integrating Negative Examples when Fine-tuning Large Language Models as Agents
Reference 51
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9255f265-83f0-42d8-93a7-edec033e530a · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Train once, get a family: State-adaptive balances for offline-to-online reinforcement learning
Reference 52
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 07a6e097-2acc-417a-9928-e0d07247b6bb · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning V., Zhou, D., et al
Reference 53
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ddd918c2-3de6-4f56-9bc8-1f16419d28cd · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning and Jennings, N
Reference 54
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 2c1f8ae7-6869-4559-94c5-4013f2ab54dd · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning The Rise and Potential of Large Language Model Based Agents: A Survey
Reference 55
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c70ee563-a50c-4e93-979c-51288df6d0a9 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Language agents with reinforcement learning for strategic play in the werewolf game
Reference 56
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 0185b1c2-0b29-414c-b1c1-c5794eee1498 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning L., Cao, Y., and Narasimhan, K
Reference 57
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 817ec64a-3d18-48ab-9631-d848d3332896 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning ReAct : Synergizing reasoning and acting in language models
Reference 58
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation fc3a4105-8d4c-4a4e-a273-14bf42a0acd4 · outbound
Reference 59
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 48c2b5e5-ade5-4ae1-8b20-498d33b23bb1 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning AgentTuning: Enabling Generalized Agent Abilities for LLMs
Reference 60
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6a976452-1826-4171-81c3-eabbf5704b52 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning Fine-tuning large vision-language models as decision-making agents via reinforcement learning
Reference 61
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation fd947cf8-8c63-4b6d-ad67-9eac04d6b612 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning V., and Chi, E
Reference 62
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation f01e7953-3233-4980-930d-fd6b86528269 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning ArCHer : Training language model agents via hierarchical multi-turn rl
Reference 63
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 957e7a45-d9e3-4f42-9ef8-5939a58610e6 · outbound
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning write newline
Reference 64
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 78f0ead6-0e63-42c4-9531-88f652aca04e · inbound
Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning
Reference 226
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 9085988c-cfee-4f5c-9c20-28609aaea7a6 · inbound
Agentic Reasoning for Large Language Models Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning
Reference 131
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 3ee393cc-93e7-424b-a369-c7cbf8af333f · inbound
HiMAC: Hierarchical Macro-Micro Learning for Long-Horizon LLM Agents Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning
Reference 19
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 68d5c6ab-a654-4ac0-becd-bec365c45249 · inbound
Moira: Language-driven Hierarchical Reinforcement Learning for Pair Trading Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning
Reference 22
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 14b9cd96-96f3-4b2a-864d-29f7400d0a09 · inbound
DeSQ: Decomposition-based SPARQL Query Generation Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning
Reference 57
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.