Pith. sign in

Paper Citation Record · LEDGER

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks

As of 22 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2608.01649.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.01649 v1

Coverage vector

measured 20 of 20 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-04T23:40:16.865390Z

measured 20 of 20 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-22T06:32:14.747728+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

20 of 20 outbound references displayed

  • verified exact0
  • verified fuzzy20
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 65e7acd9-45bc-4afc-bbdc-3505d84a4fa5 · outbound

This paper cites Comprehensive analysis of recent leo satellite constellations: Capabilities and innovative trends,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Comprehensive analysis of recent leo satellite constellations: Capabilities and innovative trends,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.225412Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:15.055304Z digest=sha256:a087b26dbe60e356ab6da350ea65917bbf5ef9d9727e072b7c9616c5afdb7fed

Observation d6f3c786-139a-4fdb-bc80-c3b64ff2d7d8 · outbound

This paper cites Low earth orbit satellite network routing algorithm based on graph neural networks and deep q-network,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Low earth orbit satellite network routing algorithm based on graph neural networks and deep q-network,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.208412Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:15.134876Z digest=sha256:b7dc85ac808fd239d4588c7fa621f95e3d9e8e7e1a164313f16ce7ec879bdb7b

Observation c95a6e30-a65d-40a9-b135-9d2e8f120959 · outbound

This paper cites An integrated routing and data fragmentation strategy for optimizing end-to-end delay in leo satellite networks,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks An integrated routing and data fragmentation strategy for optimizing end-to-end delay in leo satellite networks,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.192278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:15.239984Z digest=sha256:0d107d7f3fb186f904b9cd78e3e34f2e29ba06948ab1586031f7104a2f02c808

Observation 974637e2-0ad5-4594-a59f-8f00099bc9ed · outbound

This paper cites Reward design with language models,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Reward design with language models,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.175980Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:15.325224Z digest=sha256:2def73e13a355b69283d3127e09defc8c677aeca6fd01b6ff948ff3aecb8ce04

Observation 9b8a80fa-17fd-43e1-8c16-926d68e3992b · outbound

This paper cites The perils of trial-and-error reward design: misdesign through overfitting and invalid task specifications,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks The perils of trial-and-error reward design: misdesign through overfitting and invalid task specifications,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.160520Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:15.404338Z digest=sha256:51044a7642f48ffe4f8f8fda68fb0df7aa368806c7570265f15c850b5928892f

Observation 0292b561-4e2e-4095-9002-d0129fbcbcfa · outbound

This paper cites Language to rewards for robotic skill synthesis,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Language to rewards for robotic skill synthesis,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.144253Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:15.448430Z digest=sha256:20e6785cf0df023e63bdb59090255d636433f4aeee567c1aa36bf3c9a68d89e0

Observation 6fb3ab15-40ee-4849-a390-69d124ca725b · outbound

This paper cites Text2reward: Automated dense reward function gen- eration for reinforcement learning,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Text2reward: Automated dense reward function gen- eration for reinforcement learning,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.127932Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:15.525791Z digest=sha256:c088b9ce30e020e1792751079a00692eede0c4e07d35736ecd44e99bdada1c2e

Observation 954aa18c-f2f4-4d87-a9c2-7bc567c95276 · outbound

This paper cites Reward design framework based on reward components and large language models,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Reward design framework based on reward components and large language models,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.112641Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:15.694155Z digest=sha256:e056f46e38f2ee8bce08d659b3e72de51c4ac250618893bf2b3e39a3373dd569

Observation 09a9e851-e56e-4ad9-bfb8-2a9121a4066b · outbound

This paper cites A large language model-driven reward design framework via dynamic feedback for reinforcement learning,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks A large language model-driven reward design framework via dynamic feedback for reinforcement learning,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.097055Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:15.832600Z digest=sha256:18065dd7041a6848c44321969b502394f21f15da57917ec53e99465f4b02023d

Observation f86e4190-ef3b-4af2-b88a-98d970948224 · outbound

This paper cites Autoreward: Closed-loop reward design with large language models for autonomous driving,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Autoreward: Closed-loop reward design with large language models for autonomous driving,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.081013Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:15.941147Z digest=sha256:a7d91c2663acc3ab8cd6223d344cc7f5c62deff2948c2a24a939b205e8bff8c6

Observation 1b63e86c-652f-4868-acbf-a5db44000199 · outbound

This paper cites Chatpcg: Large language model-driven reward design for procedural content generation,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Chatpcg: Large language model-driven reward design for procedural content generation,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.065465Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:16.052414Z digest=sha256:cc7c848a4393116ad43d0a9c49652077749fac70f51cc164d820cf8f2546a253

Observation f69e2054-25a2-484d-bad1-8a997c5191df · outbound

This paper cites Llm-based reward engineering for reinforcement learn- ing: A chain of thought approach,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Llm-based reward engineering for reinforcement learn- ing: A chain of thought approach,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.048226Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:16.059566Z digest=sha256:88ca52a7901fa5d1bbe9232e4f7760db286f798bc3c8e0a9eca46d9b35674780

Observation ec8d0db7-1023-463f-a2de-515dc3e0d1fc · outbound

This paper cites Large language model (llm) for telecommunications: A comprehensive survey on principles, key techniques, and opportunities,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Large language model (llm) for telecommunications: A comprehensive survey on principles, key techniques, and opportunities,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.030204Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:16.199844Z digest=sha256:873f5c1a7fa26780c6cf70810aaa041669baaf112b96b5a2f9eca37aba06237f

Observation 7fecb655-6414-46c5-b640-d8602491a6f7 · outbound

This paper cites A comprehensive survey of large ai models for fu- ture communications: Foundations, applications and challenges,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks A comprehensive survey of large ai models for fu- ture communications: Foundations, applications and challenges,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:17.014447Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:16.279223Z digest=sha256:96d42e0296f830a32025d034c38c11a2665d2263ace76824e841ae08dafc020c

Observation cc39d6ad-e747-4214-b991-639947ba74e4 · outbound

This paper cites Large language model-enabled reinforcement learning for wireless network optimization,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Large language model-enabled reinforcement learning for wireless network optimization,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:16.997647Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:16.331587Z digest=sha256:5b1c0d17290a078271d1e710911143274918c4c7393c21e79c6fa1fc39c40b90

Observation b47210e5-3bc4-4a02-a7be-967eaff23c54 · outbound

This paper cites Large language model-enhanced deep reinforcement learning for secure data collection in low-altitude economy networking,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Large language model-enhanced deep reinforcement learning for secure data collection in low-altitude economy networking,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:16.980015Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:16.437277Z digest=sha256:6a45e509d21faa37dbf4a97783c10b01c6cf14f562702a02b2bf6e92e7bed756

Observation 05642e42-a79d-4bf1-9d78-80743bba04f5 · outbound

This paper cites Where do rewards come from,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Where do rewards come from,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:16.963343Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:16.510044Z digest=sha256:04f8b131bbb7fdb1347ff1b2da775c5474cdd715c7b6493e2fdb9b67f5b154d5

Observation a762f6ab-7ef3-4765-a69a-dcfbfcc2c53b · outbound

This paper cites An open source multi-agent deep reinforce- ment learning routing simulator for satellite networks,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks An open source multi-agent deep reinforce- ment learning routing simulator for satellite networks,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:16.945444Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:16.617356Z digest=sha256:92e758b42f0b260b951e0a5fbd6b567387a67300dc70c78396eff72cfdeaddab

Observation 75262587-91f5-4b0a-9b50-7bc619df6915 · outbound

This paper cites GPT-5.4 Thinking System Card,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks GPT-5.4 Thinking System Card,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:16.926813Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:16.753563Z digest=sha256:80ffcb6eb8da14a77b12cf8219e82002dec2c90a40d7b742647ff8ae03155ce8

Observation 500c358c-6943-40d7-992e-158b14670887 · outbound

This paper cites Claude Opus 4.6 System Card,.

LLM-Driven Automated Reward Design for Reinforcement Learning-Based Routing in LEO Satellite Networks Claude Opus 4.6 System Card,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T23:40:16.907553Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-04T23:40:16.865390Z digest=sha256:47af394d10abe48da43257c8bc302fdfb1d4b08b6c2c14e695dd56b63d780df7

Pith citing papers

No inbound Pith citation observations are available.