Pith. sign in

Paper Citation Record · LEDGER

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models

As of 19 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 1 inbound Pith citation observation for arXiv:2411.14457.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.14457 v1

Coverage vector

measured 59 of 59 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T19:34:41.907594Z

measured 60 of 60 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T16:23:32.867331Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-06T16:23:34.078888Z

Reference resolution

59 of 59 outbound references displayed

  • verified exact0
  • verified fuzzy1
  • unresolved57
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 40a1cc83-c532-4c0d-be6f-d151235db974 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.646213Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.646213Z digest=sha256:9fb96677c77852bfcc7379cf471986dd5b11dbc0b255eaccaa7538b364ca53be

Observation 8da97f0c-7875-4c75-bdc7-92edb1df8eef · outbound

This paper cites GPT-4 Technical Report.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models GPT-4 Technical Report

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.651812Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.651812Z digest=sha256:ab485655110771ca5be467de81083496af14f2d32a68f51098b803affaad818c

Observation 30b10aa2-93e1-4bd7-9a61-d7ab88270b15 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.656837Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.656837Z digest=sha256:34b4823ab001e68ccf8f8caea6aa6ee4c4d8724dfd4e1c2f2ee3cdd72e2e04cf

Observation c24f2d9d-f145-49e7-85ad-bb5e2b9e6482 · outbound

This paper cites Deep Reinforcement Learning from Policy-Dependent Human Feedback.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Deep Reinforcement Learning from Policy-Dependent Human Feedback

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.668581Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.668581Z digest=sha256:e1e7822b78fcb0d44932ece6b661433bcf8dd1dcd9e9f8b8e17f90f67ad4712b

Observation 3ad25830-1a58-4ea1-be2a-b87f7ac427e8 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.574987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.673817Z digest=sha256:9a1206a3e1a3f3dad01a4fc20b10614da59eb3717ee90ff582713665573fb517

Observation 03765f5f-3fde-4ada-b1a3-18de442e58c8 · outbound

This paper cites ChatGPT is a Knowledgeable but Inexperienced Solver: An Investigation of Commonsense Problem in Large Language Models.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models ChatGPT is a Knowledgeable but Inexperienced Solver: An Investigation of Commonsense Problem in Large Language Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.678501Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.678501Z digest=sha256:8921e701c62f379d2ee2c29a6d24bb17bb02900e89d9fc9993c286794ad68b90

Observation 88ebe1b2-d585-4f0d-809e-c36e72a73cc9 · outbound

This paper cites Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.684020Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.684020Z digest=sha256:7590bb25fbaeeae8e3afcca467226b96257a0e6b472b91d041b18d049f85dea0

Observation df3919e8-875b-4a02-ad71-e9b17194526e · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.561724Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.689116Z digest=sha256:5864955449f878bbdb51f652b0bf17e53bb2b24728dfc8f38c71476efa7a2c68

Observation 3f8338df-cbaf-45a4-80a9-23bb5bbf69c0 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.550058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.694384Z digest=sha256:d6cc4740f360b2492535648f968e482cf2cca553925dc9fbace41c729f487eda

Observation 7fe2e24d-4ae1-4be3-83bd-24929adf7adc · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.536955Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.698793Z digest=sha256:473d3f7087b41f96acc56393065290874b336bf77cafc880170106cc4268b745

Observation 79cbcea4-a194-45c3-a996-d3f02aa5ee61 · outbound

This paper cites Accelerating Reinforcement Learning of Robotic Manipulations via Feedback from Large Language Models.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Accelerating Reinforcement Learning of Robotic Manipulations via Feedback from Large Language Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.703104Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.703104Z digest=sha256:481f5dee008f4fb616833fafc61841d72db3d4b4b95fdff0f343654378b4d99f

Observation d1e9cfa7-eca2-4b93-ac32-dab53e149beb · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.524723Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.709035Z digest=sha256:5f05b09f08e0a73a9a8452c973edb61f541245d900f3de362cbedb189a68260b

Observation d9173cde-c8c2-4051-864b-66c47ea784ac · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.713473Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.713473Z digest=sha256:890f1ff14a62087ad6e00d18ac959f718373d09b53ff4b37094657d0d2ea88d5

Observation 289d4a4f-b3ac-4452-97ec-90a403848d7c · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.503711Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.717636Z digest=sha256:2a41d88643274ff875c0a6b6daeda3e70327a7078c1d29be6c1d211d4e2848be

Observation f9e84247-7236-49d7-bac2-ef760519605c · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.491667Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.721365Z digest=sha256:4f996c705863e2c0271c3b188e24da69e15b22577bb8bd65c134d5797fb87e23

Observation 6e84c4d1-8678-4e6b-9c0b-14d0f3e2b41b · outbound

This paper cites On the Importance of Uncertainty in Decision-Making with Large Language Models.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models On the Importance of Uncertainty in Decision-Making with Large Language Models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.725138Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.725138Z digest=sha256:9df368c9e61cab5281cee285874c944d8797a890c51cd658876c75e8a367a84d

Observation ba09c59b-fe28-4763-b7fa-b78cf39071de · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.729045Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.729045Z digest=sha256:1213cd92447e85a2a7c8209a6244535d136ce2483c547c0f7355ce3fa52394cf

Observation bcda8ef2-ab01-4bdd-938f-a5c99fe1707d · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.733423Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.733423Z digest=sha256:fa22667d532f10c145812850b829d11af016c45b6d039cb85543eacf7749a2b7

Observation d865dc5d-fa4e-4b15-8a75-15d2183940fd · outbound

This paper cites Guiding Reinforcement Learning Exploration Using Natural Language.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Guiding Reinforcement Learning Exploration Using Natural Language

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.737300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.737300Z digest=sha256:c0731bcccfc09ac52a3487e92bc3af528914d3570bb32dfc781664a4093d98a7

Observation d0b1d895-9e7d-45f7-ab4d-89c89318ae70 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.464841Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.741844Z digest=sha256:7f346a68ba460a19fc7cccede8f7a117f462d8e54c66f0796405f2b86c3709b3

Observation 18d5c70a-b7a0-47e1-96c4-b420f8693394 · outbound

This paper cites Look Before You Leap: An Exploratory Study of Uncertainty Measurement for Large Language Models.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Look Before You Leap: An Exploratory Study of Uncertainty Measurement for Large Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.745863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.745863Z digest=sha256:30ae620c9a6f40fb6e9338be3227a61b950944a1d69446b3ca62ed2fa3bde8ba

Observation 6846a880-475e-4c48-ae8c-0154cccb66ed · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.452281Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.750658Z digest=sha256:453ae034e323b6a9e28810506ead0d41479ddd1514e8f929edba158eddaf2d71

Observation c1a16b08-a949-45d3-a727-b674fdb2c4f8 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.754398Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.754398Z digest=sha256:ec73ebc303a20f815d455eeb38778e844eab042600536294f6b59a70d38e5318

Observation 5ba27ffe-2e34-4edf-b431-142243c820bb · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.759746Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.759746Z digest=sha256:f41f55fc6c90c1ae562d964bcb85dee35c9fe6cb4a1eb39e252773d57d24cf25

Observation 26868cb3-1a4b-4e66-8672-72c29b50482e · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.422572Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.763797Z digest=sha256:d1a2b04332814e40ab864a63525f808fea11aed1e104b500032d6f293c30b620

Observation 2240a49b-a9a5-4d9a-b14f-bd44bdb4ab36 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.768289Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.768289Z digest=sha256:9ee488c203c3e9561e7f956c5792c29879384b63851fc9100bfaa1367d04efb3

Observation 3afa7b64-0140-447e-a6ed-6401be30f49e · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.404161Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.772296Z digest=sha256:b3be4ebe3971463b25c83c48b4db312bf9ea1c608fbac527d24d2b9f2d9c753b

Observation 5de79e6c-e55f-45c3-b338-91f9b0f36aad · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.391247Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.776134Z digest=sha256:d63602aeeb05108101666e703f8c2a8a5b0945b08f9b60f16dbf3c9c55a5fbb3

Observation d7b793d6-24aa-43de-bdc0-96e0ef1f871c · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.780489Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.780489Z digest=sha256:3851a8bba7e3b80d447cd4bce3483a2d52b6ab1e6e95a674fbb19ab302a41bd4

Observation 58ac7936-4156-4410-9f3e-7a1a851df054 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.784982Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.784982Z digest=sha256:ae7924ffd98a5b2177971d88e8907aed6f75b559dd75c697274cc14dacbf657a

Observation 5dd42ddb-6798-4bf0-a126-f722e0554956 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.364644Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.791601Z digest=sha256:b63716dae6f2638bb5597b70e54bb3fb3efdfa141467d828e00154d51611e716

Observation 54a360bb-6601-429e-9e53-eba161315547 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.353220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.796144Z digest=sha256:e63444561c389984170b0ac259e928bb5ee2de25122d170a515879595efee47e

Observation baf9c4b9-e279-4d8b-8deb-8937d0494f74 · outbound

This paper cites Learning to Model the World with Language.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Learning to Model the World with Language

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.801224Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.801224Z digest=sha256:87e322249fd92809d4523d098dcaa770dd489bae8eb867cef402de2b2eca715d

Observation c41b99d3-f011-4551-be8d-af73b8160ff2 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.340285Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.805642Z digest=sha256:f51c4fadce7c5d9dfe3854d58d533f85a861320080453e76bc62847aeaeddb7e

Observation c0b4eb37-57da-4d0e-968b-39d14e1744cd · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.809944Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.809944Z digest=sha256:644a900055754df08a0bece30623a815b160810798c3510e076f415d14840d42

Observation 12ebd4a6-759c-464d-a62c-c2fde5d7db11 · outbound

This paper cites Prevent the Language Model from being Overconfident in Neural Machine Translation.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Prevent the Language Model from being Overconfident in Neural Machine Translation

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.814602Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.814602Z digest=sha256:6f4b64c132c4ed4bd33d542cec4992057959885ec9d0e18b71a527a5c93d7d18

Observation 58aedbe4-441c-4847-b732-d533b13f5e5c · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 37

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.317587Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.819281Z digest=sha256:2185eef8e17865095a3e5e1bd3ed1c607b709442ec96fe9522d9e88cb218b2cf

Observation 8c626b34-ed7e-4c37-a6c0-c36d5552f1f3 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 38

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.304675Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.823164Z digest=sha256:5755b80fd62d90b0a610e0a316809499720e9baa2123aac9adbfc998297425da

Observation 87c968f1-dc22-439a-aaa4-a8ee6d685df0 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.827077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.827077Z digest=sha256:9222a3505433004afea0b1015167f1989286d780eb3f2d576ec48e3c7592772b

Observation 7f4040a5-788e-4548-bc9e-213d753a65c3 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 40

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.284370Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.831346Z digest=sha256:c748c3189c31fa974cdf1c6c696e8119564eda7747db2720512f48fdee12b1d2

Observation 667e3f7c-33bf-4b2e-9a3c-34bf1c2f596c · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.837636Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.837636Z digest=sha256:078da227416ccb5692f2dcda0f2909e4cfca291a903864ca2414cb686b3f80af

Observation 3d59a283-29e4-4ee2-af23-509ce85617d1 · outbound

This paper cites Select Committee on Artificial In- telligence.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Select Committee on Artificial In- telligence

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T19:34:42.262933Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.846222Z digest=sha256:e9f8ac7b8087c47d62eb84332fe73d80ccaf68062cde2300e5304568ba4ba351

Observation 624b186d-c132-4f7a-a82f-6c0f25de9075 · outbound

This paper cites Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.850850Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.850850Z digest=sha256:b2152e38eaa64f6719f1396005a57938af2adb40ecfaf895945f4add34f9c83c

Observation 6ed4a278-315e-4f06-84c9-21e34e4fa554 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 44

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.249991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.855480Z digest=sha256:6afddbf333c81456674ee439a27b5a7af6ecd9e2c1c07a393b01827f9233c757

Observation ec205bc3-b000-432c-b47b-8975809dd078 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 45

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.238396Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.859102Z digest=sha256:1c7e1db3c327d68ff59b1beead76eaa69a0f9815f9c7908d87982a0612a3ebb7

Observation 54eed5f6-ff51-4dc5-9657-2b3598846450 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 46

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.225959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.862679Z digest=sha256:2af597211f13ace02757f87d5f61aa0ca29b058629ed78620f378f829e1e552e

Observation c39d75ce-2379-4faa-b0a8-ed1aad0157cb · outbound

This paper cites Understanding the Capabilities, Limitations, and Societal Impact of Large Language Models.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Understanding the Capabilities, Limitations, and Societal Impact of Large Language Models

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.866456Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.866456Z digest=sha256:36e663d581d0e1130a3e06acc8b090c307a97477b61635b5282a1a0dc61da640

Observation 7d100d2d-0584-4d85-8dca-df27aa16ef51 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 48

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.213393Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.870400Z digest=sha256:18e3142c1340e4295cd8278e6c3dbf994ace701fc9a5757ef87abb26d803274d

Observation 22db6783-e769-4ef9-8500-2c3220abc155 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.879299Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.879299Z digest=sha256:ad322ba3d8f79e758bb441dd6ad0e845a4cfb016e209750d06793ba3cfdc2d78

Observation 4ffcaaa4-aa61-4074-a1b0-beb3b85fc88c · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 50

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.191345Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.883966Z digest=sha256:692ecd5a448828d19f000cf5499ccd7a2a4ad83f9f20adaefe52186e5b173b16

Observation a6b82b9f-4b35-4379-bf5a-90e4f4699d2b · outbound

This paper cites Larger language models do in-context learning differently.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Larger language models do in-context learning differently

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.888302Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.888302Z digest=sha256:41a78ecdb6b5e9e0e95ffa36225a384ef6449686bdd0bade2bb62d59666cb2fb

Observation 411d1e64-98e0-434a-984c-0fcfbf684518 · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 52

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.178006Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.892387Z digest=sha256:8accfc175a1e4a9dfa83715c95b53249993140c809ea47ebaba1389707be3fcb

Observation b15d3b76-c645-42e4-8848-c53fc2b36824 · outbound

This paper cites On Hallucination and Predictive Uncertainty in Conditional Language Generation.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models On Hallucination and Predictive Uncertainty in Conditional Language Generation

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.896085Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.896085Z digest=sha256:95bf7f43e8441abc4918f4e09626c00c558001c0207c056cc7bdb20dc72166b9

Observation db6d92bd-d6d4-49bb-9b9e-173ef398cb9b · outbound

This paper cites Keep CALM and Explore: Language Models for Action Generation in Text-based Games.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Keep CALM and Explore: Language Models for Action Generation in Text-based Games

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.899943Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.899943Z digest=sha256:2d1ea1efb29ddaa1363114614992da83515a1beebac3b6a7fa700b463110ea69

Observation 37e18345-1d76-44aa-84e4-ecc5ce467812 · outbound

This paper cites Learning Shaping Strategies in Human-in-the-loop Interactive Reinforcement Learning.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Learning Shaping Strategies in Human-in-the-loop Interactive Reinforcement Learning

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.903610Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.903610Z digest=sha256:73a39cfd2db1364e481e17d9991504124a5db42e8b5016f28c504dbd3ec1fc00

Observation 4117b3c4-8fb4-4568-862e-0a6f7bbc835a · outbound

This paper cites an unresolved cited work.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Unresolved cited work

Reference 56

Resolution
unresolved
raw_fallback, observed 2026-08-12T19:34:42.165813Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.907594Z digest=sha256:c81eb239bf7394917f379188e02e6727535acd68ce02eaababdb2f0bce5a453d

Observation 68eb32ac-8a84-4447-8776-017ba70b072a · outbound

This paper cites Proximal Policy Optimization Algorithms.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Proximal Policy Optimization Algorithms

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.841695Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.841695Z digest=sha256:d41ab82c9510126cc9102245f55f3914e6b3541dc63c26ab799ab0604900a97b

Observation 776fb0eb-36d4-440a-83c3-30817678588b · outbound

This paper cites Influencing Reinforcement Learning through Natural Language Guidance.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models Influencing Reinforcement Learning through Natural Language Guidance

Reference 2021

Resolution
metadata mismatch
local_arxiv, observed 2026-08-12T19:34:41.994320Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T19:34:41.874350Z digest=sha256:3e137110c5a4b8203766cbce08f561eee3ae1fc940680e9d50c440998b3ba43b

Observation 009bcc72-70d8-4344-bc2c-61ffb5e3022c · outbound

This paper cites What learning algorithm is in-context learning? Investigations with linear models.

Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models What learning algorithm is in-context learning? Investigations with linear models

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-12T19:34:41.661211Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:34:41.661211Z digest=sha256:9eb090cdcd04072fcd130d2b5e8a7d3e71743f5ac6351e3d054805b46b72362c

Pith citing papers

Observation d63f222f-670d-4c71-beff-8e272a5254c5 · inbound

LLaPipe: LLM-Guided Reinforcement Learning for Automated Data Preparation Pipeline Construction cites this paper.

LLaPipe: LLM-Guided Reinforcement Learning for Automated Data Preparation Pipeline Construction Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models

Reference 28

Resolution
verified exact
local_arxiv, observed 2026-08-06T16:23:34.168092Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T16:23:32.867331Z digest=sha256:2ced76d6f997b1e8ed41f54b8e329715d169b9e9711a43434be4d9a169bef5bb