Pith. sign in

Paper Citation Record · LEDGER

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems

As of 23 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2506.22112.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.22112 v2

Coverage vector

measured 19 of 19 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T22:14:47.639455Z

measured 19 of 19 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-23T06:30:58.430688+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

19 of 19 outbound references displayed

  • verified exact0
  • verified fuzzy1
  • unresolved18
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 7c0c26d5-efe2-4886-abf2-53f632df45c3 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:49.440511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:46.660354Z digest=sha256:4a29ad886654b63eb95563c541eaa86008c1a25756ec10fda567a5216082a872

Observation ecbc2689-411b-4c15-b18c-82a1eeeeab11 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:49.213100Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:46.731263Z digest=sha256:95196b38601bf73c5fb9063a444d005475405cd64d7b468da86b5811b01bbebe

Observation 90c4fd0e-f733-4e8e-81d4-4315436f2441 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:49.110087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:46.775310Z digest=sha256:00f76122e3d9f3162cfd97a986041e3e0779dd4ff9648f88ef9016bf25deeb29

Observation 99b05cc1-01f9-4e8c-ae22-b6e28a0f5d79 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T22:14:46.835343Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:14:46.835343Z digest=sha256:a1a75a6cb4efb003926483e9bf277dce1b209aa8a3c57982824ef439edb67768

Observation e8c385bc-56ad-451c-bc75-190029a28091 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.987231Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:46.888334Z digest=sha256:7bb68ddf0c044e928dfe8f9def591cada1bca6214ced90267c89ae77f37c4169

Observation 4bb2894a-c5b1-43f1-a564-95793ec8d97e · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.888590Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:46.959502Z digest=sha256:e289d0efd250d0d2cfca40260be86bbf8ffa66b9ab8e63e60dfc31e919cd665f

Observation 993d3992-8128-4c04-a785-1c7a2983182f · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.782028Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:47.007625Z digest=sha256:8a5f17b6a0922adc339172e921786340d102211002be2e4047ed823b286d2e80

Observation 23606c55-a9a8-4df3-8704-691911ed6155 · outbound

This paper cites Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-06T22:14:47.046319Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:14:47.046319Z digest=sha256:249e00ab3e00c638a98b3b74e64cd6ae71bd458b51de22c3057855c56a1fa38d

Observation 31c20004-fefd-4dc6-a8b7-ed3ed8290a20 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.695400Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:47.094662Z digest=sha256:bedde1a11e54771b67e831620ef862a072a0c8fba2ae00d176031b2247409644

Observation 523508df-9e4a-4d47-b649-03f98481f003 · outbound

This paper cites Asynchronous Methods for Deep Reinforcement Learning.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Asynchronous Methods for Deep Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T22:14:47.126380Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:14:47.126380Z digest=sha256:56f84668a7491fca4f78524c21333902d0182dd3c3be23d0389c7926e4b71bb2

Observation 92a2f123-8585-4dfe-a1ad-3f3712747823 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.605715Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:47.192247Z digest=sha256:b11a2463a1e927faaac24c48caab564ef8196017f996cabffd45b01ba16ed7cf

Observation 82a48f55-b009-4de4-b92f-12b7a3c24b34 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.498005Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:47.248071Z digest=sha256:ff63ad0d5ed6b4d276ec066f2b629d63f217609d3b40ed0941ae170ec77aaacc

Observation 1b1240de-c4a7-4522-80f7-d735b8364602 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T22:14:47.301482Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:14:47.301482Z digest=sha256:fb12f3f4ed0bb4188b62440216c5dcedda3f49a75ec535e71a2bb878be5fa313

Observation 4ee36dcd-14fc-45df-8caa-fc5d9599903a · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.284263Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:47.387567Z digest=sha256:caf885a02ce8d6547ffefce4af6e63f94ec9c13e96201f2df3de1cf001347235

Observation db26b8e2-d178-4a0a-965d-eb904980e085 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.148236Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:47.446871Z digest=sha256:ee51be81297192ec6a43f7e291da1a513585e00e48021add8f9ba5d4c2325147

Observation 908035da-9db1-4ff2-9384-d1cb576e8994 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:47.993890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:47.515571Z digest=sha256:ba28a6ee1d684d7f2980cdebc7b61a8c6d215d642b82a210d0a6471be45aa2b8

Observation fbf22242-0277-4196-b02c-ad35a0721391 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:47.905168Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:47.589165Z digest=sha256:dd8e448c33ceb1c7eb4711e5b7c67d7c4a26e6389a0186950a740c6a99b9d953

Observation 130813a7-f668-4485-9ccc-3f43e28bb904 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:47.801561Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:47.639455Z digest=sha256:8a9934dd3ca76d562db3017bf0cc6942f327b41fef34de0e0f3dee968bad7456

Observation 3dcdf803-6766-466f-8903-ffe02b7bb4f5 · outbound

This paper cites In SIGIR.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems In SIGIR

Reference 2023

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T22:14:48.376290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-06T22:14:47.351728Z digest=sha256:b112b4487cd10d6952bf472b813c560ea11088ee435586874263477ed7cded6f

Pith citing papers

No inbound Pith citation observations are available.