Pith. sign in

Paper Citation Record · LEDGER

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems

As of 7 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2506.22112.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.22112 v2

Coverage vector

measured 19 of 19 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T22:14:47.639455Z

measured 19 of 19 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-06T06:34:29.942622+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

19 of 19 outbound references displayed

  • verified exact0
  • verified fuzzy1
  • unresolved18
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 7c0c26d5-efe2-4886-abf2-53f632df45c3 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:49.440511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:46.660354Z digest=sha256:0ffef1a2d1ecf0ca3760d27ea8c2a05e292d1c29bb708b8ed7b230c3f3bcbe60

Observation ecbc2689-411b-4c15-b18c-82a1eeeeab11 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:49.213100Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:46.731263Z digest=sha256:8029fc2734f3845e2e8b89059b4cc05ca0a09b50734754f0fa283ee78a000ff5

Observation 90c4fd0e-f733-4e8e-81d4-4315436f2441 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:49.110087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:46.775310Z digest=sha256:cc58e4bd009eb2b098ee5b5d8e2c77da282de2d8cfdac4da8c5b930978f0ce68

Observation 99b05cc1-01f9-4e8c-ae22-b6e28a0f5d79 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T22:14:46.835343Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:14:46.835343Z digest=sha256:257b23afa69ccd93c4789b0b7b44ea5727fd3409f357ed44e521b7be4eaa13c9

Observation e8c385bc-56ad-451c-bc75-190029a28091 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.987231Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:46.888334Z digest=sha256:aa0c5ed82b43d78bc5cfcaa5e7328f17d76e9d46675ef0af7b96e7701afe10af

Observation 4bb2894a-c5b1-43f1-a564-95793ec8d97e · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.888590Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:46.959502Z digest=sha256:d289c7269ebed33936a941fad8d2cb962ec4e156a66948f945835f9ab5d690ae

Observation 993d3992-8128-4c04-a785-1c7a2983182f · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.782028Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:47.007625Z digest=sha256:1fdd1d3902907b7dc01792a004bb596579aef75373ebb0272a97c89b580fdd00

Observation 23606c55-a9a8-4df3-8704-691911ed6155 · outbound

This paper cites Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-06T22:14:47.046319Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:14:47.046319Z digest=sha256:230cc156d80eaba0c193f245f62fd2a3575c7fd32ef083177784ed8d8de3c8e0

Observation 31c20004-fefd-4dc6-a8b7-ed3ed8290a20 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.695400Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:47.094662Z digest=sha256:36b63ba736df1c1c1b61fcf26740f639f6510bb065bea4c5638412b0de5f8952

Observation 523508df-9e4a-4d47-b649-03f98481f003 · outbound

This paper cites Asynchronous Methods for Deep Reinforcement Learning.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Asynchronous Methods for Deep Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T22:14:47.126380Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:14:47.126380Z digest=sha256:8742fc54fb619fa7b01fb374ac4db83c425c385c249c4685116b4a3b17fd9ce3

Observation 92a2f123-8585-4dfe-a1ad-3f3712747823 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.605715Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:47.192247Z digest=sha256:5d5189b0a09ebc871a04cab6d968d3395edc80b09872245815e0031bae5a723a

Observation 82a48f55-b009-4de4-b92f-12b7a3c24b34 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.498005Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:47.248071Z digest=sha256:95df701aafe8fac19d4ebbef351989c2ce5348118f46bcaf2da24402a3757830

Observation 1b1240de-c4a7-4522-80f7-d735b8364602 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T22:14:47.301482Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:14:47.301482Z digest=sha256:539766fbcd93bc8ae5885a1eab828f9d542245a765806e681f847119c3d8ea36

Observation 4ee36dcd-14fc-45df-8caa-fc5d9599903a · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.284263Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:47.387567Z digest=sha256:a1158b2dbdf8ce8f27501d44c6660e30d13cc9cfc3aef179250698a04a8f694c

Observation db26b8e2-d178-4a0a-965d-eb904980e085 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:48.148236Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:47.446871Z digest=sha256:cf784041a76ff0993411c0b5af323118b3c72dfb5d35ef8cf06cc6d9ed061207

Observation 908035da-9db1-4ff2-9384-d1cb576e8994 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:47.993890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:47.515571Z digest=sha256:b63ca28d1bc1980e2cdf9bd3ea0ee43adccdd7faff5841bcfaddb259251af9c5

Observation fbf22242-0277-4196-b02c-ad35a0721391 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:47.905168Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:47.589165Z digest=sha256:3f309151b0c4287111b578d6a2e595b9ff3e7b62c8d387d4345684b2fac2fa2f

Observation 130813a7-f668-4485-9ccc-3f43e28bb904 · outbound

This paper cites an unresolved cited work.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-06T22:14:47.801561Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:47.639455Z digest=sha256:f1be8611c2bc1c35bd6f8b95ee1d9da3526cbf5d0b4a09893ac2c3f5823a1f70

Observation 3dcdf803-6766-466f-8903-ffe02b7bb4f5 · outbound

This paper cites In SIGIR.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems In SIGIR

Reference 2023

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T22:14:48.376290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T22:14:47.351728Z digest=sha256:7293acd9179d914373aaf37bd9a31f3f99d4cfabc06067fc521b3c42cc7a0ad5

Pith citing papers

No inbound Pith citation observations are available.