{"as_of":"2026-08-07T03:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:67d4d6b24fd018a739cd8f536f674ac2bc5d54afd4ac40d619f658c8bbbc52d3","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:14:47.639455Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.22112/citation-record","integrity":"/paper/2506.22112/integrity","json":"/paper/2506.22112/citation-record.json","paper":"/paper/2506.22112"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:49.265020Z","title":null,"venue":null,"work_id":"deaf26db-8449-4585-9b02-7d9e5d83a7ed","year":2019},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:46.660354Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:0ffef1a2d1ecf0ca3760d27ea8c2a05e292d1c29bb708b8ed7b230c3f3bcbe60","observation_id":"7c0c26d5-efe2-4886-abf2-53f632df45c3","resolution":{"observed_at":"2026-08-06T22:14:49.440511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:49.171299Z","title":null,"venue":null,"work_id":"5bb3726b-9d3d-425a-aa33-f9b2a11b4ec6","year":2023},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:46.731263Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:8029fc2734f3845e2e8b89059b4cc05ca0a09b50734754f0fa283ee78a000ff5","observation_id":"ecbc2689-411b-4c15-b18c-82a1eeeeab11","resolution":{"observed_at":"2026-08-06T22:14:49.213100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:49.049874Z","title":null,"venue":null,"work_id":"185dca29-5c9b-425f-b489-a28237b0a513","year":2022},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:46.775310Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:cc58e4bd009eb2b098ee5b5d8e2c77da282de2d8cfdac4da8c5b930978f0ce68","observation_id":"90c4fd0e-f733-4e8e-81d4-4315436f2441","resolution":{"observed_at":"2026-08-06T22:14:49.110087Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.835343Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:46.835343Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:257b23afa69ccd93c4789b0b7b44ea5727fd3409f357ed44e521b7be4eaa13c9","observation_id":"99b05cc1-01f9-4e8c-ae22-b6e28a0f5d79","resolution":{"observed_at":"2026-08-06T22:14:46.835343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:48.945121Z","title":null,"venue":null,"work_id":"2d51a10e-d679-41df-a9df-78bbcb42cd8d","year":2019},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:46.888334Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:aa0c5ed82b43d78bc5cfcaa5e7328f17d76e9d46675ef0af7b96e7701afe10af","observation_id":"e8c385bc-56ad-451c-bc75-190029a28091","resolution":{"observed_at":"2026-08-06T22:14:48.987231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:48.837096Z","title":null,"venue":null,"work_id":"a8c6c3e6-bc9f-430b-96b0-ec7073b9a97b","year":2020},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:46.959502Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:d289c7269ebed33936a941fad8d2cb962ec4e156a66948f945835f9ab5d690ae","observation_id":"4bb2894a-c5b1-43f1-a564-95793ec8d97e","resolution":{"observed_at":"2026-08-06T22:14:48.888590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:48.749536Z","title":null,"venue":null,"work_id":"aeb13afe-71b9-4fdc-8fcd-acebe338da92","year":1985},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.007625Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:1fdd1d3902907b7dc01792a004bb596579aef75373ebb0272a97c89b580fdd00","observation_id":"993d3992-8128-4c04-a785-1c7a2983182f","resolution":{"observed_at":"2026-08-06T22:14:48.782028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T22:14:47.046319Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.046319Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:230cc156d80eaba0c193f245f62fd2a3575c7fd32ef083177784ed8d8de3c8e0","observation_id":"23606c55-a9a8-4df3-8704-691911ed6155","resolution":{"observed_at":"2026-08-06T22:14:47.046319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:48.654672Z","title":null,"venue":null,"work_id":"5a746af5-6944-4982-a138-7792fb71e154","year":2009},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.094662Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:36b63ba736df1c1c1b61fcf26740f639f6510bb065bea4c5638412b0de5f8952","observation_id":"31c20004-fefd-4dc6-a8b7-ed3ed8290a20","resolution":{"observed_at":"2026-08-06T22:14:48.695400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.01783","last_updated":"2016-06-16T16:38:45Z","snapshot_observed_at":"2026-07-06T04:45:11.148515Z","submitted_at":"2016-02-04T18:38:41Z","title":"Asynchronous Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.01783","snapshot_observed_at":"2026-08-06T22:14:47.126380Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.126380Z"},"links":{"cited_paper":"/paper/1602.01783","citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:8742fc54fb619fa7b01fb374ac4db83c425c385c249c4685116b4a3b17fd9ce3","observation_id":"523508df-9e4a-4d47-b649-03f98481f003","resolution":{"observed_at":"2026-08-06T22:14:47.126380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:48.556814Z","title":null,"venue":null,"work_id":"71bf21ea-b8ae-496f-ac06-474b163bc742","year":2016},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.192247Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:5d5189b0a09ebc871a04cab6d968d3395edc80b09872245815e0031bae5a723a","observation_id":"92a2f123-8585-4dfe-a1ad-3f3712747823","resolution":{"observed_at":"2026-08-06T22:14:48.605715Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:48.444803Z","title":null,"venue":null,"work_id":"614c4270-6424-49e1-891d-56a3b6ece56b","year":2015},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.248071Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:95df701aafe8fac19d4ebbef351989c2ce5348118f46bcaf2da24402a3757830","observation_id":"82a48f55-b009-4de4-b92f-12b7a3c24b34","resolution":{"observed_at":"2026-08-06T22:14:48.498005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:47.301482Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.301482Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:539766fbcd93bc8ae5885a1eab828f9d542245a765806e681f847119c3d8ea36","observation_id":"1b1240de-c4a7-4522-80f7-d735b8364602","resolution":{"observed_at":"2026-08-06T22:14:47.301482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:48.215140Z","title":null,"venue":null,"work_id":"fc66f5d4-782d-452d-bfd3-e07c72679782","year":2020},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.387567Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:a1158b2dbdf8ce8f27501d44c6660e30d13cc9cfc3aef179250698a04a8f694c","observation_id":"4ee36dcd-14fc-45df-8caa-fc5d9599903a","resolution":{"observed_at":"2026-08-06T22:14:48.284263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:48.072820Z","title":null,"venue":null,"work_id":"9179c41b-4ff6-4b31-8d50-fa9930fbf664","year":2020},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.446871Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:cf784041a76ff0993411c0b5af323118b3c72dfb5d35ef8cf06cc6d9ed061207","observation_id":"db26b8e2-d178-4a0a-965d-eb904980e085","resolution":{"observed_at":"2026-08-06T22:14:48.148236Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:47.959355Z","title":null,"venue":null,"work_id":"c9909f15-29f6-46e1-99c4-861cdc1acc2c","year":2020},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.515571Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:b63ca28d1bc1980e2cdf9bd3ea0ee43adccdd7faff5841bcfaddb259251af9c5","observation_id":"908035da-9db1-4ff2-9384-d1cb576e8994","resolution":{"observed_at":"2026-08-06T22:14:47.993890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:47.865806Z","title":null,"venue":null,"work_id":"6e59be46-c1d3-4bca-9d8e-b40214ce9e65","year":2024},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.589165Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:3f309151b0c4287111b578d6a2e595b9ff3e7b62c8d387d4345684b2fac2fa2f","observation_id":"fbf22242-0277-4196-b02c-ad35a0721391","resolution":{"observed_at":"2026-08-06T22:14:47.905168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:47.756681Z","title":null,"venue":null,"work_id":"5402224c-fd92-4857-b537-005d0eccb1bd","year":2024},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.639455Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:f1be8611c2bc1c35bd6f8b95ee1d9da3526cbf5d0b4a09893ac2c3f5823a1f70","observation_id":"130813a7-f668-4485-9ccc-3f43e28bb904","resolution":{"observed_at":"2026-08-06T22:14:47.801561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:48.324057Z","title":"In SIGIR","venue":null,"work_id":"c6c15aa4-3307-4b04-9734-a75056f9b1c9","year":null},"citing_paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:47.351728Z"},"links":{"citing_paper":"/paper/2506.22112"},"observation_digest":"sha256:7293acd9179d914373aaf37bd9a31f3f99d4cfabc06067fc521b3c42cc7a0ad5","observation_id":"3dcdf803-6766-466f-8903-ffe02b7bb4f5","resolution":{"observed_at":"2026-08-06T22:14:48.376290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.22112","last_updated":"2025-06-30T06:57:33Z","latest_version":2,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-06T22:08:14.254605Z","submitted_at":"2025-06-27T10:46:41Z","title":"Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2506.22112."}