{"as_of":"2026-08-13T10:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fff9175ffb81741dfbcf67fbd554cfd14292f50e075cfb445e004c797f40cf2b","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T17:32:07.052068Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.08911/citation-record","integrity":"/paper/2412.08911/integrity","json":"/paper/2412.08911/citation-record.json","paper":"/paper/2412.08911"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1706.05098","last_updated":"2017-06-15T21:38:12Z","snapshot_observed_at":"2026-08-11T03:54:05.796121Z","submitted_at":"2017-06-15T21:38:12Z","title":"An Overview of Multi-Task Learning in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05098","snapshot_observed_at":"2026-08-11T17:32:06.936864Z","title":"An overview of multi-task learning in deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.936864Z"},"links":{"cited_paper":"/paper/1706.05098","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:4985170405464b9c6f1097817bc3960eebbaef228e791b1f3a520859b8bcf5eb","observation_id":"9c22d02d-3754-40ad-be22-80f10b87475a","resolution":{"observed_at":"2026-08-11T17:32:06.936864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.388970Z","title":"Multi-task learning as multi-objective optimization","venue":null,"work_id":"d086f5ef-179a-425d-8128-db97a25713ae","year":2018},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.941585Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:d315dc2f3d4757905e4e9f222a7cd90678f48d6712b218b9a8e627c1d3d7c3cf","observation_id":"f3c12bac-1405-4e28-8dc2-081d7bc46a85","resolution":{"observed_at":"2026-08-11T17:32:07.393145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.377552Z","title":"A survey on multi-task learning","venue":null,"work_id":"ae9e6fa5-8246-4aca-ae19-8b69792bb06c","year":2021},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.945401Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:256ed349179e1b0309432e9862b0b4787b9c0a056e4a8f491d0facca3dab0be3","observation_id":"47d24c4c-efff-49d9-bfef-78e0662e93b1","resolution":{"observed_at":"2026-08-11T17:32:07.381404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.365755Z","title":"Modeling task relationships in multi-task learning with multi-gate mixture-of-experts","venue":null,"work_id":"92fabedb-c09c-436b-90b9-85b954536b5e","year":1930},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.949617Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:3149ac64cc70007eea779a1d52799e954f41d26a1ac0cf5bbbd4a56daefd27be","observation_id":"3c3c8c00-7a99-48fa-85c6-5d895e1dbfbc","resolution":{"observed_at":"2026-08-11T17:32:07.370160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:06.953779Z","title":"End-to-end multi-task learning with attention","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.953779Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:d0fb0e64f16287457feca6ff61ec6d26fb44295e29bc6d12643562f028792e5b","observation_id":"ef40fd43-3394-474b-99f8-5bb9570fe44f","resolution":{"observed_at":"2026-08-11T17:32:06.953779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:06.957994Z","title":"Gradient surgery for multi-task learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.957994Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:1e4386b32a45740b1a80125ebdc63e2c509475afed72ed44616cba25468f449b","observation_id":"29e6991b-7104-4b51-99c1-abc820cfb8ea","resolution":{"observed_at":"2026-08-11T17:32:06.957994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.340083Z","title":"A pareto-efficient algorithm for multiple objective optimization in e-commerce recommendation","venue":null,"work_id":"912e8da6-6152-44aa-a8ed-0203bd6d9116","year":2019},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.962098Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:5b89dc815b5f3340b2d7bba08bc02c9bf66c86bb7efabff209c968fcb70b4074","observation_id":"ec34560b-1c45-4c1e-8c84-11b8074b8685","resolution":{"observed_at":"2026-08-11T17:32:07.344047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.04478","last_updated":"2022-02-14T04:26:50Z","snapshot_observed_at":"2026-08-08T23:10:28.615456Z","submitted_at":"2022-02-09T14:17:05Z","title":"Rethinking Goal-conditioned Supervised Learning and Its Connection to Offline RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.04478","snapshot_observed_at":"2026-08-11T17:32:06.965689Z","title":"Rethinking goal-conditioned supervised learning and its connection to offline rl","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.965689Z"},"links":{"cited_paper":"/paper/2202.04478","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:5a1226230ea0cc4dad9e1a14540657f5a6d8de296a16061f85d2103a56fd1901","observation_id":"5ca147e6-54b6-4e09-97a1-21436fb522ef","resolution":{"observed_at":"2026-08-11T17:32:06.965689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08299","last_updated":"2022-09-02T10:46:40Z","snapshot_observed_at":"2026-08-09T20:13:54.024607Z","submitted_at":"2022-01-20T17:06:42Z","title":"Goal-Conditioned Reinforcement Learning: Problems and Solutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08299","snapshot_observed_at":"2026-08-11T17:32:06.969586Z","title":"Goal-conditioned reinforcement learning: Problems and solutions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.969586Z"},"links":{"cited_paper":"/paper/2201.08299","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:66ee6a520f6160aaf21e89174216c0450981b90a311165bb75744a28b474d664","observation_id":"3da55db4-9c97-4bda-94d3-71279520a723","resolution":{"observed_at":"2026-08-11T17:32:06.969586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:06.973352Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.973352Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:a9c973b42bc1da3df04a5adbf4449d43ff6783101e4273dd2d482932ecb75c1e","observation_id":"e3003b99-0289-46c5-801b-1e41b7b9003a","resolution":{"observed_at":"2026-08-11T17:32:06.973352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.321838Z","title":"Rethinking reinforcement learning for recommendation: A prompt per- spective","venue":null,"work_id":"fca61e3d-8c36-4cae-a51d-1c99cf5e4e6e","year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.977397Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:4e5929a832e098c07ae3114ec6138a2ad18eeb2b9dc612fd89a133ee3c17cd14","observation_id":"9f7a887b-d3d3-48be-b8c6-b091466573d9","resolution":{"observed_at":"2026-08-11T17:32:07.326470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.310411Z","title":"Cross-stitch networks for multi-task learning","venue":null,"work_id":"9e253ba1-c7c0-4872-962e-83fd55201541","year":2016},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.981022Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:176bd80077ea55310adf5e8793fe289868dec2e8d4e50f27e487773b97eed6ad","observation_id":"4e94d1af-4814-4f52-aa7d-32d559637e33","resolution":{"observed_at":"2026-08-11T17:32:07.314406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.299026Z","title":"Famo: Fast adaptive multitask optimization","venue":null,"work_id":"03e44d1d-e241-4e7c-ad83-db45509e705d","year":2024},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.984442Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:24d707ef0b09c00ba85772d2280982ea44b9150c01b703853ab37cfe20a9609a","observation_id":"d31fb4a2-cd14-460c-83b9-56fdbc037582","resolution":{"observed_at":"2026-08-11T17:32:07.302821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:06.987847Z","title":"Offline reinforcement learning as one big sequence modeling problem","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.987847Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:5722dc95866f07091f39b1bd5aa67631cf988f728fef1a87174d6949f8577cde","observation_id":"e19777a6-c71c-41cc-ae18-33eb84674f5d","resolution":{"observed_at":"2026-08-11T17:32:06.987847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.280811Z","title":"Online decision transformer","venue":null,"work_id":"dec53745-e3d8-4ca0-9f08-2da240e710c6","year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.991343Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:ef721a7cd650ef40f7e3275d85a5206ff8a6183c710534181b6bbacf078890ea","observation_id":"ecc57f5f-9a57-47a3-9722-a6dfbfcc1698","resolution":{"observed_at":"2026-08-11T17:32:07.284507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-08-11T17:32:06.994818Z","title":"Opal: Of- fline primitive discovery for accelerating offline reinforcement learning","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.994818Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:0eca49208f07134438c1405038250a7ccabe21410c6edbba4d3acd0ee339bcaf","observation_id":"0d6edf85-53ae-4327-bf2b-0235d61acc91","resolution":{"observed_at":"2026-08-11T17:32:06.994818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:06.998552Z","title":"Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:06.998552Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:cc62abd85cb5d7dd8757e03ca30fb896c06f6f1e71321fd36a5301a99afbad53","observation_id":"69a6064c-91e9-4a44-9818-ff69b12f4165","resolution":{"observed_at":"2026-08-11T17:32:06.998552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08740","last_updated":"2024-06-02T10:15:53Z","snapshot_observed_at":"2026-08-13T00:07:50.738471Z","submitted_at":"2024-05-14T16:30:03Z","title":"Reinformer: Max-Return Sequence Modeling for Offline RL","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08740","snapshot_observed_at":"2026-08-11T17:32:07.002583Z","title":"Reinformer: Max-return sequence modeling for offline rl","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.002583Z"},"links":{"cited_paper":"/paper/2405.08740","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:96c1c42cc6c9bcb05afc5f10ac44d0019208dfb084b7809887db9e45fad853e1","observation_id":"b61b5177-3c07-4603-95da-53f3ec4b5ae5","resolution":{"observed_at":"2026-08-11T17:32:07.002583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.13248","last_updated":"2022-05-26T09:36:20Z","snapshot_observed_at":"2026-08-02T00:16:23.031911Z","submitted_at":"2022-05-26T09:36:20Z","title":"Constrained Reinforcement Learning for Short Video Recommendation","version":1},"cited_work":{"arxiv_id":"2205.13248","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.13248","snapshot_observed_at":"2026-08-11T17:32:07.115935Z","title":"Constrained Reinforcement Learning for Short Video Recommendation","venue":"cs.LG","work_id":"f4707e46-0fd0-4f91-bab1-b07c78b15d9b","year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.006351Z"},"links":{"cited_paper":"/paper/2205.13248","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:342ed6057682286bd3c31510948d66bc1bab1bb7194cd6f6f4f72ba1b8125e28","observation_id":"f6a4aac2-ce35-4c41-a21f-134a92b6932d","resolution":{"observed_at":"2026-08-11T17:32:07.122150Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.263200Z","title":"Choosing the best of both worlds: Diverse and novel recommendations through multi-objective reinforcement learning","venue":null,"work_id":"2c8272d3-a829-441f-861d-c9ade6ee2aa9","year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.010676Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:46432818690e32741a75473887d52d9c7986962cf0a72a122a9eed9ffd1d25b9","observation_id":"602e5f06-1bde-4b51-91ed-c301ca570a7b","resolution":{"observed_at":"2026-08-11T17:32:07.266804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.252933Z","title":"A survey of multi-objective sequential decision-making","venue":null,"work_id":"470d05bb-cea3-45dc-a931-1da374a07d8a","year":2013},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.014018Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:415e06333df41ff2d99341af7fd875a605cd5b9b13ee7e05b73aebd62501ea66","observation_id":"a4c3179c-7bb8-4422-b8e2-95c5fa8281a0","resolution":{"observed_at":"2026-08-11T17:32:07.256280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.017623Z","title":"Self-attentive sequential recommendation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.017623Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:09ec7f544c72140bf6200f02cf0689f6d36e5909172a42a32ad20cf42e21aafe","observation_id":"fd110922-2c9e-47bb-9f2a-3b460ba6c128","resolution":{"observed_at":"2026-08-11T17:32:07.017623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.233275Z","title":"Strec: Sparse transformer for sequential recommendations","venue":null,"work_id":"2450215b-264c-4d46-b3f5-33b2ee7b06ac","year":2023},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.021140Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:314ce9d37b7812c5a6de7dfc38ba75c3b63c51d75025b4313726eaf4b7e36c1a","observation_id":"17c3c0a4-f595-4a19-8269-d9509c12b14b","resolution":{"observed_at":"2026-08-11T17:32:07.237519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-08-12T18:51:00.108451Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-11T17:32:07.024760Z","title":"Conditional generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.024760Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:4a06a5565ccb35ca6109a227bb92a94a61a2c8efd9985810ea8cfb629dbb00aa","observation_id":"e9c5eaed-eeea-401f-911c-62b76054fcbc","resolution":{"observed_at":"2026-08-11T17:32:07.024760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-12T19:28:23.372660Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-11T17:32:07.028753Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.028753Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:c2853f27cdd8ce428c4f9c743ce15c874e45676ff8c68482998f10d72e916631","observation_id":"433845f8-1404-4bb2-a294-b3e7879299bf","resolution":{"observed_at":"2026-08-11T17:32:07.028753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.032868Z","title":"Learning structured output representation using deep conditional generative models","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.032868Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:4f0cb9d8e47600738db6d05aef44f2f43209cc316fc43d204ffebe1697c4a75b","observation_id":"de5fd350-deb5-460c-8802-82377e1790ea","resolution":{"observed_at":"2026-08-11T17:32:07.032868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.214653Z","title":"Multi-objective optimization for long tail recommendation","venue":null,"work_id":"07d0ec90-5cfe-4b18-b803-3ddf5473ff51","year":2016},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.036676Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:9e40aa783a1516c93c84314c67588a156e7d3628a772e9813d4c6a0773a92e19","observation_id":"b6f2e1a9-4ef1-47be-b907-1fe029cdf34d","resolution":{"observed_at":"2026-08-11T17:32:07.218933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.202299Z","title":"Self-supervised reinforcement learning for recommender systems","venue":null,"work_id":"b0785268-b958-46ec-a190-6970792c6d45","year":2020},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.040519Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:6ab858a59bb45b94dc7cca7aa7c34b7e80c1c483dcc7f85ab883a627348ff1db","observation_id":"dc528a4b-5c95-481b-a5c9-d99ced8527e9","resolution":{"observed_at":"2026-08-11T17:32:07.206312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.044156Z","title":"Xgboost: A scalable tree boosting system","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.044156Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:c8f8e9faa758fefe04cf30739111b663cd1eb904bf4490f12c8423ed3c02fe7a","observation_id":"5a9e2eeb-0e75-4359-ab7b-ba7f913a0430","resolution":{"observed_at":"2026-08-11T17:32:07.044156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06939","last_updated":"2016-03-29T14:52:58Z","snapshot_observed_at":"2026-07-31T19:00:00.136727Z","submitted_at":"2015-11-21T23:42:59Z","title":"Session-based Recommendations with Recurrent Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06939","snapshot_observed_at":"2026-08-11T17:32:07.048025Z","title":"Session-based recommendations with recurrent neural networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.048025Z"},"links":{"cited_paper":"/paper/1511.06939","citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:9b48e81bcdd0672a1d8519b9e8d6b305a6f096774d6b3f78e06eef47b71e6899","observation_id":"ad1e9d07-b190-4982-83bf-5112c493a654","resolution":{"observed_at":"2026-08-11T17:32:07.048025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:32:07.182543Z","title":"Tenrec: A large-scale multipurpose benchmark dataset for rec- ommender systems","venue":null,"work_id":"7686c946-1acb-4e96-88a1-d4e94513ef8d","year":2022},"citing_paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:07.052068Z"},"links":{"citing_paper":"/paper/2412.08911"},"observation_digest":"sha256:266f0ec9c92db0d836e2d26f5981d16fe1fa9039c873e93b1983c69b46896906","observation_id":"35527f8a-0d17-4298-84b8-9ea14b2b4cd4","resolution":{"observed_at":"2026-08-11T17:32:07.186823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.08911","last_updated":"2025-05-14T22:08:01Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T04:12:00.299088Z","submitted_at":"2024-12-12T03:47:40Z","title":"Goal-Conditioned Supervised Learning for Multi-Objective Recommendation"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":14},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2412.08911."}