{"as_of":"2026-08-09T23:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f31e6ea430f78303b1881fe25e113e5ce353ea8e69d6161305a0b62f7b91b5fc","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:30:31.417206Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.05292/citation-record","integrity":"/paper/2509.05292/integrity","json":"/paper/2509.05292/citation-record.json","paper":"/paper/2509.05292"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.00201","last_updated":"2025-07-31T23:01:14Z","snapshot_observed_at":"2026-08-09T20:47:59.469532Z","submitted_at":"2025-07-31T23:01:14Z","title":"RecoMind: A Reinforcement Learning Framework for Optimizing In-Session User Satisfaction in Recommendation Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.00201","snapshot_observed_at":"2026-08-05T05:30:31.262162Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.262162Z"},"links":{"cited_paper":"/paper/2508.00201","citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:439054f274b5ef4e9adf297348c21a2a1bb326d2264e495a0f97bd431a0272ce","observation_id":"d2dbd2c8-c9ec-4aa8-b86d-246a475c313c","resolution":{"observed_at":"2026-08-05T05:30:31.262162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.897683Z","title":null,"venue":null,"work_id":"f127e816-f376-4887-8049-fc0e8361826f","year":1983},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.266222Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:ff1b76b40a7254b03e42616092e44e432555b757382099f81ef3957614714add","observation_id":"47134fcb-73ca-4021-af76-9078686dfc9f","resolution":{"observed_at":"2026-08-05T05:30:31.900397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.269847Z","title":"Charles, D","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.269847Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:594832154eddfacf6a6576113ea65f74ad12f14407789cbcf7da950433c3e067","observation_id":"58c6ef39-d5b7-4590-80a4-916ec471334d","resolution":{"observed_at":"2026-08-05T05:30:31.269847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.273444Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.273444Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:203bc4278340955307af4d6984f72549ed58cbd11f36bf0116a9f676708d3e95","observation_id":"c8d8a259-643e-4afb-a7bc-c2bbe07a8ad5","resolution":{"observed_at":"2026-08-05T05:30:31.273444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.277130Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.277130Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:e1fd42a354615ed264e73f624a46921a692948c45f270c4633c7cd613fdda86d","observation_id":"ce1b55e8-b00f-42f7-affb-fef1d2b40f63","resolution":{"observed_at":"2026-08-05T05:30:31.277130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.863200Z","title":null,"venue":null,"work_id":"60820bed-b42c-4b17-8bad-abd0f074dcab","year":2016},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.283892Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:e62d11db0b698f0c5837da57eb158ba86e6e6b35fb86dc9ae494f8f1364a87bd","observation_id":"c2825e65-75ba-47d7-be5b-2ee44c28cb6f","resolution":{"observed_at":"2026-08-05T05:30:31.867791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.287363Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.287363Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:ab46ad97104ff0455611e927dafdefc8744ef6130fc0acb4538328b1cf55275a","observation_id":"25a78291-daf2-4bb4-b448-57aec4029ccd","resolution":{"observed_at":"2026-08-05T05:30:31.287363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.846889Z","title":null,"venue":null,"work_id":"1c3a0af5-89b3-4506-9378-a7aa7ef5f144","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.291766Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:85c5f9fcc0c5ae3efc6a0be57eaff9b7ed4b71d66ebb0ca4563ab660d2a489bb","observation_id":"8dc7649a-038d-4d17-90e4-3873bbad5d8b","resolution":{"observed_at":"2026-08-05T05:30:31.850525Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.836719Z","title":null,"venue":null,"work_id":"baa312bf-6825-4ae7-abc2-b4af16369ed9","year":2017},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.295166Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:79397dce77859819b95ae80c0cf0b3e8c5ba5ce4acda23d27ad6a9f6a927b863","observation_id":"f71737dc-e5be-42ea-903b-77213b165590","resolution":{"observed_at":"2026-08-05T05:30:31.840128Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.825975Z","title":null,"venue":null,"work_id":"0715b39f-bea3-479e-b0e6-5fa7f85e52fe","year":2014},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.299293Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:65d6ee4b9e3a581562e284a479fdae1e198b41d3d8f2a0f7f74a6c1b7b609cbf","observation_id":"03bc7d0d-3f8b-4c81-8cc6-9eea248a13e5","resolution":{"observed_at":"2026-08-05T05:30:31.830031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.816073Z","title":null,"venue":null,"work_id":"25ca1ce8-cd5e-4cf5-bfd3-d01ce5c99d80","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.302708Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:86b4c03bea346bbbfed77583af1a3cd33462646dde455673420a2f35ab1f90ec","observation_id":"47ad0a1f-a78e-4132-b1af-5e8c558bf7ef","resolution":{"observed_at":"2026-08-05T05:30:31.819376Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.805158Z","title":null,"venue":null,"work_id":"ddbc7cbb-37e0-4476-8f54-fce65d7c67bc","year":2015},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.306054Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:12b7e1909eac5dbb963c71d9d9dcedea5e1671a57e00ebf393f99e35e43234b6","observation_id":"867db65d-8714-4562-a8d7-21d504a61221","resolution":{"observed_at":"2026-08-05T05:30:31.808727Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.794002Z","title":null,"venue":null,"work_id":"7a0433de-3eea-4880-87cb-1a5d0437a3a8","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.310681Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:4b4ae6d91da26951aaaa3c2513e5906ee00a2c4b8b97438d1564e1fc3e0fba64","observation_id":"7d221c9d-3a7c-45d5-b816-e3f1cb60b41c","resolution":{"observed_at":"2026-08-05T05:30:31.797415Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.782640Z","title":null,"venue":null,"work_id":"17c46ab0-afed-408f-a90b-64371818f4fb","year":2015},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.314186Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:697e2b2077a6d529780b280f67c2f8686cf76d3ea338b40e17af141d2329c0ab","observation_id":"6b9db0f1-aff9-4f4d-8bfa-44812a903f2a","resolution":{"observed_at":"2026-08-05T05:30:31.786444Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.770360Z","title":null,"venue":null,"work_id":"3bb05529-6540-41dd-9177-7176860ccb0b","year":2022},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.317545Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:72446eca3e66354043481048dde269e83d656c7d12abcc3be15ed17f498dbe9e","observation_id":"414e7448-9071-4f48-b487-41d843da9674","resolution":{"observed_at":"2026-08-05T05:30:31.774244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07663","last_updated":"2022-09-27T21:58:20Z","snapshot_observed_at":"2026-08-09T23:35:27.100073Z","submitted_at":"2022-09-16T00:58:16Z","title":"Monolith: Real Time Recommendation System With Collisionless Embedding Table","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07663","snapshot_observed_at":"2026-08-05T05:30:31.320766Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.320766Z"},"links":{"cited_paper":"/paper/2209.07663","citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:9a31ab154a7928c343981b5ee2e2790bf4659ae6cee5b574c6e42dfcc79e1fe6","observation_id":"3933ef2b-3d2e-43ff-9480-749cb2a613e9","resolution":{"observed_at":"2026-08-05T05:30:31.320766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.758069Z","title":null,"venue":null,"work_id":"741fd3c7-7014-476f-89c4-c149a9c8364c","year":2017},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.324262Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:4bf22261d525938d583ce1c5c9e50cc9342c847f24c3e25ad657c6222819570f","observation_id":"84145b36-f4e7-41a9-b68f-8ea0d9dd9244","resolution":{"observed_at":"2026-08-05T05:30:31.762385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.746065Z","title":null,"venue":null,"work_id":"32eace03-c935-4c02-8b25-7b6a1009dd18","year":2010},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.327570Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:ade66339a1dd24a2b226f7091257a9f6a6a64d0a982ea5dd4ec94d614b31c628","observation_id":"a94053b0-c596-43f8-9f46-cda613f7f8d3","resolution":{"observed_at":"2026-08-05T05:30:31.749887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.00720","last_updated":"2018-09-14T11:58:09Z","snapshot_observed_at":"2026-07-06T06:53:41.483733Z","submitted_at":"2018-08-02T09:13:18Z","title":"RecoGym: A Reinforcement Learning Environment for the problem of Product Recommendation in Online Advertising","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.00720","snapshot_observed_at":"2026-08-05T05:30:31.331145Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.331145Z"},"links":{"cited_paper":"/paper/1808.00720","citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:4a2367f4c258c19249e4f41a34a2eede49aa39dea17a25da734bfb70e1318442","observation_id":"29f41471-6aec-4878-bb88-0efbf70983e0","resolution":{"observed_at":"2026-08-05T05:30:31.331145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.334929Z","title":"Rosenblatt","venue":null,"work_id":null,"year":1958},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.334929Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:c71ab53e68dc248432c70e5e34d879ad2f74404a924c43793295db0435c340db","observation_id":"975893d5-a647-4bfb-8836-f86e32841d9e","resolution":{"observed_at":"2026-08-05T05:30:31.334929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.735188Z","title":null,"venue":null,"work_id":"2fc4f5b9-0e5f-4e68-bf15-1b8bb2d44e5d","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.338278Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:06c20be468d19026768a2f146f975a736dbfc0be0eed875b93853d07471ae566","observation_id":"12f553ee-b2bc-4774-92ea-a72c20e7bc57","resolution":{"observed_at":"2026-08-05T05:30:31.738967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.724211Z","title":"1984.Temporal credit assignment in reinforcement learning","venue":null,"work_id":"a160a549-b979-448d-b6ed-75c1ad3924ed","year":1984},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.341559Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:131168f39aee8b48145bb3937e306fe55dbce17ecd24b597757ffcef763ddac9","observation_id":"4a4d4b7b-a031-4149-a11d-8bcf930e3546","resolution":{"observed_at":"2026-08-05T05:30:31.728205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.344794Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.344794Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:2bddbce72918430b65cc685dc99eb1e3138be4f331b36c83c6a9ff9512ff4405","observation_id":"efa4e5ba-ae6f-46c2-b4b7-279eab08513b","resolution":{"observed_at":"2026-08-05T05:30:31.344794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.708044Z","title":null,"venue":null,"work_id":"434e5802-2f30-4bf6-81ba-3f98bc5271ad","year":2023},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.348652Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:668b58bffd5fda36e039f0051bb0fff9510f3f09eeae0972baffd8f12b0e089e","observation_id":"1411ef85-8440-4880-b5f4-56ca75ee24f4","resolution":{"observed_at":"2026-08-05T05:30:31.711560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.352339Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.352339Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:c9118c5e7153875e9fe32625c95264f9a0542cf4b78ab77f339b36ce55c80a6b","observation_id":"2be04e54-3b59-4614-af1e-2c6f6ad95ef1","resolution":{"observed_at":"2026-08-05T05:30:31.352339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.356475Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.356475Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:2c4942195da5cf16dab45dd85440d04fe8604cb982ea5ffabad80d58cfe552f3","observation_id":"a1444093-e47b-4c0a-8777-5581d93dc45e","resolution":{"observed_at":"2026-08-05T05:30:31.356475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.359767Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.359767Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:d329d8e173bb27bafd66c3d7df5abcffb9f7e2c16d2cd22c3e1320354ff3c1c6","observation_id":"385b8985-7d8a-4b53-91f1-67d37ea3b541","resolution":{"observed_at":"2026-08-05T05:30:31.359767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.680361Z","title":"1987.Reinforcement-learning connectionist systems","venue":null,"work_id":"8054eda2-2f87-4f5a-a8a3-72cf4f4cd4a1","year":1987},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.363193Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:efd43b09f85faa67ceb40527c151d2d0b9efaafce69e20742bf7f74c160f8f73","observation_id":"96f4ce8c-7c49-49ff-a45e-cc0325a48ac3","resolution":{"observed_at":"2026-08-05T05:30:31.684111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.366972Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.366972Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:d9e5b9932f6184f016d1716803e2d879e01cfc104e9f7730f31388f244cc323a","observation_id":"6b85f7ff-8703-43bd-9594-3158a41fc07d","resolution":{"observed_at":"2026-08-05T05:30:31.366972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.664031Z","title":null,"venue":null,"work_id":"cbdb93ca-cc69-4265-a70a-7bc2af9faf66","year":1977},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.370984Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:be71c97431e073f6dc1631da07248aff74cc2ba4309b72fb742da9f8161bb3cf","observation_id":"47b17142-8cef-44f8-b131-38c92ad8482a","resolution":{"observed_at":"2026-08-05T05:30:31.667419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.374809Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.374809Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:b58ad0f480920b81b19af242de764c7fc30029d6c4dda9b78f496612735b7909","observation_id":"acaa94d3-ba75-467d-97e8-d2b8714ee220","resolution":{"observed_at":"2026-08-05T05:30:31.374809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.644603Z","title":null,"venue":null,"work_id":"26ba56af-7a47-472f-9da4-3870255d43a8","year":2021},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.378556Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:b43daf9686ac3542a310a680f9b106ba46f2144e996dc051040ad006692471bc","observation_id":"c04006be-cd1a-49cf-90bc-09b783f1d381","resolution":{"observed_at":"2026-08-05T05:30:31.649866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.382096Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.382096Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:1c96a95c136a9ec00e1ccfb4446a038ae98585d84d2b0b23402b569706322129","observation_id":"382f3390-793d-4a50-980a-eb6924516473","resolution":{"observed_at":"2026-08-05T05:30:31.382096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17152","last_updated":"2024-05-06T02:05:45Z","snapshot_observed_at":"2026-08-06T03:48:40.952592Z","submitted_at":"2024-02-27T02:37:37Z","title":"Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17152","snapshot_observed_at":"2026-08-05T05:30:31.385487Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.385487Z"},"links":{"cited_paper":"/paper/2402.17152","citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:32b593b0de376ca02f76ac3283be18a71f3bee1f86958c3c6934d040d66dca39","observation_id":"6ccddf19-27af-4dde-8257-ff9c820ec5e4","resolution":{"observed_at":"2026-08-05T05:30:31.385487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.634049Z","title":null,"venue":null,"work_id":"86666562-365e-4ec4-a443-6004a01e5dee","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.389445Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:e1936c25f248cf62d824bb9afa10ae275df8e56dfdf526dd2df1134ec4a20e0e","observation_id":"2b58fd15-37c5-466c-a161-7fe35805c734","resolution":{"observed_at":"2026-08-05T05:30:31.637542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.394050Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.394050Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:b1f86fc342be66d62a26443a244cc2b51c3ccb1ea5c3b2c9db1b92e164c1664b","observation_id":"0d1db9dc-463b-4408-86f5-24bfb72ec1a6","resolution":{"observed_at":"2026-08-05T05:30:31.394050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.615616Z","title":"Deep reinforcement learning for search, recommendation, and online advertising: a survey","venue":null,"work_id":"66e7767c-2aba-4234-a3a0-dfd6ab60fa25","year":2019},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.398600Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:a01b9d2394639610a3ec8d870da9739329c8e9dbfd065a8928bd5e42d6e5fc84","observation_id":"5e122a06-5f13-427d-92f6-56724a00de73","resolution":{"observed_at":"2026-08-05T05:30:31.619456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.402492Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.402492Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:643cc23d4b149ebe2ca053e2b362bb318e3b797931e64f0d5dc8c470e7215c5a","observation_id":"bb38321f-1fa2-44ac-a111-7dc9a95a2c5f","resolution":{"observed_at":"2026-08-05T05:30:31.402492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.405592Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.405592Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:b3583e1c98da7dd84c7ad9b55b9b41829cbbc02d0a9fa861f655781623e09aa2","observation_id":"ab8ce50b-f6f5-4115-8e6b-1826f8985a5b","resolution":{"observed_at":"2026-08-05T05:30:31.405592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.592108Z","title":null,"venue":null,"work_id":"45a5ce44-6abe-4f65-a75c-c9d8b2b75055","year":null},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.409046Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:1bbd2a48e75bb1ee3eaf11d320d1b4ffbdb577f618cf699b4dffdf33550d234f","observation_id":"2eb88476-28a0-427f-bb6a-23ad30504de1","resolution":{"observed_at":"2026-08-05T05:30:31.595828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.564514Z","title":null,"venue":null,"work_id":"9ccbcc24-4ab1-4312-ab49-25bc82a3e381","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.417206Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:e288e508074f5a9467afcb9929daa2b5639c23eb7a7c3d6a1de83ae99fbc6198","observation_id":"c4ec5258-eb2f-40f3-ad3c-fc1f421e1f1e","resolution":{"observed_at":"2026-08-05T05:30:31.569567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.280505Z","title":"InProceedings of the 1st workshop on deep learning for recommender systems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.280505Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:d55b2c5c1990632dda4e1037d3f01a7797a760299f73ddccaca172dd5f8d853a","observation_id":"a199e549-a6e0-4552-a035-cd72dda05b9d","resolution":{"observed_at":"2026-08-05T05:30:31.280505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.578809Z","title":"InProceedings of the 26th ACM SIGKDD International Conference on Knowledge Discovery & Data Mining","venue":null,"work_id":"15e07d17-06f1-44fa-aa4b-536099a3a2bb","year":null},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.413365Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:d91b2392bd32c743ffeb1fc981a9c6c139d66533a3fb6adb4bf472efbbca3ea5","observation_id":"e64a2954-ab28-4c6f-8f40-cfe655b1de64","resolution":{"observed_at":"2026-08-05T05:30:31.584089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T05:30:29.896450Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2509.05292."}