{"as_of":"2026-08-08T09:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:56ae8fd9cdcae6f1526d3b06da2bafc1f147276599c67d868595b11d12f0fbcc","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:11:05.980631Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00446/citation-record","integrity":"/paper/2506.00446/integrity","json":"/paper/2506.00446/citation-record.json","paper":"/paper/2506.00446"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.729643Z","title":"• Inverse Cascade: cinverse cascade(k, l) = 1, ∀l ≥ k, and cinverse cascade(k, l) = 0, otherwise","venue":null,"work_id":"ab834ec3-201d-4881-bf5e-c7ee2611b197","year":2021},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.670687Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:5e5a8bed610c84ad6407531b4d06d71dba1e9c873ae1fc5339da60ecb48109fa","observation_id":"89f73561-d224-4a72-9d5f-4d944a5c21b9","resolution":{"observed_at":"2026-08-07T12:11:06.821948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.895865Z","title":"Note that for the RCV1-2K dataset, the top 1600 training and top 4000 test samples were extracted for the experiment","venue":null,"work_id":"82fcc2d3-c37f-4d2e-85e7-df0d11c29cf1","year":2016},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.576338Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:c1b19711160ceb067092bfa07918aee11154f3e827e68c81217ae649e763f28b","observation_id":"ed4f24c9-2bc1-4cf6-be08-b4ce2ed6332c","resolution":{"observed_at":"2026-08-07T12:11:06.989611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.550944Z","title":"We utilized SLOPE to determine the optimal number of dimensions to extract from the first dimension of the embedding","venue":null,"work_id":"9db97fe0-c879-4989-9bd8-ba3391ccac90","year":2021},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.796919Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:e979c347c7f6b2ab06fdb7f7b43cd890f6aa277353469407d512377ad0bb6861","observation_id":"88f3505d-3cd3-4f3a-b891-c1a9d6ac422e","resolution":{"observed_at":"2026-08-07T12:11:06.647178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06151","last_updated":"2024-02-09T03:01:13Z","snapshot_observed_at":"2026-08-03T20:09:33.150859Z","submitted_at":"2024-02-09T03:01:13Z","title":"POTEC: Off-Policy Learning for Large Action Spaces via Two-Stage Policy Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06151","snapshot_observed_at":"2026-08-07T12:11:04.863678Z","title":"Long-term off-policy evaluation and learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.863678Z"},"links":{"cited_paper":"/paper/2402.06151","citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:f6d9f11ab7b1afaf1bbb0cbca3cf2e7cca35b8604f7ee8991e293fb11474839e","observation_id":"7e454082-3720-4737-acf6-5f86c870ce8c","resolution":{"observed_at":"2026-08-07T12:11:04.863678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.934283Z","title":"Related Works Here, we provide an overview of the related works pertinent to our study","venue":null,"work_id":"163f8e5b-705f-4c71-ac65-a4f119c97f0f","year":2011},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.965244Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:ac4851ef12b1c543755ebf2d39e6c3ec3ccab802d798adaeb20f5136783089cc","observation_id":"5ecf65b7-4023-4b30-b8d8-23c67979d65e","resolution":{"observed_at":"2026-08-07T12:11:07.988542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.641067Z","title":"However, selecting estimators using only logged data is challenging, as their biases are influenced by the true policy value","venue":null,"work_id":"aeb6c2ba-d38e-4e63-8bcf-1b069724746f","year":2023},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.169171Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:9c1face6e6c55368b78049939d55e1411bdaa08931fbd4834f90728236dcfad3","observation_id":"f1998767-0cad-48b7-ae95-6459ca8ab476","resolution":{"observed_at":"2026-08-07T12:11:07.709206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.474321Z","title":null,"venue":null,"work_id":"9031dc08-4059-48b2-885a-42f09b1c1fe5","year":2020},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.240932Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:3d049c1c349ba249d2ed65de6805747fd544402626f0bd51b18bae45b1390560","observation_id":"6179592d-8279-4d41-ac31-5ade73dd5d32","resolution":{"observed_at":"2026-08-07T12:11:07.568832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.344131Z","title":null,"venue":null,"work_id":"ab1ea39a-66de-4e39-affa-07f0b99cc2ab","year":2000},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.882116Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:4042bccb254216c83ce28ae483a7419a7260d266af6858048c8b73e45bfaf5a3","observation_id":"a27bb8b5-7d66-4b36-a66f-77d1c5c7b965","resolution":{"observed_at":"2026-08-07T12:11:06.456691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.139914Z","title":"Comparison of MSIPS, MRIPS without SLOPE, and MSIPS(w/SLOPE), MRIPS(w/SLOPE)","venue":null,"work_id":"16719a57-412b-43de-ae6b-a17cd0957d6c","year":2022},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.980631Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:b2252ad6a65bcab832a9f1f536f899f04abcfbe8b6a87b850d313a2a0197fcea","observation_id":"239636ea-e3c7-413e-866d-2cd804bec2e8","resolution":{"observed_at":"2026-08-07T12:11:06.235537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.290521Z","title":null,"venue":null,"work_id":"f3af49a0-871c-45e4-bbdf-aa700ae8b52f","year":2019},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":1975,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.337304Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:b73dd0c1ba6b8508b5a3a568755b3b6b138e864eec213b6a7dd9ed16ebb30522","observation_id":"46a1f30f-30f8-4af3-a7bd-1c5d9dbbc01f","resolution":{"observed_at":"2026-08-07T12:11:07.367778Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.089666Z","title":null,"venue":null,"work_id":"a2b3bd4d-f97e-4a22-8eb9-d388f462629e","year":2020},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.486042Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:39afc454d2261aee271f34b881b9dcbedd8e896b4245474410e05ecf6998fb0b","observation_id":"ae372a46-ba53-45ed-912e-6732244abe99","resolution":{"observed_at":"2026-08-07T12:11:07.212997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.810242Z","title":"However, if this assumption is not met, the PI exhibits significant bias (Kiyohara et al., 2024)","venue":null,"work_id":"aaa5d6b0-2bdc-46d7-8a9b-0341319d3d53","year":2024},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.085688Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:68af15df10e80f577a0e4ddf22c32c60c3d5d581087ac06e3cf94d54ee4062d1","observation_id":"6fc9e330-53fb-4403-a8b2-13adca72b616","resolution":{"observed_at":"2026-08-07T12:11:07.875920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.061419Z","title":"Off-policy evaluation for large action spaces via pol- icy convolution","venue":null,"work_id":"1526c840-ff08-4de9-8efd-2aac405740ed","year":2024},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.690507Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:81804a6cd0072ac3cdad05496fe74e9c5dbb574510f5a04da41ce93b70f3cb3a","observation_id":"bb3ed3f6-142f-4e5c-a222-9b2f9def25ed","resolution":{"observed_at":"2026-08-07T12:11:08.158081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.230768Z","title":"Offline policy evaluation in large action spaces via outcome-oriented action grouping","venue":null,"work_id":"e581c122-efeb-47ee-b152-de111974e72b","year":2023},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.593822Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:b392fe468cd264140e532f6208f8564fde510d4cfd39f132f2a4b3adc8a6afa8","observation_id":"d1eaab94-86f2-4b9e-9635-d764868791eb","resolution":{"observed_at":"2026-08-07T12:11:08.299336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.07146","last_updated":"2021-10-26T08:57:39Z","snapshot_observed_at":"2026-08-06T10:55:10.645410Z","submitted_at":"2020-08-17T08:23:50Z","title":"Open Bandit Dataset and Pipeline: Towards Realistic and Reproducible Off-Policy Evaluation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.07146","snapshot_observed_at":"2026-08-07T12:11:04.807882Z","title":"Open bandit dataset and pipeline: Towards realistic and reproducible off-policy evaluation","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.807882Z"},"links":{"cited_paper":"/paper/2008.07146","citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:9045843a3d1e06ab33302dc464eed8565a5ec08da84e55f6c7c298df44ab68d2","observation_id":"3733ae4d-b351-4922-b317-83bcdf8a200b","resolution":{"observed_at":"2026-08-07T12:11:04.807882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.356138Z","title":"Off-policy evalu- ation of slate bandit policies via optimizing abstraction","venue":null,"work_id":"49aed729-5af0-401f-bab5-3a9899684f57","year":2024},"citing_paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.516415Z"},"links":{"citing_paper":"/paper/2506.00446"},"observation_digest":"sha256:49227174639e294888461f7f47b10e3079117d633068ed5defb0c519e1fbe827","observation_id":"cfa1d54e-6276-4625-a0b9-1c26b71ec839","resolution":{"observed_at":"2026-08-07T12:11:08.451911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00446","last_updated":"2025-05-31T07:58:53Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-07T12:02:41.216388Z","submitted_at":"2025-05-31T07:58:53Z","title":"Off-Policy Evaluation of Ranking Policies via Embedding-Space User Behavior Modeling"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2506.00446."}