{"as_of":"2026-08-23T12:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc015ae972f21bb33dce0ca6b93bd0441e550a80a7e88b95c8ced95aab271dbf","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:18:15.952566Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.05278/citation-record","integrity":"/paper/2501.05278/integrity","json":"/paper/2501.05278/citation-record.json","paper":"/paper/2501.05278"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.212739Z","title":"Auction research evolving: Theorems and market designs","venue":null,"work_id":"1d979690-2e92-4c5b-bcd8-99f23b8b7ecc","year":2021},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.870415Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:c5f1913248605ca00e384fe4f31f7c55a4bafd706b9bb247f191fbb2c610a4b1","observation_id":"4094d169-a15d-41f9-90ad-6628f80bdfaf","resolution":{"observed_at":"2026-08-10T21:18:16.216337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.202625Z","title":"Market design: auctions and matching","venue":null,"work_id":"12a55405-378d-4049-ae93-a2711a55d55a","year":2018},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.875546Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:68042e103064e1239242ef7c1ae9be84ac818b4013af1f9f0fb549ddd171d8d3","observation_id":"b8ac9994-c5c0-41ea-831c-c5840c7a4962","resolution":{"observed_at":"2026-08-10T21:18:16.206419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.192006Z","title":"Learning to bid with auctiongym","venue":null,"work_id":"17c17a88-44a1-4211-9238-2a8f32092637","year":2022},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.879742Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:f6e0b38b170fd33323e942701ed99acba4b362e80e790c8ac42ceaab88146083","observation_id":"5b75a1aa-0ab3-4356-8bb4-2aca4e959f76","resolution":{"observed_at":"2026-08-10T21:18:16.195429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.07146","last_updated":"2021-10-26T08:57:39Z","snapshot_observed_at":"2026-08-06T10:55:10.645410Z","submitted_at":"2020-08-17T08:23:50Z","title":"Open Bandit Dataset and Pipeline: Towards Realistic and Reproducible Off-Policy Evaluation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.07146","snapshot_observed_at":"2026-08-10T21:18:15.884203Z","title":"Open bandit dataset and pipeline: Towards realis- tic and reproducible off-policy evaluation","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.884203Z"},"links":{"cited_paper":"/paper/2008.07146","citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:340242de478deaf75f1ba658baa3ddd4b09a746397700a1760b763a9540dfe47","observation_id":"82f8ef6c-baae-4381-8028-2f91e5cc99fc","resolution":{"observed_at":"2026-08-10T21:18:15.884203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.182388Z","title":"Learning from logged implicit exploration data","venue":null,"work_id":"885c5718-b267-42dd-85c4-5b4dbf03bb12","year":2010},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.888567Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:32e78d8ed5ed7db513f28bd2d354ba9c3da5dd312d4b357e93ade18b29db5195","observation_id":"f7be9c94-4ea0-48b9-b66d-acdc5d9b90af","resolution":{"observed_at":"2026-08-10T21:18:16.186180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.174075Z","title":"Doubly robust policy evaluation and optimization","venue":null,"work_id":"bce3f853-18b7-4165-85ec-d628ab40475c","year":2014},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.892182Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:b25e2109af2a4a05ead2580fc674d64532572cf23abaff97fffe9ff5e14eeb39","observation_id":"e3ea2dc4-d776-46b3-85d3-294a2084a81b","resolution":{"observed_at":"2026-08-10T21:18:16.177203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.163503Z","title":"Doubly robust off-policy evaluation with shrink- age","venue":null,"work_id":"ce2cf455-f6d8-4a8e-9872-a0bcadb4f1f5","year":2020},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.895375Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:323638e842ae4677f32fb692ed63a89e5a628059015d440b2ab1fdf11b0a630f","observation_id":"7e4e078e-6f6f-4d3c-8039-219b364feb7d","resolution":{"observed_at":"2026-08-10T21:18:16.168037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.152434Z","title":"The self-normalized estimator for counterfactual learning","venue":null,"work_id":"e3498bd9-af72-4ed6-b6a4-624573accbbc","year":2015},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.898266Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:9483c0c0f43142997c1994775c9d6f53baf23fc219dad0ac3593e1ddbc04705b","observation_id":"2729b6dd-cf33-47b6-9697-a3e13b6210d3","resolution":{"observed_at":"2026-08-10T21:18:16.156991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.140980Z","title":"Intrinsically efficient, stable, and bounded off-policy evaluation for reinforcement learn- ing","venue":null,"work_id":"77ab9778-5e36-40ae-86ad-e9b23b8cb303","year":2019},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.901714Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:0d5f018c5ded9f59b9af3aee05ba8dd98bf131744e3adc29b8f12dd37a91ecb5","observation_id":"dd41cf89-4a39-42ec-b207-5849afb30981","resolution":{"observed_at":"2026-08-10T21:18:16.144879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.130422Z","title":"The offset tree for learning with partial labels","venue":null,"work_id":"b32b1b05-be47-4f05-9eeb-3d21e6db77ab","year":2009},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.906268Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:a854dda0c7a7ccd11ab82de699c79b580f90314934634e5357879b2a66014298","observation_id":"74922745-bf37-4605-b4f4-417ae90a88ec","resolution":{"observed_at":"2026-08-10T21:18:16.133556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.120047Z","title":"More robust doubly robust off-policy evaluation","venue":null,"work_id":"a08f6e5c-79b2-4898-b9bc-3c67d8b00212","year":2018},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.910413Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:879051f40019895556dbd16d52302cc278dc30de41b4f1accd407edd1b5fded8","observation_id":"7c74382a-ab48-4a9a-ac0d-39cad6d5486e","resolution":{"observed_at":"2026-08-10T21:18:16.124154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.109790Z","title":"Cab: Continuous adaptive blending for policy eval- uation and learning","venue":null,"work_id":"9c1922d5-2598-47b1-ad04-17aa76e1c3d1","year":2019},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.913651Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:af43ab0bbc19f7cebf549acb715a090a646113959c9ecee761cfb5c9e6cfd968","observation_id":"4945d4fa-45d0-40bc-b5b3-9ed27fa960a5","resolution":{"observed_at":"2026-08-10T21:18:16.113668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.099746Z","title":"Policy evaluation and optimiza- tion with continuous treatments","venue":null,"work_id":"62566773-6caf-4562-bb2b-e7986e8edf7e","year":2018},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.918085Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:2ad458b66ce664f124d3e2ad8c213190b5b86675c96750a2d986079f8897482c","observation_id":"82a33328-e364-4b98-8ccf-0de1ebe99ec8","resolution":{"observed_at":"2026-08-10T21:18:16.103512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.090080Z","title":"Virtual metrology in long batch processes using machine learning","venue":null,"work_id":"585b571b-f708-48a7-b7b9-36c237bbfaff","year":1997},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.921511Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:695ac89933ed2d293fb13fd5c36f4011b005f4ef75d8098326c3a5a3ef72abdb","observation_id":"56709e02-a10e-41f6-bfd7-61f59524b155","resolution":{"observed_at":"2026-08-10T21:18:16.093517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.080653Z","title":"Probabilistic evaluation of counterfactual queries","venue":null,"work_id":"bca2fde1-2564-4c10-8a3f-9164f93b48f0","year":2011},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.924756Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:bb369b2f4a7de26f080b444ae809be8bc932583c2e9d8df1cde1f39cb7f39a98","observation_id":"fe42a95c-b022-4cd3-9fe2-f617305c4afd","resolution":{"observed_at":"2026-08-10T21:18:16.084121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.070303Z","title":"Off-policy evaluation for large action spaces via embeddings","venue":null,"work_id":"9eec3bad-349c-40dc-9d2b-f606e2d5f317","year":2022},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.929145Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:58db9a6d89ef330c8f8e7a77c4d5c4e44c574f24cb9547a2fe5b657dc9fbc313","observation_id":"22f7dc0d-b753-4d73-81b2-2e2e0ded4e9b","resolution":{"observed_at":"2026-08-10T21:18:16.074036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.059436Z","title":"Optuna: A next-generation hyperparameter optimization framework","venue":null,"work_id":"3a8b09be-49c1-4433-baae-daa3dbee8af1","year":2019},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.932478Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:c6e81e4bce3216242500712c919435c3a402d347ee84b16d3b276fb581cd88b8","observation_id":"c4da51d8-d093-405f-97b7-25b470d2d789","resolution":{"observed_at":"2026-08-10T21:18:16.063573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.047958Z","title":"En[·] is the empirical average over n observations in D","venue":null,"work_id":"55a96ec3-530d-4714-a6a6-44e2237295b9","year":null},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.935874Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:1296175ded19982c972f0eba7d85ca81c4712ca66ec3f0f53c42454173620db4","observation_id":"ae0ffb38-d635-4138-bdbe-6a48b3bbb4d7","resolution":{"observed_at":"2026-08-10T21:18:16.052143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.036272Z","title":"This estimator is not unbiased even when the behavior policy is known","venue":null,"work_id":"fb621add-179e-40e7-bdde-a2108f47091f","year":null},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.939549Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:01c69af0377a83f69a29d14372a369556e46cef2d65a430bffa0b01a54566e3b","observation_id":"4c972896-f2d0-468a-961a-bda9fef0066d","resolution":{"observed_at":"2026-08-10T21:18:16.040467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.026297Z","title":"It then uses the estimated rewards to estimate the policy value as follows","venue":null,"work_id":"26c9b53f-c1cd-4826-a96e-3fe5602d4d09","year":null},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.942402Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:aad30d7aa6154c0ca6706fffcefc3710c135e874ba9be5d7655035dd40a851d6","observation_id":"a7e0bebb-f635-43e7-82bc-fc8d64ffd943","resolution":{"observed_at":"2026-08-10T21:18:16.029842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.015358Z","title":"It then uses the estimated rewards to estimate the policy value as follows","venue":null,"work_id":"3cf4fa6a-e462-4d40-a745-c7bcab11fb06","year":null},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.945405Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:9641be8e8eaab5d214caecbb368df79761bebda98e1a337b35469745e5ca29eb","observation_id":"181dc83e-e081-4b77-a2d5-b16facb8fc14","resolution":{"observed_at":"2026-08-10T21:18:16.019187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:16.004836Z","title":"The SNDR estimator computes the policy value of the evaluation policy πe as ˆVSNDR(πe; D, ˆq) :=En ˆq(xi, πe) +w(xi, ai)(ri − ˆq(xi, ai)) En[w(xi, ai)] (5)","venue":null,"work_id":"d342a934-714e-46b1-966a-0986df83383e","year":null},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.948869Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:7abf96c2bed17767b3faca64d1b3c69e87b84a28a6427ed0ebc6a3b6d98f3223","observation_id":"db3ee01f-1733-40fb-8938-f054262dc5f3","resolution":{"observed_at":"2026-08-10T21:18:16.008799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:18:15.989224Z","title":"This binning process can obscure subtle differences within the data, making it challenging to evaluate small changes, as these nuances are often lost within the bins","venue":null,"work_id":"be070575-b80f-4d0e-8a73-ccb193cc4089","year":null},"citing_paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:15.952566Z"},"links":{"citing_paper":"/paper/2501.05278"},"observation_digest":"sha256:8ee4707e365bf347e113f86e3fc6f11c6c4fcc83a37d12df69fbbcd378d7bac1","observation_id":"dcef2213-588d-4eb6-b2c0-535a449d6681","resolution":{"observed_at":"2026-08-10T21:18:15.995301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.05278","last_updated":"2025-01-09T14:39:40Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T21:11:51.574758Z","submitted_at":"2025-01-09T14:39:40Z","title":"Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2501.05278."}