{"as_of":"2026-08-08T05:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d71381a3c7da1e0ae83a89840a1bb65740761450c84d1b4b4772a2c6d4002b8d","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:54:06.521394Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.09940/citation-record","integrity":"/paper/2506.09940/integrity","json":"/paper/2506.09940/citation-record.json","paper":"/paper/2506.09940"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.339035Z","title":"The causal structure of the transition sh+1 is the same asr h","venue":null,"work_id":"bc0fd316-e160-4a11-950a-989b14828ed1","year":2009},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.981598Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:4ff4fd4ebcc7f8ca97fc6e66997639dc5d2a06f1be0ac58b1827613ccb92bed2","observation_id":"0a304f26-af6d-4bd0-9bcc-aaabeb304e4c","resolution":{"observed_at":"2026-08-07T04:54:11.521993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03927","last_updated":"2022-09-08T17:08:12Z","snapshot_observed_at":"2026-07-06T13:50:18.095078Z","submitted_at":"2022-09-08T17:08:12Z","title":"Sequential Information Design: Learning to Persuade in the Dark","version":1},"cited_work":{"arxiv_id":"2209.03927","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.03927","snapshot_observed_at":"2026-08-07T04:54:09.997592Z","title":"Sequential Information Design: Learning to Persuade in the Dark","venue":"cs.LG","work_id":"93946bff-d998-4af9-8840-20f3bfd02bef","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.006936Z"},"links":{"cited_paper":"/paper/2209.03927","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:7f799c230ca3484bdc99fbcc0af21c91ad7a7fe161a7c25722119e8933b7a468","observation_id":"a0893674-3196-4bef-8cfd-795a834e2683","resolution":{"observed_at":"2026-08-07T04:54:10.084054Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15634","last_updated":"2022-09-30T17:59:16Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:16Z","title":"A General Framework for Sample-Efficient Function Approximation in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15634","snapshot_observed_at":"2026-08-07T04:54:02.731207Z","title":"J., Yuan, A., Gu, Q., and Jordan, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.731207Z"},"links":{"cited_paper":"/paper/2209.15634","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:df6ec17c4b6702a78055147fdde1522a25ebcbbe8a597390cbdf8d2a2ccf1a07","observation_id":"ce103053-a1c5-4338-9e01-e38b1ffa5044","resolution":{"observed_at":"2026-08-07T04:54:02.731207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.04972","last_updated":"2021-03-08T18:51:00Z","snapshot_observed_at":"2026-07-06T10:47:57.598461Z","submitted_at":"2021-03-08T18:51:00Z","title":"Provably Efficient Cooperative Multi-Agent Reinforcement Learning with Function Approximation","version":1},"cited_work":{"arxiv_id":"2103.04972","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.04972","snapshot_observed_at":"2026-08-07T04:54:08.913189Z","title":"Provably Efficient Cooperative Multi-Agent Reinforcement Learning with Function Approximation","venue":"cs.LG","work_id":"338d8176-988d-486b-bb3a-c8005574e11a","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.009237Z"},"links":{"cited_paper":"/paper/2103.04972","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:d11d0f11af19a800a91d4f4e5d8a43658193b96db5fa8762b5a3b3a7a74b25ef","observation_id":"e5e3c04d-62fe-44e0-98a9-05f8056cae3f","resolution":{"observed_at":"2026-08-07T04:54:09.068600Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.13487","last_updated":"2023-07-11T16:47:42Z","snapshot_observed_at":"2026-07-06T12:22:32.240903Z","submitted_at":"2021-12-27T02:53:44Z","title":"The Statistical Complexity of Interactive Decision Making","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.13487","snapshot_observed_at":"2026-08-07T04:54:03.157341Z","title":"J., Kakade, S","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.157341Z"},"links":{"cited_paper":"/paper/2112.13487","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:bee8defadac0ed4826335a5af8a2a7d1f2e88690e70faa657e8597b2a75d938a","observation_id":"72a59660-db8a-49c2-aad2-4e1a3f2553bb","resolution":{"observed_at":"2026-08-07T04:54:03.157341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.608600Z","title":"and Goldberg, Y","venue":null,"work_id":"c7d67415-89d4-4891-b2ca-c0b6e2a71423","year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.294909Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:701f8539f29cb7cad838cf74199c2f58b6375f68399266a3796906c13e08da3e","observation_id":"b3f4eb6b-269b-44fd-baab-a75e0b3658d4","resolution":{"observed_at":"2026-08-07T04:54:12.777594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.01146","last_updated":"2024-02-14T02:35:48Z","snapshot_observed_at":"2026-08-06T15:19:21.240217Z","submitted_at":"2022-09-02T15:56:08Z","title":"Generalized Principal-Agency: Contracts, Information, Games and Beyond","version":2},"cited_work":{"arxiv_id":"2209.01146","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.01146","snapshot_observed_at":"2026-08-07T04:54:08.658488Z","title":"Generalized Principal-Agency: Contracts, Information, Games and Beyond","venue":"cs.GT","work_id":"1f020909-d2aa-4c26-b02e-e8d5497ebdd5","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.437949Z"},"links":{"cited_paper":"/paper/2209.01146","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:6605d8ba4a4e29bc69d1b5fa5484acb8502ac0264e7f48fba6e03cd30fa10919","observation_id":"e87ba1e4-72af-4e05-92d0-08a330b705ac","resolution":{"observed_at":"2026-08-07T04:54:08.765995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13712","last_updated":"2024-08-20T02:31:25Z","snapshot_observed_at":"2026-08-03T19:29:01.124747Z","submitted_at":"2023-10-13T01:21:52Z","title":"Impact of Guidance and Interaction Strategies for LLM Use on Learner Performance and Perception","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13712","snapshot_observed_at":"2026-08-07T04:54:03.543461Z","title":"J., and Liut, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.543461Z"},"links":{"cited_paper":"/paper/2310.13712","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:11ea628bdac96b5d4ea305cdd99139abc7472ad791103e805fcaa3faba8e60b7","observation_id":"fde7464f-4a58-42df-ac9e-536ec1d70442","resolution":{"observed_at":"2026-08-07T04:54:03.543461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.378759Z","title":null,"venue":null,"work_id":"c5e0d6bd-8c2d-4b96-b73d-3647d9c6d712","year":1994},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.769226Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:6f7cbc854bf35c3084e9a8afaabb2b9c713690ec3ce6072186e85ee53abbcd1d","observation_id":"eea964c4-a3c9-412d-bec4-87c7a08c0382","resolution":{"observed_at":"2026-08-07T04:54:12.463390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.10502","last_updated":"2021-09-22T03:36:51Z","snapshot_observed_at":"2026-08-06T07:02:30.814685Z","submitted_at":"2021-09-22T03:36:51Z","title":"A Spectral Approach to Off-Policy Evaluation for POMDPs","version":1},"cited_work":{"arxiv_id":"2109.10502","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.10502","snapshot_observed_at":"2026-08-07T04:54:07.536685Z","title":"A Spectral Approach to Off-Policy Evaluation for POMDPs","venue":"cs.LG","work_id":"4d0e922b-d088-4937-986d-09b01ec1c066","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.362447Z"},"links":{"cited_paper":"/paper/2109.10502","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:dc9393d7cc03f00d0de909ac99e5025d8f7e4f5452830c4d8760c3e2c3c8ea0b","observation_id":"e1ad7928-2e4d-4f21-a123-e56cc1018896","resolution":{"observed_at":"2026-08-07T04:54:07.688057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.13081","last_updated":"2023-11-14T22:16:28Z","snapshot_observed_at":"2026-07-06T13:35:39.787667Z","submitted_at":"2022-07-26T17:53:29Z","title":"Future-Dependent Value-Based Off-Policy Evaluation in POMDPs","version":2},"cited_work":{"arxiv_id":"2207.13081","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.13081","snapshot_observed_at":"2026-08-07T04:54:06.992916Z","title":"Future-Dependent Value-Based Off-Policy Evaluation in POMDPs","venue":"cs.LG","work_id":"dd9efded-845e-415b-99db-cc927c1cfdae","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.661647Z"},"links":{"cited_paper":"/paper/2207.13081","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:05c8890aff54d1d58024c9186326ce70c9826b92f8110fef49e49e78bde0bbb4","observation_id":"6f5b7b01-83d2-4ece-877e-60aa6745c19a","resolution":{"observed_at":"2026-08-07T04:54:07.118747Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.06309","last_updated":"2019-05-29T02:05:10Z","snapshot_observed_at":"2026-07-06T07:45:44.180699Z","submitted_at":"2019-04-12T16:32:17Z","title":"Distributed Bandit Learning: Near-Optimal Regret with Efficient Communication","version":2},"cited_work":{"arxiv_id":"1904.06309","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.06309","snapshot_observed_at":"2026-08-07T04:54:06.693850Z","title":"Distributed Bandit Learning: Near-Optimal Regret with Efficient Communication","venue":"cs.LG","work_id":"98c9678a-1d22-460c-b5d7-0e2b2345a25c","year":2019},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.786705Z"},"links":{"cited_paper":"/paper/1904.06309","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:384e3406fdf22ff9b78e0035bfc5a9b25aee915238bf8ef035e566e1928b3217","observation_id":"934db6f4-644f-4424-90c5-2aa261c47055","resolution":{"observed_at":"2026-08-07T04:54:06.868256Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10678","last_updated":"2022-02-22T05:41:43Z","snapshot_observed_at":"2026-07-06T12:40:16.583058Z","submitted_at":"2022-02-22T05:41:43Z","title":"Sequential Information Design: Markov Persuasion Process and Its Efficient Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10678","snapshot_observed_at":"2026-08-07T04:54:04.936385Z","title":"I., and Xu, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.936385Z"},"links":{"cited_paper":"/paper/2202.10678","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:8b3954abb3f9ea235ac148a7525c2bb65954835953b6437fd68ac85591d77827","observation_id":"2622d014-63f5-40d7-9a54-1cfd3b172673","resolution":{"observed_at":"2026-08-07T04:54:04.936385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.11040","last_updated":"2022-08-23T15:32:44Z","snapshot_observed_at":"2026-07-06T13:44:41.231513Z","submitted_at":"2022-08-23T15:32:44Z","title":"Strategic Decision-Making in the Presence of Information Asymmetry: Provably Efficient RL with Algorithmic Instruments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.11040","snapshot_observed_at":"2026-08-07T04:54:05.048804Z","title":"Strategic decision-making in the presence of information asymmetry: Provably ef- ficient rl with algorithmic instruments.arXiv preprint arXiv:2208.11040,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.048804Z"},"links":{"cited_paper":"/paper/2208.11040","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:b5deb382324659418458036114bc97bad80b4db6d247ef4c689eb17155d5b6bb","observation_id":"70a35387-73a2-43dc-b593-10034929719e","resolution":{"observed_at":"2026-08-07T04:54:05.048804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.13521","last_updated":"2021-12-27T05:41:14Z","snapshot_observed_at":"2026-08-01T16:05:23.189518Z","submitted_at":"2021-12-27T05:41:14Z","title":"Can Reinforcement Learning Find Stackelberg-Nash Equilibria in General-Sum Markov Games with Myopic Followers?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.13521","snapshot_observed_at":"2026-08-07T04:54:05.164140Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.164140Z"},"links":{"cited_paper":"/paper/2112.13521","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:c5189a7f2a4250baa11f26f0308a3dc898b5535244d0743e60b4e81abaf20083","observation_id":"397c7713-7dff-4a4c-9669-ab4428628ab2","resolution":{"observed_at":"2026-08-07T04:54:05.164140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01962","last_updated":"2023-06-30T13:05:42Z","snapshot_observed_at":"2026-07-06T14:14:06.039306Z","submitted_at":"2022-11-03T16:42:40Z","title":"GEC: A Unified Framework for Interactive Decision Making in MDP, POMDP, and Beyond","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01962","snapshot_observed_at":"2026-08-07T04:54:05.290336Z","title":"A posterior sampling frame- work for interactive decision making.arXiv preprint arXiv:2211.01962,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.290336Z"},"links":{"cited_paper":"/paper/2211.01962","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:269041f25b9ee43b4f5b6c3cb1983c25a7ac546f8a5cd4d711127118f9da912c","observation_id":"0774341a-012a-440c-bddb-28ef5f3eb085","resolution":{"observed_at":"2026-08-07T04:54:05.290336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.230892Z","title":"Notation Table For the convenience of the reader, we summarize the notations in the paper as a notation table","venue":null,"work_id":"a4d4ce8a-c580-45b7-b584-dae27925abc0","year":2018},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.422440Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:c7ccd8bee1cb5bce121e9d3f03b464acb4c9ba8b17f4ce328c54df7e5eb4dfc2","observation_id":"d56982cc-0085-434d-a31b-9af0ef59ffa4","resolution":{"observed_at":"2026-08-07T04:54:12.308788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.108303Z","title":null,"venue":null,"work_id":"e68cfc6e-d4d2-44ad-87d7-5e43d3abe209","year":2013},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.588600Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:aa02c1ce0e51f9441389883a18206af1ab344105b80fc99f2274c7587beed472","observation_id":"aed164c0-13e0-416c-88e5-17b764dea9cf","resolution":{"observed_at":"2026-08-07T04:54:12.161611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.684305Z","title":null,"venue":null,"work_id":"74e4490a-33da-43d2-9127-904901154864","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.846040Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:21297d44c4052fa56f858f402be0c9614b80f050efdd0cb2848ee940fef49b36","observation_id":"90caff52-f96f-416f-ae2f-2aa4fbccf611","resolution":{"observed_at":"2026-08-07T04:54:11.811749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.021629Z","title":"Section 4.1) and the dynamical transition class (see Section D.1)","venue":null,"work_id":"0d0896a7-2581-43b1-9fb3-8dc25990f645","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:06.105483Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:dc24df884052e06043cb43761832ece096760b14b6c271da8669d7c5d5f1d6d1","observation_id":"00a46fb7-3e40-46e3-8060-8adc3e61b57d","resolution":{"observed_at":"2026-08-07T04:54:11.177643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.824771Z","title":null,"venue":null,"work_id":"38d2914a-ac79-422a-9e3b-9e3b0004d2be","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:06.249836Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:a47ede82e027ea1eda552caf830c79476e7babc385b74638fb6b14455e4dce2a","observation_id":"138a270b-83d2-4f00-bc7c-cb790fe5fe33","resolution":{"observed_at":"2026-08-07T04:54:10.945201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.505480Z","title":"Denote the least-square estimator of f ∗ by ˆf, standard analysis allows us to bound the projected Mean Squared Error (pMSE) EW EX,Y h Y− ˆf(X)|W i2","venue":null,"work_id":"ec4d3aa0-7218-4791-b4f9-44e87fdee3ae","year":2014},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:06.403117Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:3b538c75651984d60e0769273c6e9a8e552ab134caa8d138c5f8e8c57f198678","observation_id":"673bdefd-9a66-4539-ac0d-de610111fbf5","resolution":{"observed_at":"2026-08-07T04:54:10.671170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.01866","last_updated":"2020-01-09T19:08:09Z","snapshot_observed_at":"2026-08-05T18:01:40.803157Z","submitted_at":"2020-01-07T02:59:59Z","title":"Reinforcement Learning via Fenchel-Rockafellar Duality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.01866","snapshot_observed_at":"2026-08-07T04:54:04.252289Z","title":"and Dai, B","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":1982,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.252289Z"},"links":{"cited_paper":"/paper/2001.01866","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:16758486a6bcefa6e71d3b6baf67169fdd7c803c231ee2f07b90713a5431a04c","observation_id":"2c57ecf3-d9cf-4bd4-b63f-5712208a686c","resolution":{"observed_at":"2026-08-07T04:54:04.252289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.07035","last_updated":"2022-06-21T21:34:58Z","snapshot_observed_at":"2026-08-05T14:56:05.630631Z","submitted_at":"2021-02-14T00:06:54Z","title":"Model-free Representation Learning and Exploration in Low-rank MDPs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.07035","snapshot_observed_at":"2026-08-07T04:54:04.093965Z","title":"Model-free representation learning and exploration in low-rank mdps.arXiv preprint arXiv:2102.07035,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":1984,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.093965Z"},"links":{"cited_paper":"/paper/2102.07035","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:8078228abb9f2221d8f8e9ff1196a506d034ace017f9ae815aa38fadfb69695b","observation_id":"a31f4c4b-8e59-420d-959d-4bca75f21e2f","resolution":{"observed_at":"2026-08-07T04:54:04.093965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08967","last_updated":"2022-05-24T18:53:45Z","snapshot_observed_at":"2026-08-04T04:17:06.345381Z","submitted_at":"2022-04-19T16:08:28Z","title":"When Is Partially Observable Reinforcement Learning Not Scary?","version":2},"cited_work":{"arxiv_id":"2204.08967","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.08967","snapshot_observed_at":"2026-08-07T04:54:08.020462Z","title":"When Is Partially Observable Reinforcement Learning Not Scary?","venue":"cs.LG","work_id":"19abff3f-a3eb-491c-a968-b02d2172d692","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":1994,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.882330Z"},"links":{"cited_paper":"/paper/2204.08967","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:b0062c7e20cc54ebb8d1be90e8252158e53b0370d0eed962e15f1f9c66352b46","observation_id":"484eed63-23fc-40fc-adec-020a11fac100","resolution":{"observed_at":"2026-08-07T04:54:08.160563Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:13.209838Z","title":"and Urner, R","venue":null,"work_id":"ac6361b7-6d96-48f3-9bf2-02071ad4aab8","year":2012},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.666375Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:bec908093deaccc43f6bd065a1d6bf0adb0afc6c1f647217d7d2800d8327b570","observation_id":"01574dc7-f2af-408e-afcb-3b1baf6abd76","resolution":{"observed_at":"2026-08-07T04:54:13.329279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.948926Z","title":"RL with confounders.Our work is also related to RL with confounders, as the private type th acts as an unobserved confounder in the strategic interaction model","venue":null,"work_id":"428787c2-fb13-4144-8c47-6e4494679ffd","year":2011},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2003,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.715325Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:cf167c9e63db0509c54a78c17277f31edec6d386365021b8dabcbd81701d05eb","observation_id":"f81925d8-6bb7-4d7b-b791-0c39d52cd761","resolution":{"observed_at":"2026-08-07T04:54:12.038612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.06784","last_updated":"2022-06-15T21:52:05Z","snapshot_observed_at":"2026-07-06T12:07:56.233037Z","submitted_at":"2021-11-12T15:52:24Z","title":"A Minimax Learning Approach to Off-Policy Evaluation in Confounded Partially Observable Markov Decision Processes","version":4},"cited_work":{"arxiv_id":"2111.06784","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.06784","snapshot_observed_at":"2026-08-07T04:54:07.274233Z","title":"A Minimax Learning Approach to Off-Policy Evaluation in Confounded Partially Observable Markov Decision Processes","venue":"cs.LG","work_id":"02aa66fe-37ae-4dea-8b54-071e72009797","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2005,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.503307Z"},"links":{"cited_paper":"/paper/2111.06784","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:44ce68dc5a35f98d81a952ec0c68eeeec9f5dfa148fd74c57318bb9c01ff3b3c","observation_id":"af6cc5eb-9151-4625-ba36-1c0499f3bf84","resolution":{"observed_at":"2026-08-07T04:54:07.397002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03852","last_updated":"2024-07-19T11:35:43Z","snapshot_observed_at":"2026-07-06T14:02:23.566635Z","submitted_at":"2022-10-07T23:55:51Z","title":"Stackelberg POMDP: A Reinforcement Learning Approach for Economic Design","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03852","snapshot_observed_at":"2026-08-07T04:54:02.141846Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.141846Z"},"links":{"cited_paper":"/paper/2210.03852","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:309082fae0b6240bee26a544e341c94c959f3b117faae1213834c48dcc824e26","observation_id":"b6c06909-c5f1-4df3-a818-a6813dfe345f","resolution":{"observed_at":"2026-08-07T04:54:02.141846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03244","last_updated":"2022-03-13T07:22:13Z","snapshot_observed_at":"2026-07-06T11:55:17.935458Z","submitted_at":"2021-10-07T07:59:50Z","title":"Near-Optimal Reward-Free Exploration for Linear Mixture MDPs with Plug-in Solver","version":4},"cited_work":{"arxiv_id":"2110.03244","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.03244","snapshot_observed_at":"2026-08-07T04:54:09.205923Z","title":"Near-Optimal Reward-Free Exploration for Linear Mixture MDPs with Plug-in Solver","venue":"cs.LG","work_id":"ab48c434-46e5-476c-86ba-8697555e54a0","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.600821Z"},"links":{"cited_paper":"/paper/2110.03244","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:f740ece0ec3f5bb9a97b585d3b736b00fae5324409e4aa624b8f66ea25ba8bc8","observation_id":"0551c6a1-d9c2-493b-9313-e1215ae844d6","resolution":{"observed_at":"2026-08-07T04:54:09.323072Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.06169","last_updated":"2022-06-27T02:34:13Z","snapshot_observed_at":"2026-07-06T12:27:49.978708Z","submitted_at":"2022-01-17T01:09:38Z","title":"On Well-posedness and Minimax Optimal Rates of Nonparametric Q-function Estimation in Off-policy Evaluation","version":3},"cited_work":{"arxiv_id":"2201.06169","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.06169","snapshot_observed_at":"2026-08-07T04:54:09.441738Z","title":"On Well-posedness and Minimax Optimal Rates of Nonparametric Q-function Estimation in Off-policy Evaluation","venue":"math.ST","work_id":"2e477a71-2d30-4af2-9294-0c632155b3fc","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.462387Z"},"links":{"cited_paper":"/paper/2201.06169","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:f7eecca0558c14a6219e144f60ed2b74abe5c8ec136a05f52d5989f0ecd54ead","observation_id":"69d66a50-b79c-45cd-888b-177460d542b2","resolution":{"observed_at":"2026-08-07T04:54:09.586681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15332","last_updated":"2023-03-22T22:24:18Z","snapshot_observed_at":"2026-07-06T12:03:10.121189Z","submitted_at":"2021-10-28T17:46:14Z","title":"Proximal Reinforcement Learning: Efficient Off-Policy Evaluation in Partially Observed Markov Decision Processes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15332","snapshot_observed_at":"2026-08-07T04:54:01.740262Z","title":"and Kallus, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.740262Z"},"links":{"cited_paper":"/paper/2110.15332","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:62bf4395c4122551ab58d056b33c1829582fc00403b15a4aac42629fdd916126","observation_id":"eb476f26-f3a0-424c-852f-3a73651be08b","resolution":{"observed_at":"2026-08-07T04:54:01.740262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.241927Z","title":null,"venue":null,"work_id":"0ca8ceec-40d6-4ec2-898e-d7127e84bf42","year":2011},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:06.521394Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:f055717138c63d4f44b595609664cba7b802503963e1a29e931905f8110a0be4","observation_id":"65ab6644-e237-471f-899c-80b272760fc7","resolution":{"observed_at":"2026-08-07T04:54:10.364098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.08693","last_updated":"2023-10-22T20:59:12Z","snapshot_observed_at":"2026-07-06T07:09:29.571298Z","submitted_at":"2018-10-19T21:38:06Z","title":"The total variation distance between high-dimensional Gaussians with the same mean","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.08693","snapshot_observed_at":"2026-08-07T04:54:02.883224Z","title":"The total variation distance between high-dimensional gaussians","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.883224Z"},"links":{"cited_paper":"/paper/1810.08693","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:5fe07148726d215df3dab98748b83f1660d255a21f78dfcfd1fb63a8ac8a4874","observation_id":"20bbaf71-ffb4-404c-b55f-c53a9238e695","resolution":{"observed_at":"2026-08-07T04:54:02.883224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07822","last_updated":"2021-04-15T23:44:39Z","snapshot_observed_at":"2026-07-06T11:00:07.753513Z","submitted_at":"2021-04-15T23:44:39Z","title":"Estimating and Improving Dynamic Treatment Regimes With a Time-Varying Instrumental Variable","version":1},"cited_work":{"arxiv_id":"2104.07822","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.07822","snapshot_observed_at":"2026-08-07T04:54:09.704464Z","title":"Estimating and Improving Dynamic Treatment Regimes With a Time-Varying Instrumental Variable","venue":"stat.ME","work_id":"da834964-f369-4c76-a4c8-d25630c5dcaa","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.296965Z"},"links":{"cited_paper":"/paper/2104.07822","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:a1dd6dbaa0f18e2cc191c57489413a96a4d0495c3e53f73b7421583f35b242e3","observation_id":"e69212ad-7db0-444e-910e-9a518f081e0a","resolution":{"observed_at":"2026-08-07T04:54:09.838252Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.895452Z","title":"Off-policy evaluation in infinite-horizon reinforcement learning with latent confounders","venue":null,"work_id":"9cb16b1d-372b-44b4-8776-f62a4f794131","year":1999},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.875863Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:25353a9c20d927e88a02b0d9ab4d543ff66347813246a14eac94c0f6df17ce84","observation_id":"76fddd0e-11b6-4bfe-976a-9f2ac34a8790","resolution":{"observed_at":"2026-08-07T04:54:13.041692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00046","last_updated":"2023-02-07T16:07:50Z","snapshot_observed_at":"2026-07-06T13:26:33.250328Z","submitted_at":"2022-06-30T18:26:03Z","title":"Performative Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2207.00046","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.00046","snapshot_observed_at":"2026-08-07T04:54:07.815412Z","title":"Performative Reinforcement Learning","venue":"cs.LG","work_id":"ac29a13d-9b4f-4e06-9c79-55564b6b013c","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.995282Z"},"links":{"cited_paper":"/paper/2207.00046","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:a5b9dc648d4be85f336e0addeaa0c5227bf386f65b4c85868f7fa27191b53e1c","observation_id":"04cb86aa-8842-4d94-b8c9-3b8e85dbd73e","resolution":{"observed_at":"2026-08-07T04:54:07.903892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09907","last_updated":"2024-10-14T22:26:38Z","snapshot_observed_at":"2026-08-04T15:40:09.141942Z","submitted_at":"2021-02-19T13:01:40Z","title":"Instrumental Variable Value Iteration for Causal Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2102.09907","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.09907","snapshot_observed_at":"2026-08-07T04:54:08.291306Z","title":"Instrumental Variable Value Iteration for Causal Offline Reinforcement Learning","venue":"stat.ML","work_id":"337fc120-d563-46a0-aa68-e36c657b52ee","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.658128Z"},"links":{"cited_paper":"/paper/2102.09907","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:10a55f566d5da036ac96b8e01c394c2324adc72e8e7413c41f826db790416668","observation_id":"8fd8f01b-760c-4162-b371-c47fa63a0f77","resolution":{"observed_at":"2026-08-07T04:54:08.476679Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T04:34:49.017127Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":13,"verified_fuzzy":8},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2506.09940."}