{"as_of":"2026-08-09T02:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b49ec8949cb9a27b4505d2eefdbcaadd313751afc48add8fa5943f60d2f2aa7","coverage":[{"denominator":10,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:38:17.474509Z","state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.10812/citation-record","integrity":"/paper/2604.10812/integrity","json":"/paper/2604.10812/citation-record.json","paper":"/paper/2604.10812"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning 101: Ai plays pok ´emon! https: //medium.com/ordina-data/reinforcement-learning-101-ai-plays-pok% C3%A9mon-e0626bd6beae","venue":null,"work_id":"c2d7bc6f-75a1-4137-8574-8ac7ace74aee","year":2024},"citing_paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:17.474509Z"},"links":{"citing_paper":"/paper/2604.10812"},"observation_digest":"sha256:1ce6fddf636dcc1d85836374472a2e59fff31a3bee3d37bc69b8f0b44fd4e051","observation_id":"5e2c575b-d240-480e-a165-a199e3f45106","resolution":{"observed_at":"2026-05-17T19:32:05.126045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.10995","last_updated":"2021-02-26T21:21:11Z","snapshot_observed_at":"2026-07-06T07:30:05.397042Z","submitted_at":"2019-01-30T18:40:37Z","title":"Go-Explore: a New Approach for Hard-Exploration Problems","version":4},"cited_work":{"arxiv_id":"1901.10995","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1901.10995","snapshot_observed_at":"2026-07-04T15:29:55.587215Z","title":"Go-explore: a new approach for hard-exploration problems","venue":null,"work_id":"811ed60c-dea3-46b6-b28f-bf76eb844c38","year":1901},"citing_paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:17.474509Z"},"links":{"cited_paper":"/paper/1901.10995","citing_paper":"/paper/2604.10812"},"observation_digest":"sha256:13b880e6a9d13a635cd768448f22462f250ce180ee44a729313366793bc25e58","observation_id":"d617b402-533e-4565-bbe1-64537fbb271d","resolution":{"observed_at":"2026-05-11T10:06:04.951429Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01118","last_updated":"2024-04-02T15:46:35Z","snapshot_observed_at":"2026-08-06T08:24:17.984186Z","submitted_at":"2024-02-02T03:22:12Z","title":"PokeLLMon: A Human-Parity Agent for Pokemon Battles with Large Language Models","version":3},"cited_work":{"arxiv_id":"2402.01118","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.01118","snapshot_observed_at":"2026-07-04T00:39:17.308922Z","title":"Pokéllmon: A human-parity agent for pokémon battles with large language models","venue":null,"work_id":"789030c4-d8d7-4ba1-ab5e-86c4450f0e15","year":2024},"citing_paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:17.474509Z"},"links":{"cited_paper":"/paper/2402.01118","citing_paper":"/paper/2604.10812"},"observation_digest":"sha256:2cb825a20e825181a434391e59e2ece0daaae5fdad63b25a7d4ca72469d7fb61","observation_id":"45738616-ddc0-4726-a31f-e41d1a608ac9","resolution":{"observed_at":"2026-05-11T10:06:04.898354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:44:02.297018Z","title":"The pokeagent challenge: Competitive and long-context learning at scale","venue":null,"work_id":"5aca4e92-c80d-4627-8eb9-6dc68e609a43","year":2025},"citing_paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:17.474509Z"},"links":{"citing_paper":"/paper/2604.10812"},"observation_digest":"sha256:a180bae983e0e5761dd5b97da4ac24731d79fa1adbee51109d1dfa85cf96ec0a","observation_id":"7b5250ed-c586-490d-8989-5dd63a230d08","resolution":{"observed_at":"2026-05-17T19:32:05.142145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19920","last_updated":"2025-03-11T05:44:11Z","snapshot_observed_at":"2026-08-07T17:43:28.824095Z","submitted_at":"2025-02-27T09:42:23Z","title":"Pokemon Red via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2502.19920","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19920","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pokemon red via reinforcement learning","venue":null,"work_id":"02216e3d-ac4a-4a74-9541-eed7f5718399","year":2025},"citing_paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:17.474509Z"},"links":{"cited_paper":"/paper/2502.19920","citing_paper":"/paper/2604.10812"},"observation_digest":"sha256:90fc1d1c292489db7139e3a9e1aa90c39753b7d85afd67c113309a0b76a93bf2","observation_id":"8b0bcc59-9883-4e66-9a9b-2c00a5417363","resolution":{"observed_at":"2026-05-11T10:06:04.936693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pokemon rl observations: The ”visited mask”","venue":null,"work_id":"2ea218f1-367d-4fdc-943c-57f744d75646","year":2025},"citing_paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:17.474509Z"},"links":{"citing_paper":"/paper/2604.10812"},"observation_digest":"sha256:9759fdca61c8321e3daf3962eb38c433d3b4fdb894088243d6b5a53aad0ccf6e","observation_id":"663c8711-29cc-4c96-b71a-9af00ba321e3","resolution":{"observed_at":"2026-05-17T19:32:05.138076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Poke-env: pokemon ai in python","venue":null,"work_id":"e3e58004-3eb6-40d0-8d51-29be7db39de6","year":null},"citing_paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:17.474509Z"},"links":{"citing_paper":"/paper/2604.10812"},"observation_digest":"sha256:78c7bb54ad2902913e396de54038a2b840e4c9635bdb10d09cef69c7c05bb18a","observation_id":"4b0ce119-b75c-4c14-83d3-65772ebc6526","resolution":{"observed_at":"2026-05-17T19:32:05.132156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On shannon entropy and its applications.Kuwait Journal of Science, 50(3):194–199","venue":null,"work_id":"20ae0965-88f0-434c-821d-d45676b20bcb","year":2023},"citing_paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:17.474509Z"},"links":{"citing_paper":"/paper/2604.10812"},"observation_digest":"sha256:48c802678d1ff6c0e35eb90ab2c97c4bc1f7a574bdee2af3f88b9c7e8449894a","observation_id":"7ce193ff-c961-4053-bd18-5b0d6b4a0d5c","resolution":{"observed_at":"2026-05-17T19:32:05.121829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:10.239871Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":"3fd006b3-ce9f-4777-887c-2e1b5edfdf04","year":2017},"citing_paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:17.474509Z"},"links":{"citing_paper":"/paper/2604.10812"},"observation_digest":"sha256:790779125184c4b39d77453c7daf65505fa25a6517bfd95c0c14d87112d89422","observation_id":"0a2c530d-785b-45e4-9cfe-e4ff0c257f41","resolution":{"observed_at":"2026-05-17T19:32:05.113909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"771a1c92-a9c4-4809-bd01-278c36caa129","year":2023},"citing_paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:17.474509Z"},"links":{"citing_paper":"/paper/2604.10812"},"observation_digest":"sha256:b8ed9c5a3fcb4f580512b27fc713b217f7d0debb9996e03f57c87eac4b5b025c","observation_id":"5599da1d-e299-477b-a4a8-94335f409f6c","resolution":{"observed_at":"2026-05-17T19:32:05.117340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.10812","last_updated":"2026-04-12T20:46:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:46:47Z","title":"PokeRL: Reinforcement Learning for Pokemon Red"},"reference_resolution":{"displayed":10,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":1,"verified_exact":2,"verified_fuzzy":6},"total_outbound_references":10},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 10 of 10 outbound references and 0 inbound Pith citation observations for arXiv:2604.10812."}