{"as_of":"2026-08-10T17:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:12fb146d070b373892fa2454c0da1f539b4acc69f1adaea3a9cff3fc99296bca","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:56:12.926094Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.06301/citation-record","integrity":"/paper/2502.06301/integrity","json":"/paper/2502.06301/citation-record.json","paper":"/paper/2502.06301"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.229575Z","title":"Sutton and Andrew G","venue":null,"work_id":"21c2de3b-65b8-4d4a-a71a-2e1e4ab98f52","year":2018},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.836510Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:bf7322aa921a76336d8184dbd03935c3c1c0e73a349894a1afe6cd554dfc6985","observation_id":"99825ef8-090c-42ad-9f17-e31af988d065","resolution":{"observed_at":"2026-08-08T15:56:13.234331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.216178Z","title":"De Jong.Evolutionary Computation","venue":null,"work_id":"15049208-0a1e-4e68-a75a-9608a8d86741","year":2016},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.842368Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:e4f79eacb44b5231b90b867f890b90ffb23db70ed9012db650b5e43586b4e38e","observation_id":"acd655cd-5862-438a-a10f-5ab6d50c0f8e","resolution":{"observed_at":"2026-08-08T15:56:13.220588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.202264Z","title":"Friedrich Frommann Verlag, Stuttgart-Bad Cannstatt, Germany, 1973","venue":null,"work_id":"76e20970-c8f8-4964-aabc-c1d846bc52a5","year":1973},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.847510Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:68a00addf4c312ccb5358dd3ae0889900be818c441ca8727b8d75543d4f1e78f","observation_id":"bed0ab23-efaa-4ab3-8e32-fe67734f71a2","resolution":{"observed_at":"2026-08-08T15:56:13.207222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.188310Z","title":"Efficacy of modern neuro-evolutionary strategies for continuous control optimization.Fron- tiers in Robotics and AI, 7, 2020","venue":null,"work_id":"4619e719-bf1c-43bf-9515-24b7ae8b59cd","year":2020},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.852702Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:1d10a1e539862f4876ff44636bd283e6b47502a645ff4fa8ff2be6ab3ab6a17f","observation_id":"2e8e717b-300c-4bdb-beaa-232bc15c7a36","resolution":{"observed_at":"2026-08-08T15:56:13.193006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.174615Z","title":"Venkate- sha Prasad, and Chris Verhoeven","venue":null,"work_id":"f76f1762-230f-4c8f-87f9-a0febee383bb","year":2024},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.857985Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:7c4db8794c3c123125adbb3ced435a5c4e122bd99d615b352c9ddbd6888c2d93","observation_id":"e4327f0b-b6e2-4510-8cb8-56ea0169c517","resolution":{"observed_at":"2026-08-08T15:56:13.179259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.160625Z","title":"Combining evolution and deep reinforcement learning for policy search: A survey.ACM Trans","venue":null,"work_id":"0431afe7-b6aa-4abf-93cc-88f29707b48f","year":2023},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.862965Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:c849297be82de6b2c66de54257ca7e338b126070770e33b5521afbae530a59aa","observation_id":"35afc798-f47e-47c9-9627-0e142d3cbfdc","resolution":{"observed_at":"2026-08-08T15:56:13.165163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.146609Z","title":"Stanley.Novelty Search and the Problem with Objectives, pages 37–56","venue":null,"work_id":"58350470-7d96-45a4-9ae6-5c65951eb742","year":2011},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.868258Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:091cdf11aaad9dd80fc32a63993991852aae71df296206df1a9f46adf330ad62","observation_id":"da90fa00-21b6-489a-899f-7d8f10ba2710","resolution":{"observed_at":"2026-08-08T15:56:13.151288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.132701Z","title":null,"venue":null,"work_id":"19b29c6f-6e38-45fb-b210-62a3eb7a4479","year":2011},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.872905Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:1b35590aad0224d1d29a9bf6ab4fdc182e217154cfc6cb2928d6cb32c065576b","observation_id":"254c99bd-fc9a-48ad-81b2-548e7ae60978","resolution":{"observed_at":"2026-08-08T15:56:13.137373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.118683Z","title":"Pugh, Lisa B","venue":null,"work_id":"94597b25-656b-4d35-bf4a-6893d661d2db","year":2016},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.877451Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:83a47e04fae8231a4f7de51c20ca69cb53fa1143a0161a82278ee7487967c54e","observation_id":"a59926a3-93db-426e-945e-7d6f7c2138cb","resolution":{"observed_at":"2026-08-08T15:56:13.123456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.105069Z","title":"Stanley, and Jeff Clune","venue":null,"work_id":"3d8b011a-3ba2-4b79-99cf-e59104dd4ce7","year":2018},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.881964Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:348d1973a75c054a173037b27b396e5b0ced3edf3a99f80c067348968971cc7f","observation_id":"7fce9110-a63d-4847-9bf0-42d8b2b15019","resolution":{"observed_at":"2026-08-08T15:56:13.109513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.091203Z","title":"Evolution strategies as a scalable alternative to reinforcement learning.arXiv, 2017","venue":null,"work_id":"a4809648-3fbf-498b-981b-93c66d1bbf1b","year":2017},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.886476Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:4de5e8e1a4f90e72f588c59e4e03fdcdaf808a0313df51ded9ea40e0e8160a9f","observation_id":"a586f444-8417-4df2-ac6f-8a8f8c87175f","resolution":{"observed_at":"2026-08-08T15:56:13.095741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.077258Z","title":"Attention is all you need","venue":null,"work_id":"814dec57-49eb-4184-839c-521cdde4c44a","year":2017},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.890724Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:184d57e3228051694ff0e671d13efb5240bee9331af1c19818b71b7261da753e","observation_id":"327e997c-3d92-45fb-a96c-f57680b1b3b8","resolution":{"observed_at":"2026-08-08T15:56:13.081735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.063055Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"69d39948-7426-487c-ac82-837e2fb133cf","year":2021},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.895381Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:9ff871993eddd388cf36f257804de6c2b7711de3d92bc9e11b107c158bfe97c7","observation_id":"e3e2bf46-08bd-4ef0-9810-074f58094ce0","resolution":{"observed_at":"2026-08-08T15:56:13.067905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01345","last_updated":"2021-06-24T17:09:59Z","snapshot_observed_at":"2026-08-07T09:11:20.723647Z","submitted_at":"2021-06-02T17:53:39Z","title":"Decision Transformer: Reinforcement Learning via Sequence Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.01345","snapshot_observed_at":"2026-08-08T15:56:12.899684Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.899684Z"},"links":{"cited_paper":"/paper/2106.01345","citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:d01d4eb3b7ad92342be585dbaa6665f3cd5172894a8f1ab884c86c188b38e896","observation_id":"c0604f62-8275-42b2-b8a6-9276a1c4020e","resolution":{"observed_at":"2026-08-08T15:56:12.899684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.047100Z","title":"Offline reinforcement learning as one big sequence modeling problem","venue":null,"work_id":"c4966a06-17d5-40d4-bcfa-038bb8700945","year":2021},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.904302Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:0a8549b8ce0d4f23c0af0ca5c10ed66efe5c51020f7b790860ca52cdaadf60c2","observation_id":"01264edb-e442-4d90-b50a-cb790beaf7e9","resolution":{"observed_at":"2026-08-08T15:56:13.052663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.031482Z","title":"Utilizing evolution strategies to train transformers in reinforcement learning, 2025","venue":null,"work_id":"da33d2b3-1386-4612-bced-4c9500dfbc88","year":2025},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.908612Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:0f854975218498bd99e98d9ff4ed33b08276fbc3ca6e1bd1d0631c49a7d633a1","observation_id":"debfbcc8-090a-4317-8713-6de02721030b","resolution":{"observed_at":"2026-08-08T15:56:13.036347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.016701Z","title":"Natural evolution strategies.Journal of Machine Learning Research, 15(27):949–980, 2014","venue":null,"work_id":"e34c92d6-574f-4192-b79b-295f0eca477a","year":2014},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.912852Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:3bd7d561828dc5b6e0ff98d6cd90bbade0e10aa4dcfed38e1f7227b1b15ba8ca","observation_id":"eba538db-f2d9-4f21-a2d6-c32c6d05eac3","resolution":{"observed_at":"2026-08-08T15:56:13.021648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:13.001005Z","title":"First-order and second-order variants of the gradient descent in a unified framework","venue":null,"work_id":"2643b81c-f990-4f95-af12-4533fac11c1a","year":2021},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.917228Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:2aa4f1a2319d01a0e1a7df2080926a6798ffba6568855c3742803f766ecf07cf","observation_id":"488e0243-f3fa-484a-9c7c-3b28623e6c7e","resolution":{"observed_at":"2026-08-08T15:56:13.005820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:12.985551Z","title":"MuJoCo: A physics engine for model-based control","venue":null,"work_id":"41b53bff-14a5-44ad-8254-5a70614cbfa8","year":2012},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.921652Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:394da280212a065088bd60b0db92a972bfca6447f7839583efcd254b82c0b098","observation_id":"ccbb8586-46f9-4dbc-a20c-444390a346c0","resolution":{"observed_at":"2026-08-08T15:56:12.991255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:56:12.969470Z","title":"OpenAI Gym.arXiv, 06 2016","venue":null,"work_id":"4fa4fe54-9272-4be2-bd9a-d22482335af9","year":2016},"citing_paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T15:56:12.926094Z"},"links":{"citing_paper":"/paper/2502.06301"},"observation_digest":"sha256:1ce9bf5c1c3942da3f8d3e921083ad085af59f4e2587e23eb258c64d5d57b9b1","observation_id":"4b9338a6-3053-4c82-b6ac-dfbc52f8276f","resolution":{"observed_at":"2026-08-08T15:56:12.975389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.06301","last_updated":"2025-09-17T07:46:50Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T14:52:32.032374Z","submitted_at":"2025-02-10T09:44:10Z","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2502.06301."}