{"as_of":"2026-08-19T02:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d497cf50ef8ae60aaf3b4c8fd81a8376c6b8f1e85446db5a5a4de0053a1c39d","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:22:16.177487Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T04:01:31.928056Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T21:51:30.641060Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"cited_work":{"arxiv_id":"2505.10010","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.10010","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imag- inebench: Evaluating reinforcement learning with large language model rollouts.arXiv preprint arXiv:2505.10010","venue":null,"work_id":"0b5d9a5e-d898-4adf-bb7d-471dc34957d7","year":null},"citing_paper":{"arxiv_id":"2604.24729","last_updated":"2026-04-27T17:40:18Z","snapshot_observed_at":"2026-08-12T13:11:55.493073Z","submitted_at":"2026-04-27T17:40:18Z","title":"SpecRLBench: A Benchmark for Generalization in Specification-Guided Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T04:01:31.928056Z"},"links":{"cited_paper":"/paper/2505.10010","citing_paper":"/paper/2604.24729"},"observation_digest":"sha256:1fa8cc525bd781e9c67bcd7ccb6341504b39932d5d5c24279df925e27494bacd","observation_id":"65da9b3c-af91-4fe4-867b-48c09c4344dd","resolution":{"observed_at":"2026-05-11T21:51:30.671346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.10010/citation-record","integrity":"/paper/2505.10010/integrity","json":"/paper/2505.10010/citation-record.json","paper":"/paper/2505.10010"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.725607Z","title":null,"venue":null,"work_id":"afa6b9b2-1916-48f5-bc9d-0eaa59fa21c0","year":1977},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.012007Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:6a685184e1b5e3248655719342a59c06888185a1e13474f9a8cd1d34e7cc80c1","observation_id":"9f743604-27f1-41ba-8b19-a8aba4033be0","resolution":{"observed_at":"2026-08-15T21:22:16.729635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-15T21:22:16.017057Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.017057Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:165516fccf14f7ccbcb8da54a0f57405ded5a66b4b6daf2a6a19602564d942d1","observation_id":"b187e487-1d3b-47ae-8d52-c89fead7a742","resolution":{"observed_at":"2026-08-15T21:22:16.017057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.713081Z","title":null,"venue":null,"work_id":"bd33547a-0edb-4617-a54c-a8bb6f114588","year":2021},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.022030Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:f26430d5d1c869441aea71b79977b2f503d0d3f37501de9e003a76e53568910c","observation_id":"1e510c66-52ab-4ea7-8a57-8adc8a8fc99a","resolution":{"observed_at":"2026-08-15T21:22:16.717923Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.701159Z","title":null,"venue":null,"work_id":"ea2476aa-8b7d-448d-92e3-bf126d974524","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.026377Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:c0987d51d72f9a14df5721fb54f42ef6cba3d8d0b7297fbab809e62de535c9da","observation_id":"a1cabfba-522e-4906-805d-2c7b1659af10","resolution":{"observed_at":"2026-08-15T21:22:16.705099Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.688466Z","title":"H., and Bengio, Y","venue":null,"work_id":"3473b8dd-7d99-46b4-a008-4169e0d6da2b","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.030639Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:77ace76b2941170144b47ff45bbf11624f13ed1612f935fe352c8ed8e084f9a3","observation_id":"aa5e79ce-f043-4fe4-adbf-3c282e25f02b","resolution":{"observed_at":"2026-08-15T21:22:16.692421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.676813Z","title":null,"venue":null,"work_id":"64ae97ce-50ff-42df-95ca-ca222f05fbc5","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.034472Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:f6c4d37f55a6966cf28ed78af8e17e65bc0706e9feb254e156acbd59c036673b","observation_id":"532b3888-9ecb-4018-9e22-f74e731c49ef","resolution":{"observed_at":"2026-08-15T21:22:16.680689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-08-16T08:32:46.407746Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-15T21:22:16.039373Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.039373Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:ea41c4a0fd53aa0b98491674fe0369539a34d7278b0f5656718e58a6c42132ab","observation_id":"e7381cc0-f19a-4c8a-a4ee-5db9e3a7af84","resolution":{"observed_at":"2026-08-15T21:22:16.039373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.664567Z","title":"and Gu, S","venue":null,"work_id":"a2f5535e-644d-439f-a61a-b8054bde5142","year":2021},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.043862Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:d8f488023f3be1226f14273a3ed03cbb4a67f824fc76951ac080e202ca641cac","observation_id":"e60411c5-6134-4a86-ba86-7b8fb0c411eb","resolution":{"observed_at":"2026-08-15T21:22:16.668415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.652273Z","title":null,"venue":null,"work_id":"00a47aaf-5aaf-49f4-8882-f97abbd60b11","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.047375Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:8cbcefef9e153bec40b22e7dcf78dcffca58d567db3d7abc59f7fb4ca77795f1","observation_id":"258a95ab-f5a7-4d2c-8817-6b2de3421209","resolution":{"observed_at":"2026-08-15T21:22:16.656503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.640196Z","title":null,"venue":null,"work_id":"02365c70-9918-4269-a023-3afc6a41bae2","year":2018},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.051056Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:235aa30375182b3ded20af968625aa79e88ec85f3f236afe3a7c01497c60e058","observation_id":"e7eef8cc-ca56-43f0-a063-679dc4c2e17d","resolution":{"observed_at":"2026-08-15T21:22:16.644260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.627499Z","title":"S., Mankowitz, D","venue":null,"work_id":"42381424-d5cc-4cbc-a303-c6cf68c378b7","year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.054462Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:0202e66333cdbd32075e8d8280b04f9c87d834f1771a0050a6194731161afca6","observation_id":"0f5be4ff-caf9-4627-b612-eff700309295","resolution":{"observed_at":"2026-08-15T21:22:16.631545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-17T07:51:41.384508Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-15T21:22:16.058417Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.058417Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:3a88161ddd695f882ca7a3ac5af36554e0ccd47836781a95c9cbff6f37d6d6b8","observation_id":"3c98b5f2-3f95-4cac-a906-96933cc6fd8e","resolution":{"observed_at":"2026-08-15T21:22:16.058417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.614120Z","title":"Do as I can, not as I say: Grounding language in robotic affordances","venue":null,"work_id":"b2cc5317-83ca-41a7-b3c7-970aaa1bf1b8","year":2022},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.062228Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:50075f30ba972283f0079df1b16083f902ff02e52bb0f708bac9b92df1a25e28","observation_id":"2c049fdb-8567-439a-ac62-4b8f60ddc5cc","resolution":{"observed_at":"2026-08-15T21:22:16.619680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.600093Z","title":null,"venue":null,"work_id":"d13f8ea7-ced7-49d7-b7bc-617f0873fa92","year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.065876Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:b39c268fa2b18548e7d4be166e4d11bbbf6a3cb1e466666e95a4271b47a97da1","observation_id":"df1bc545-17f4-4604-a05d-2c3bd589c519","resolution":{"observed_at":"2026-08-15T21:22:16.604602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.587707Z","title":null,"venue":null,"work_id":"e5a3ab50-b62d-4f7b-a077-645d1b370194","year":2015},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.069944Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:76072b7cc160d2dc59559708c36919c029ea72961afa5f7decbc137987e827d2","observation_id":"36773faf-f240-4d40-8ce2-a02ccb905f38","resolution":{"observed_at":"2026-08-15T21:22:16.591566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.574401Z","title":null,"venue":null,"work_id":"28152d42-f86d-4bd5-8fd3-d82dd0280cba","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.073964Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:9236ede22713e6dabafd3be9ff16629cc6ab130f3c017191faa6e1d2dfd30994","observation_id":"be98b178-e7fa-4b55-871d-765f408d2c04","resolution":{"observed_at":"2026-08-15T21:22:16.578572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.561652Z","title":null,"venue":null,"work_id":"89c798bc-3b44-4b9a-a5ca-2efdf74f4ac1","year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.077673Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:e0cf13eaedcc09ff41eee1e9f1cb88cd1f8353e52cdbcc4ce0d9ac77707bbcd9","observation_id":"2fe4dfc9-2ca6-4618-920f-0b8387eb6d5a","resolution":{"observed_at":"2026-08-15T21:22:16.565726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-15T21:22:16.081307Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.081307Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:581de1a9dde3ac9568ebc7d0bfdb021c7ec9b567ab907e30116294950ae8df02","observation_id":"e7a38d0b-3e54-468e-a543-cdc554804492","resolution":{"observed_at":"2026-08-15T21:22:16.081307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.547957Z","title":null,"venue":null,"work_id":"cbe10735-c5fd-434e-8990-6733a15d9f4e","year":2023},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.085717Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:d580ea87e3491ca7d1c373b5b6aef5137849f88c5f9616894519bf2c30c7db57","observation_id":"be62e38e-be7e-40dc-aa0f-6ef066ea6b6a","resolution":{"observed_at":"2026-08-15T21:22:16.552946Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.533749Z","title":null,"venue":null,"work_id":"72682d42-22fa-4b6e-bcb6-de3777bee3c4","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.089878Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:acdd50a12031aae2bf0a6a778f02b58cfeb35ef97f79bd1fd13092759c55f9b0","observation_id":"6d754aa9-eb23-47f1-8f9d-bdfd64665d3f","resolution":{"observed_at":"2026-08-15T21:22:16.537809Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.519187Z","title":null,"venue":null,"work_id":"50a579f7-4e43-4b24-a1b2-72b41291356e","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.093700Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:9f3b717795a2789dee8bfe5975daf7015bbb3670f6d37bfaca62f90380562324","observation_id":"cf4be6e9-9218-4b69-b9db-669d9fc65961","resolution":{"observed_at":"2026-08-15T21:22:16.524667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.504782Z","title":null,"venue":null,"work_id":"fc186d04-c9f2-468a-b3b3-43e5988ba856","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.097483Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:c0b4e870cf8afd6eff95173c2d4dd4d6c3c097553184bd81f0344b0ef283284a","observation_id":"025ee99f-bf04-4c1a-8815-8403751cdee9","resolution":{"observed_at":"2026-08-15T21:22:16.509317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.490853Z","title":"A., Veness, J., Bellemare, M","venue":null,"work_id":"6d8a1a0b-a94d-467d-88e0-d96e3715a057","year":2015},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.101493Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:153fcaceddb763894fe49c08fa8a7fc6760d3a27856157927e1ffce995c64f92","observation_id":"ec5d5ed8-4726-4d1c-9841-38627c19163a","resolution":{"observed_at":"2026-08-15T21:22:16.495285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.479000Z","title":null,"venue":null,"work_id":"496a8d53-8997-4fc0-b5ca-f28d54b59388","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.105223Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:1abb3b73c29f6bb1dc62247b6ecb369e788b46a1ca056c0ba4c7618c014b6a87","observation_id":"64f485e8-b01e-4701-920a-784e9f60904f","resolution":{"observed_at":"2026-08-15T21:22:16.482776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.467732Z","title":null,"venue":null,"work_id":"c18066b3-e8ee-4f67-9809-19da150e553e","year":2023},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.108784Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:1b34ec7dde5d73a3ba02ed7f05894167d494754f4404b4cebda017a376ec491d","observation_id":"a70fdaaa-dbaa-4077-8426-192db4bd1d41","resolution":{"observed_at":"2026-08-15T21:22:16.471536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.456025Z","title":null,"venue":null,"work_id":"345d27de-b219-43d1-a26f-71b2b6ca538e","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.112415Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:91f152ceb4801cab82aa753f82b5cebd1bc1c861a87bd40986f19b437e9fc881","observation_id":"a7fcff16-5fc5-4c26-b633-f1415e2fb63c","resolution":{"observed_at":"2026-08-15T21:22:16.459767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.444780Z","title":null,"venue":null,"work_id":"9c357817-bfbe-4210-b70d-9f1e8be78c9f","year":2023},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.116289Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:99eb577732e8c6be76784a35da6063087c445ff4e3e44e3e885c6d1582e391ab","observation_id":"cb935178-fb0f-49c7-ba51-0d90fc1509b6","resolution":{"observed_at":"2026-08-15T21:22:16.448195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.431995Z","title":null,"venue":null,"work_id":"b6a81b5d-dbaf-4db4-8fb1-a3dca0d33cf0","year":2022},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.120356Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:a993c8a9ae14e718e1362d7d4b21e9cd6536644d8e683d206e9533db0a8463e1","observation_id":"b66207bb-fb2d-4838-8d5e-a1fd8d87745b","resolution":{"observed_at":"2026-08-15T21:22:16.435659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.419972Z","title":null,"venue":null,"work_id":"02c85ecf-fb3a-4b67-af64-b602d2c931fe","year":2023},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.124410Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:298854d0f686056451d2804d4c6a45a466c49915f2a8dd601b9fb2c4c2f3f379","observation_id":"4fa7d640-1e1e-4212-a640-568bcda5038b","resolution":{"observed_at":"2026-08-15T21:22:16.423658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.407512Z","title":null,"venue":null,"work_id":"86120e58-6956-4aa5-a40e-f96430e74acd","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.128254Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:217ebdce3a4f9028cf1817f7a4012ed0555d096ad62a8291907f31b854b2be72","observation_id":"382496c0-982f-41d6-89d9-1fea6ff90427","resolution":{"observed_at":"2026-08-15T21:22:16.412018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.396401Z","title":"and Imai, M","venue":null,"work_id":"f26be40e-ec59-4cda-b59b-41273f69b449","year":2022},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.131975Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:1271313a3da195b3e08f753d714b6396802956700c1388ec604aad04e0b90610","observation_id":"3d8398ea-a741-4f95-91b4-cf08a8b3e681","resolution":{"observed_at":"2026-08-15T21:22:16.400282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.384848Z","title":null,"venue":null,"work_id":"f54e54a7-5482-4267-9ec5-a76be641c0cf","year":2016},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.135578Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:d199f7ed24b51a5ed9d31dd2f061e401502f4997f657dafeac26150f3e349014","observation_id":"e87c4343-e529-4f5d-8a4c-3350f45b347c","resolution":{"observed_at":"2026-08-15T21:22:16.388736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.373211Z","title":null,"venue":null,"work_id":"5f84ab1d-2992-46ff-a9a6-50d38d5d6317","year":1998},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.139088Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:edd028843188c2676c5b3bcc153b13f0029580f8a2579614cfb171ec1d7c642f","observation_id":"17cb33e6-ab13-435d-9b11-20f67caed28f","resolution":{"observed_at":"2026-08-15T21:22:16.377232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-15T21:22:16.142589Z","title":"P., and Riedmiller, M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.142589Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:db5f7f76b18fdad1f22d7eff33239c0570e8f4724c4718557e95fab7f78d8918","observation_id":"90bb5f1d-81a0-4d9e-96e5-70bce867cb92","resolution":{"observed_at":"2026-08-15T21:22:16.142589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.362078Z","title":null,"venue":null,"work_id":"2fd7e46a-dacd-44bd-840a-55c761c4c946","year":2021},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.146475Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:5b32af798911e7217102106801522af386da3bd967d54260ac54f014a74e7b2e","observation_id":"1b8cb69c-cc35-4fb9-8883-49224d9074c9","resolution":{"observed_at":"2026-08-15T21:22:16.365666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.350861Z","title":null,"venue":null,"work_id":"ba8c2389-8ecb-4aa8-9c01-aaf9bec54dc4","year":2012},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.150059Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:5554e01285912b860b9161db4a30782cdc55f907ac7bd4e4f44bc5f018ef987f","observation_id":"86f042a2-61b4-46bc-b98f-60c9518aa83d","resolution":{"observed_at":"2026-08-15T21:22:16.354348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T21:22:16.153736Z","title":"LLaMA 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.153736Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:eda78408b775b7562dcda3f876348d67dfff12268c0daa58ad179f2f3fcc305c","observation_id":"b8782f6f-d863-4a1e-9c44-4a8f007b87cb","resolution":{"observed_at":"2026-08-15T21:22:16.153736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.336977Z","title":"u l c ehre, C ., Wang, Z., Pfaff, T., Wu, Y., Ring, R., Yogatama, D., W \\","venue":null,"work_id":"50b43e1f-7fa9-49b4-bb21-dc31beac6dd5","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.157590Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:4782d4dc10fcfa74048ea746a3b6387f05ecf05b0493c8d574f1f56ab01be45e","observation_id":"59e916c3-6eb9-4bb5-b523-1141e99c4ea8","resolution":{"observed_at":"2026-08-15T21:22:16.342220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.324412Z","title":null,"venue":null,"work_id":"3f9dc493-eb49-4bf0-9ea0-5d20c77155c9","year":2025},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.161170Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:9b2e672f86bb7dd20506f404c80c67b519363c99de3c9dadc0ff0cd113402a65","observation_id":"c505a9b7-d739-4e54-841f-f139b136a954","resolution":{"observed_at":"2026-08-15T21:22:16.328383Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.312008Z","title":null,"venue":null,"work_id":"9e59689c-bf87-498e-983e-f10fb04abc43","year":2025},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.164868Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:4cd60e97f93e150b1cdd475574b753feed8750c68adabd856d73a0afee99ac99","observation_id":"64a4fd18-9ab7-4fe3-ba58-00b244f03700","resolution":{"observed_at":"2026-08-15T21:22:16.316619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.300434Z","title":null,"venue":null,"work_id":"e923f5d9-c5f8-473b-bd89-6457f25e4329","year":2021},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.169209Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:a8c04599ba3675eb50b339fce9c95a8f7ec00f078d6fa430711e45d3948c0636","observation_id":"b6ddf42e-850a-4238-bdcb-9ea23f47d81f","resolution":{"observed_at":"2026-08-15T21:22:16.304331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.288338Z","title":null,"venue":null,"work_id":"9bf47853-c917-46cf-b177-ffc814a65f46","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.173285Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:819da13f869e8d5234823d74b1452fe089418ddcb1309764f59f0180a48d4909","observation_id":"102ddb5d-2b6a-4e60-9c83-7ce77da78c77","resolution":{"observed_at":"2026-08-15T21:22:16.292240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.274703Z","title":"Y., Levine, S., Finn, C., and Ma, T","venue":null,"work_id":"2bf9eec5-3245-4926-aa7b-9b6aeaeaa1f9","year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.177487Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:20c7048a5bcf755e04a60f8bdcdf9ab5cc32bb00bfb04db7f8ed9a565185106f","observation_id":"04a14512-33bb-4c32-82e7-0e19e3871de5","resolution":{"observed_at":"2026-08-15T21:22:16.279666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2505.10010."}