{"as_of":"2026-08-08T01:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a41fc0825bc0c198c63cc4e94e621ec5f06354516286010c143ac3c066947403","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:49:50.173686Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03571/citation-record","integrity":"/paper/2608.03571/integrity","json":"/paper/2608.03571/citation-record.json","paper":"/paper/2608.03571"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.143215Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.143215Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:f5cc64a69f2317e8c9b3ee5334f63aa082a4e3c05cd16cf3705e4dbd4a3d67c2","observation_id":"6011476f-fa79-4241-9f11-fe37a17017ac","resolution":{"observed_at":"2026-08-08T00:49:50.143215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.147095Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.147095Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:dfb2f891ee5efccf10ad9fd7b8846e1c72cc972baa9a468e1d8682e291a4cb05","observation_id":"5fc581b8-0c76-43b4-9a87-9a3596a4dc42","resolution":{"observed_at":"2026-08-08T00:49:50.147095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00347","last_updated":"2026-05-01T02:05:56Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T02:05:56Z","title":"Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.00347","snapshot_observed_at":"2026-08-08T00:49:50.099166Z","title":"Xiaoshuai Song, Haofei Chang, Guanting Dong, Yutao Zhu, Zhicheng Dou, and Ji-Rong Wen","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.099166Z"},"links":{"cited_paper":"/paper/2605.00347","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:16df450e99f2906dc66ce6d3864d460fcb965c77e108c19296e653997c86e992","observation_id":"72f2291e-4f9f-4c72-a4a4-f838637c2d23","resolution":{"observed_at":"2026-08-08T00:49:50.099166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05726","last_updated":"2025-02-08T23:59:41Z","snapshot_observed_at":"2026-08-06T12:37:05.892627Z","submitted_at":"2025-02-08T23:59:41Z","title":"Improving Environment Novelty Quantification for Effective Unsupervised Environment Design","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05726","snapshot_observed_at":"2026-08-08T00:49:50.102398Z","title":"Preprint, arXiv:2502.05726","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.102398Z"},"links":{"cited_paper":"/paper/2502.05726","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:67f71afd99b655010fb5659f669e20dd19a3b9b15fc3fa28df8427ba1ea77fea","observation_id":"76755303-a8f4-4c03-9562-bcd6fd5a439a","resolution":{"observed_at":"2026-08-08T00:49:50.102398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21798","last_updated":"2025-05-21T17:21:45Z","snapshot_observed_at":"2026-07-06T21:17:09.837496Z","submitted_at":"2025-04-30T16:56:06Z","title":"SWE-smith: Scaling Data for Software Engineering Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21798","snapshot_observed_at":"2026-08-08T00:49:50.106422Z","title":"John Yang, Akshara Prabhakar, Karthik Narasimhan, and Shunyu Yao","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.106422Z"},"links":{"cited_paper":"/paper/2504.21798","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:487c731d527ffb7d12594b0f5551dd77322197cd2db7ae540acf7035b7a4315d","observation_id":"3c503544-e35d-4636-bd2e-216cb4ee58c7","resolution":{"observed_at":"2026-08-08T00:49:50.106422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.173686Z","title":"Return exactly one valid JSON object only","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.173686Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:b0c1ba4522c9fc1354d2ee3de37edfb4fb48220e988f798e0ca6a2c1a42c0d6c","observation_id":"0eb1c13b-7dd3-43a9-bc72-3d9a2dc2245a","resolution":{"observed_at":"2026-08-08T00:49:50.173686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.07317","last_updated":"2026-06-06T19:45:56Z","snapshot_observed_at":"2026-08-03T23:08:02.092548Z","submitted_at":"2025-11-10T17:18:35Z","title":"RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive Verifiable Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.07317","snapshot_observed_at":"2026-08-08T00:49:50.113959Z","title":"Dazhi Zhan, Xin Liu, Wei Bai, Wei Li, Shize Guo, and Zhisong Pan","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.113959Z"},"links":{"cited_paper":"/paper/2511.07317","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:487f2509e77fa3f9004c5a3891f25684f793914441de550a5f88d2f6f55ec2b0","observation_id":"79dbd851-04f6-4497-971d-815a2b4a0b7b","resolution":{"observed_at":"2026-08-08T00:49:50.113959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.562877Z","title":"ADCL (Zhang et al., 2025a) periodically re-estimates sample difficulty to mitigate difficulty shift during training","venue":null,"work_id":"2a4e303f-3b42-485e-b545-657dadc7322f","year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.121134Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:68e5c1640a90888cbc91dd3d41e89b4c091cf0757f3071bdc417de57380fa298","observation_id":"7fc91c40-0a3f-47a0-8171-bbb119c4ff5f","resolution":{"observed_at":"2026-08-08T00:49:50.566686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.551085Z","title":"In the main experiments, we further include Qwen3-VL-8B- Instruct to evaluate whether our method remains effective with a larger model","venue":null,"work_id":"89c8813d-c993-4741-b2a5-ab00d7d1ca8c","year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.124677Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:adc1e1990f56136860be4cbf9be982bbf63378da972157e1293f917ac186cfba","observation_id":"cb74b442-407e-4415-8ca5-e9f055bf1e39","resolution":{"observed_at":"2026-08-08T00:49:50.555394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.539608Z","title":"Specifically, all runs use the same total number of training samples, which is set to 7,680 in our experiments","venue":null,"work_id":"3015445b-0b06-4ba6-a966-b7ab1e194e8a","year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.127773Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:f4d8d8f98e16ffa467e1fa2ed02002a777a642bafe092cdeae579c7aa34275af","observation_id":"af2d5206-b856-4c6d-bd09-e47fa04c906f","resolution":{"observed_at":"2026-08-08T00:49:50.543858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.526982Z","title":"impossible","venue":null,"work_id":"1e6a35ca-e220-4ac9-a03a-527528fc54a2","year":2024},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.131825Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:eea80a14f8e0582ebe2584be752f3098c3e0ddeb6e2816aa1a43496e686a50ad","observation_id":"87f04dbe-1e7a-47d0-8fd8-b96d3b24fefd","resolution":{"observed_at":"2026-08-08T00:49:50.531740Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.135414Z","title":"All methods use the same AES-selected environment subset and the same total training budget","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.135414Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:74dc9cac5d4f1c67544dd8a515f111a53c86f4255168c1fb9d533b2562857245","observation_id":"12cc483b-b170-433f-8d60-2eff8c6cca3f","resolution":{"observed_at":"2026-08-08T00:49:50.135414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.138802Z","title":"The curve shows an adaptive learning process","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.138802Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:66eca283cf500736d127a6bc93a805bed95a6aab6fc1451cac4c7eaea702374c","observation_id":"e926f70c-cfff-4914-b742-248d8a61766d","resolution":{"observed_at":"2026-08-08T00:49:50.138802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.149745Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.149745Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:b6b10f05dbd26ff7281cfc11bc808fdc5a2ded279ceff5d14fa0f270d2780cc5","observation_id":"261a7b67-5dcd-4b0a-9a05-69c310037036","resolution":{"observed_at":"2026-08-08T00:49:50.149745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.152733Z","title":"A rollout step is one interaction with the environment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.152733Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:a3104eb4af896a92c1fc23d3055b5c11c67d6d0726dd9db8b73896c2c5cd0356","observation_id":"eb1b9621-4807-4755-a2eb-6c9bce8823a2","resolution":{"observed_at":"2026-08-08T00:49:50.152733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.156496Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.156496Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:0e5d461d30706c6e44ccead959542e6cbba73da12c695d3a903cdc85ae0ecc78","observation_id":"fa31ced4-4384-4ba1-8cc2-1720feb8328d","resolution":{"observed_at":"2026-08-08T00:49:50.156496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.159705Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.159705Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:d5db90ceaf91471e313c7170571732380d95082e6d1a2aadc268e237992bdac3","observation_id":"f4442c71-0116-45a3-8493-c673e069f2e7","resolution":{"observed_at":"2026-08-08T00:49:50.159705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.163838Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.163838Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:35ade3bc5d7bcd7d7ff5333fa27b6d95f09639d7867c09c0e63922f8e2b4a2a2","observation_id":"ef1e454d-28b7-4b94-9f55-2b3846399696","resolution":{"observed_at":"2026-08-08T00:49:50.163838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.166610Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.166610Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:3222530f9f60446bc030e2fa3ea94d11e02bf6c8b80d8787924e12797ec2685a","observation_id":"5a55c1fe-2bfe-4ff2-863d-e869f93c0b91","resolution":{"observed_at":"2026-08-08T00:49:50.166610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.169734Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.169734Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:235fa9ef6ce5474876a9cfa5c7d9408a33d6eca0dc5ca3968f7d3abcc8d59f75","observation_id":"4e72fb79-a5f5-40dc-8690-7868f6d2dadb","resolution":{"observed_at":"2026-08-08T00:49:50.169734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04141","last_updated":"2026-07-20T11:08:55Z","snapshot_observed_at":"2026-08-08T00:41:56.834898Z","submitted_at":"2025-06-04T16:33:41Z","title":"MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04141","snapshot_observed_at":"2026-08-08T00:49:50.117587Z","title":"Kejian Zhu, Zhuoran Jin, Hongbang Yuan, Jiachun Li, Shangqing Tu, Pengfei Cao, Yubo Chen, Kang Liu, and Jun Zhao","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.117587Z"},"links":{"cited_paper":"/paper/2506.04141","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:f50d7801414c187e18361756688e891420756e0c368f600ae977310473833da4","observation_id":"fc22239d-0da1-49c1-b065-5cfddb0ec259","resolution":{"observed_at":"2026-08-08T00:49:50.117587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02722","last_updated":"2025-09-06T21:02:02Z","snapshot_observed_at":"2026-08-06T16:33:27.369886Z","submitted_at":"2025-09-02T18:18:57Z","title":"Planning with Reasoning using Vision Language World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02722","snapshot_observed_at":"2026-08-08T00:49:50.095503Z","title":"Jianlv Chen, Shitao Xiao, Peitian Zhang, Kun Luo, Defu Lian, and Zheng Liu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.095503Z"},"links":{"cited_paper":"/paper/2509.02722","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:7f7634de171d954981ae9b9fcc90187ade8e53e88b95cf3e4ef02b9422940824","observation_id":"33342f5c-3494-4700-9838-5c6adfbc55eb","resolution":{"observed_at":"2026-08-08T00:49:50.095503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06126","last_updated":"2026-04-07T17:38:15Z","snapshot_observed_at":"2026-07-06T22:54:40.349479Z","submitted_at":"2026-04-07T17:38:15Z","title":"Gym-Anything: Turn any Software into an Agent Environment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.06126","snapshot_observed_at":"2026-08-08T00:49:50.090990Z","title":"Muhammad Awais Ahmad, Tauqir Ahmed, Muhammad Aslam, Amjad Rehman, Faten S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.090990Z"},"links":{"cited_paper":"/paper/2604.06126","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:1db434f44773cbe6bbd93f0dffb03a0b1c8f35a77979f132ace47946da190410","observation_id":"08ce8ef8-88e9-4b14-9f77-3c8baaaea9ec","resolution":{"observed_at":"2026-08-08T00:49:50.090990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.110243Z","title":"Yucheng Zeng, Weipeng Lu, Linyun Liu, Shupeng Li, Zitian Qu, Chenghao Zhu, Shaofei Li, Zhengdong Tan, Mengyue Liu, Haotian Zhao, and 1 others","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":9567,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.110243Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:d1c91967464ea64a7635f8a26ff0407f2999fbd81c69fd78a710ca19e0d9505c","observation_id":"1f66e7cd-d38a-48ef-bce0-b04a33f2237c","resolution":{"observed_at":"2026-08-08T00:49:50.110243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:42:56.882750Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2608.03571."}