{"as_of":"2026-08-17T14:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:220361ed7c93a761109a471060dd7538c289f3d996616dd86958cdc0834b1ab2","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:12:58.275096Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:41:40.567807Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T17:42:25.757588Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"cited_work":{"arxiv_id":"2505.02010","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02010","snapshot_observed_at":"2026-06-28T17:42:25.757588Z","title":"Meta-black-box-optimization through offline q-function learning","venue":null,"work_id":"b575a039-8995-4d20-9b48-ed4aa63a166f","year":2025},"citing_paper":{"arxiv_id":"2606.00862","last_updated":"2026-05-30T19:26:32Z","snapshot_observed_at":"2026-08-08T15:58:34.048053Z","submitted_at":"2026-05-30T19:26:32Z","title":"Meta-Black-Box Optimization with Ensemble Surrogate Modeling for Robustness-Accuracy Trade-off within SAEA","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T17:41:40.567807Z"},"links":{"cited_paper":"/paper/2505.02010","citing_paper":"/paper/2606.00862"},"observation_digest":"sha256:e4cc0ac7fbd4dd2785ac1972b9f148f3aff5c81eed706e1206a3d2a43e45bd5a","observation_id":"d7bab352-3317-48ac-93bc-f6e1e4870e71","resolution":{"observed_at":"2026-06-28T17:42:25.759635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.02010/citation-record","integrity":"/paper/2505.02010/integrity","json":"/paper/2505.02010/citation-record.json","paper":"/paper/2505.02010"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.656381Z","title":null,"venue":null,"work_id":"7fa38b9f-ae2f-4260-b57a-55f19dc77f1b","year":2000},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.275096Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:7b7ea18fbec841e80b5304eeebcd102b00f2ce5ea060df342377bccb5a737b46","observation_id":"b1a690d7-55b8-4e6c-8b77-f072143e1217","resolution":{"observed_at":"2026-08-16T04:12:58.774796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.922854Z","title":"States Notes Problem Property st 1 mean xi,xj∈Xt ||xi−xj||2 Average distance between any pair of individuals in current population","venue":null,"work_id":"69c16109-5971-41ff-9e51-1df2a6f5a94b","year":1997},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.239030Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:8458055bcaf98627ee34f6dc9e80b4317cd53facc02ced4acb7713d4f4c726d0","observation_id":"acd76e7e-a27c-4893-be14-38ac41b1dc15","resolution":{"observed_at":"2026-08-16T04:12:58.928393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.825209Z","title":null,"venue":null,"work_id":"17e9b994-0a6a-428f-9009-8884d9a83e07","year":2000},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.270940Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:809b0b9a455863352f610821b584b897031c46bd7bb91a2213c9bacf69563718","observation_id":"4e3082a2-2c34-4876-8c17-9dbf601d6a98","resolution":{"observed_at":"2026-08-16T04:12:58.830109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01881","last_updated":"2025-02-26T13:57:13Z","snapshot_observed_at":"2026-08-16T14:22:00.658392Z","submitted_at":"2024-02-02T20:12:05Z","title":"Large Language Model Agent for Hyper-Parameter Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01881","snapshot_observed_at":"2026-08-16T04:12:58.175734Z","title":"Large language model agent for hyper-parameter optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.175734Z"},"links":{"cited_paper":"/paper/2402.01881","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:fb191c916f8ec9e6e7fdc59324e8d0f8894e23fe94bc752b39a950dbfb8d3a2f","observation_id":"f2a0fba5-afd2-4e28-9a50-820283c05fad","resolution":{"observed_at":"2026-08-16T04:12:58.175734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-16T04:12:58.187135Z","title":"Playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.187135Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:b27dd34af4375c80be6f658377e4c2650453d0e033545a5a30bd46a28dee3b2c","observation_id":"684515a3-6bc9-4f1a-9c71-a9645e385074","resolution":{"observed_at":"2026-08-16T04:12:58.187135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T04:12:58.203848Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.203848Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:ed3a0a11147f2b62fb5a3dfbe56892c5bbb9687dc1ef2a1695d56abbe397737a","observation_id":"d38b18a9-f383-4927-ad27-187b67f35f00","resolution":{"observed_at":"2026-08-16T04:12:58.203848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17423","last_updated":"2024-11-01T14:32:12Z","snapshot_observed_at":"2026-08-16T14:14:56.590065Z","submitted_at":"2024-02-27T11:32:14Z","title":"Reinforced In-Context Black-Box Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17423","snapshot_observed_at":"2026-08-16T04:12:58.208783Z","title":"Reinforced in-context black-box opti- mization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.208783Z"},"links":{"cited_paper":"/paper/2402.17423","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:c3fb01f472202061a7d6687aa3acb2be77172fef570280557a8b58ac93d30564","observation_id":"8a1896db-6b57-488b-b58d-41c688bf5472","resolution":{"observed_at":"2026-08-16T04:12:58.208783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.954516Z","title":"and Fukunaga, A","venue":null,"work_id":"f5cf1cb6-649b-47a1-983a-ceaaf4495d89","year":2014},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.218416Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:54200f4ce01bf51b6120fb4f7d7320d10e5f796bdd16c29ce190ff90cda8a42c","observation_id":"117e3293-922e-4606-a655-7c9e56584705","resolution":{"observed_at":"2026-08-16T04:12:58.959246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09599","last_updated":"2024-12-23T09:33:13Z","snapshot_observed_at":"2026-08-16T15:39:18.308617Z","submitted_at":"2023-04-19T12:14:01Z","title":"DECN: Evolution Inspired Deep Convolution Network for Black-box Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09599","snapshot_observed_at":"2026-08-16T04:12:58.228648Z","title":"Decn: Evolution inspired deep convolution network for black-box optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.228648Z"},"links":{"cited_paper":"/paper/2304.09599","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:fc626931cc1f4d59fa878d894d69b7a2d75a92e078a154caec1826afd4c95338","observation_id":"fcd67b36-51a1-4e69-bf10-52a33672e243","resolution":{"observed_at":"2026-08-16T04:12:58.228648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03419","last_updated":"2024-05-06T12:36:17Z","snapshot_observed_at":"2026-08-17T13:26:45.820506Z","submitted_at":"2024-05-06T12:36:17Z","title":"Automated Metaheuristic Algorithm Design with Autoregressive Learning","version":1},"cited_work":{"arxiv_id":"2405.03419","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.03419","snapshot_observed_at":"2026-08-16T04:12:58.327020Z","title":"Automated Metaheuristic Algorithm Design with Autoregressive Learning","venue":"cs.NE","work_id":"25e8736d-151d-4943-93e4-9c6e2e4d0575","year":2024},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.234060Z"},"links":{"cited_paper":"/paper/2405.03419","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:62add73620e199aa3c689239d24eb18d4c1482c665c71a77ba48f5512b5abb8f","observation_id":"221773b3-ba32-451f-88a3-aff77b2bb079","resolution":{"observed_at":"2026-08-16T04:12:58.447854Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.907684Z","title":null,"venue":null,"work_id":"1fc86ee8-d45b-4949-b642-5aeba0fc71b4","year":2014},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.246095Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:80edfff26a706efc5dc4214550b590cde6d5b4abf87f2b01b3a7db76744acb65","observation_id":"8aca96fd-f132-4d35-b04f-4b73a7024385","resolution":{"observed_at":"2026-08-16T04:12:58.912438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.858844Z","title":"(17) whereηc∈{ 1, 2, 3} is controllable parameter andu∈ [0, 1] is random number","venue":null,"work_id":"e83051e0-47c5-4a98-801b-bd5df8bc1e40","year":1991},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.261132Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:12645248fc1a70627bc6a6770ed316248c2fb8810cf787b3e145402d58a618b2","observation_id":"cf501bc2-6850-4c4e-9542-233a99a19ebb","resolution":{"observed_at":"2026-08-16T04:12:58.864485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.841438Z","title":"The Exponential crossover formulated as Eq","venue":null,"work_id":"2e8d3f84-2d9b-48ef-87ca-9b1c9f7d48db","year":1997},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.265849Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:1b5b8710d6be12caf415a3c45c401e7b0a362b6077aaa0de27c41d9000394705","observation_id":"b3439b35-3e34-43a9-af4a-961af34c8b87","resolution":{"observed_at":"2026-08-16T04:12:58.847260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-16T04:12:58.154768Z","title":"and Dao, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.154768Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:8d0792cb11348ef93f0abf79979f1d2a9bed99bba08a702a42e871baa7222fa4","observation_id":"3fbdb806-c8c2-42b7-bb1b-17834affdd7d","resolution":{"observed_at":"2026-08-16T04:12:58.154768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.892358Z","title":"clip”, “rand","venue":null,"work_id":"959efaf8-a2f8-4cce-a173-d67a02f0449f","year":1992},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":1992,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.250847Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:62fb93de74fd71ed5ed5b316a5a8a83267ccdb5dc9b88c6656c0dd6dfc2a9e54","observation_id":"4660b9ef-482d-4e78-a079-63283b950fd6","resolution":{"observed_at":"2026-08-16T04:12:58.897117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.984446Z","title":"C., Pearson, D","venue":null,"work_id":"074db8d2-4cd7-4527-b85e-4a68106056b9","year":1999},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":1995,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.150426Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:e494c6f72f1691d08ed20119adc875579c1aa185ef7ce3428b0909c946a4b626","observation_id":"bd249aec-9649-46f7-9340-95515454d86c","resolution":{"observed_at":"2026-08-16T04:12:58.989060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.06567","last_updated":"2018-04-20T18:38:34Z","snapshot_observed_at":"2026-08-14T20:02:29.132687Z","submitted_at":"2017-12-18T18:22:05Z","title":"Deep Neuroevolution: Genetic Algorithms Are a Competitive Alternative for Training Deep Neural Networks for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.06567","snapshot_observed_at":"2026-08-16T04:12:58.213620Z","title":"P., Madhavan, V ., Conti, E., Lehman, J., Stanley, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.213620Z"},"links":{"cited_paper":"/paper/1712.06567","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:84676bb209ff30c8fe5d25c90580af4e74b12ba618dedd58a70cb3c48bfb482f","observation_id":"0c3855ec-5c74-4dc8-92a9-e2a47c905382","resolution":{"observed_at":"2026-08-16T04:12:58.213620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.875247Z","title":"The Polynomial mutation is as follow: x′′ i = ( x′ i + ((2u) 1 1+ηm− 1)(x′ i−lb), ifu≤ 0.5; x′ i + (1− (2− 2u) 1 1+ηm )(ub−x′ i), ifu> 0.5","venue":null,"work_id":"bdf5ee4d-aa19-4f93-88be-796bc6c736e5","year":1992},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.255932Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:7e091351655a05cee4664f38fe545f062f3b87c1f54d1501edf9f12ff2563fa6","observation_id":"a1f5ef90-a9b9-4150-b4a9-0ba5382610a6","resolution":{"observed_at":"2026-08-16T04:12:58.881066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.969678Z","title":"W., Hadi, A","venue":null,"work_id":"bc5f4611-7fca-4cba-aab4-cf9c03b73a7e","year":2021},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.192562Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:acf1f56b362f45347f1a6d357b936329cf405c04caa1c53373d3da621cf32f29","observation_id":"bed09463-35f8-4fcd-8647-5f564af4c412","resolution":{"observed_at":"2026-08-16T04:12:58.974349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.938585Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":"3a733a6e-2344-49d0-ab2b-e8333f8533fc","year":2012},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.223188Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:9e28989a885a2f4de8dece262fbfaf4553ddc03b8fdf81a94317c0dedcd06feb","observation_id":"38307373-0d0f-437f-b1d3-b5d394fd10d7","resolution":{"observed_at":"2026-08-16T04:12:58.944007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12094","last_updated":"2024-10-27T04:46:58Z","snapshot_observed_at":"2026-08-16T13:51:17.328153Z","submitted_at":"2024-05-20T15:05:47Z","title":"Is Mamba Compatible with Trajectory Optimization in Offline Reinforcement Learning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12094","snapshot_observed_at":"2026-08-16T04:12:58.144502Z","title":"Is mamba compatible with trajectory optimization in offline reinforcement learning? arXiv preprint arXiv:2405.12094, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.144502Z"},"links":{"cited_paper":"/paper/2405.12094","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:595b63890f0c1d516685909179c2f28af6a1793b3d8b0507c970290a5b777cc0","observation_id":"353b6159-e330-47b4-9ca8-7ba8c2d2a0e6","resolution":{"observed_at":"2026-08-16T04:12:58.144502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-16T04:12:58.170426Z","title":"Discovering attention-based genetic algorithms via meta-black-box optimization","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.170426Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:17e3c79efef2174ebeb2a1564ab54adbe3165107ff36d01b581671bde1ab59b4","observation_id":"7bbf7f18-751a-4a8f-abab-1060df898b1d","resolution":{"observed_at":"2026-08-16T04:12:58.170426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19925","last_updated":"2024-03-29T02:25:55Z","snapshot_observed_at":"2026-08-16T14:05:18.974051Z","submitted_at":"2024-03-29T02:25:55Z","title":"Decision Mamba: Reinforcement Learning via Sequence Modeling with Selective State Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19925","snapshot_observed_at":"2026-08-16T04:12:58.198043Z","title":"Decision mamba: Reinforcement learning via sequence modeling with selective state spaces","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.198043Z"},"links":{"cited_paper":"/paper/2403.19925","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:4b261d14a81394c02530af09ef8608246bd0e219eb9f48c06f296ca84804dd2e","observation_id":"33689923-964c-41b3-8bdc-ef707cde410f","resolution":{"observed_at":"2026-08-16T04:12:58.198043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07507","last_updated":"2024-12-15T15:09:38Z","snapshot_observed_at":"2026-08-17T09:49:11.768791Z","submitted_at":"2024-12-10T13:43:51Z","title":"ConfigX: Modular Configuration for Evolutionary Algorithms via Multitask Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07507","snapshot_observed_at":"2026-08-16T04:12:58.159226Z","title":"Deep reinforcement learning for dynamic algorithm selection: A proof-of-principle study on differential evolution","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.159226Z"},"links":{"cited_paper":"/paper/2412.07507","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:7c899f5b9bba3f5a9872e824d2057740d90a8c1e9d5250f44c1b620fdd2f960e","observation_id":"6b2ee1c3-3670-40a7-bbf0-a6d419bbf6a1","resolution":{"observed_at":"2026-08-16T04:12:58.159226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10672","last_updated":"2025-03-27T01:42:03Z","snapshot_observed_at":"2026-08-16T13:25:17.164750Z","submitted_at":"2024-08-20T09:17:11Z","title":"Neural Exploratory Landscape Analysis for Meta-Black-Box-Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10672","snapshot_observed_at":"2026-08-16T04:12:58.180780Z","title":"Neu- ral exploratory landscape analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.180780Z"},"links":{"cited_paper":"/paper/2408.10672","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:28f50395d7232eeaa2e7cc4ca7fdd30a31923dae6aebe0a03cf862be7f21bbfb","observation_id":"1b224c58-9e7f-4f1a-87db-2306e2a425e2","resolution":{"observed_at":"2026-08-16T04:12:58.180780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17098","last_updated":"2024-05-27T12:12:39Z","snapshot_observed_at":"2026-08-16T13:49:04.706761Z","submitted_at":"2024-05-27T12:12:39Z","title":"Q-value Regularized Transformer for Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17098","snapshot_observed_at":"2026-08-16T04:12:58.164914Z","title":"Q-value regularized transformer for offline reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.164914Z"},"links":{"cited_paper":"/paper/2405.17098","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:01faa3daea84148aca5b299794ebdf470bf6652093b79bb07e6813f008414bf4","observation_id":"53ed532d-424c-4a5f-892b-86071331d325","resolution":{"observed_at":"2026-08-16T04:12:58.164914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","latest_version":1,"primary_category":"cs.NE","snapshot_observed_at":"2026-08-16T04:01:41.501689Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":9},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2505.02010."}