{"as_of":"2026-08-18T02:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1c7d710dadc471f25ac9ce22c953a88faf19a12bdf811d43ac0cb18a50cd0dbc","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:24:26.960195Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.14162/citation-record","integrity":"/paper/2506.14162/integrity","json":"/paper/2506.14162/citation-record.json","paper":"/paper/2506.14162"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:24.188306Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.188306Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:8b5f8c679d70fc04faa8d8c450ce3430348a6a9723158325a453798fa1c60aa2","observation_id":"b2e05dca-4bb0-494a-88b4-74b3c57f7952","resolution":{"observed_at":"2026-08-07T00:24:24.188306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:32.149286Z","title":"Recursive program synthesis","venue":null,"work_id":"b4b90220-671e-4a3a-9970-03aa94ba5373","year":2013},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.254476Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:da6fcab0f3a4ca9a7964faddce3ab32371bee70de8179a5ab36f18ef73c02d0c","observation_id":"fdafc41b-37d2-495b-8aa3-428532357391","resolution":{"observed_at":"2026-08-07T00:24:32.350067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:31.959253Z","title":"Unveiling options with neural network decomposition","venue":null,"work_id":"b2d36834-9973-469a-8cdf-daaf43818dfe","year":2024},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.333427Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:f847e37a617666b547ada6d05991f10ecce8cf90ca28cbb8763b578de000e247","observation_id":"0b763c18-8921-4c08-ad4b-66a29ad62d6b","resolution":{"observed_at":"2026-08-07T00:24:32.037426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:31.760304Z","title":"Qwen technical report, 2023","venue":null,"work_id":"cbc2a0ca-5607-4200-ba0c-65712382f762","year":2023},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.397393Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:e0786dfcd30d643754201ae20dd24468147637cd5c229616d4338b3b0df7acb0","observation_id":"14fe9c8b-824a-4237-92e7-99dd372cf9ec","resolution":{"observed_at":"2026-08-07T00:24:31.898822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:31.607382Z","title":"Verifiable reinforcement learning via policy extraction","venue":null,"work_id":"85b43546-d9e7-4d19-9330-f53cd7475859","year":2018},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.455899Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:88de54c5a1421b37e1541a401029c837a1f09c118ae4d7d1b4d777f527d99382","observation_id":"c891efc3-6e21-4b61-bd9e-09d5cb8e8b9c","resolution":{"observed_at":"2026-08-07T00:24:31.670160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:31.449928Z","title":"Look where you look! saliency-guided q-networks for generalization in visual reinforcement learning","venue":null,"work_id":"56eb96da-343b-4606-902a-457068e498c7","year":2022},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.511312Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:ee9b23eb7aefce376e8994ca18af85e38f60e43caddadd5edb85b6176eed36f2","observation_id":"6f7e1649-ef5e-4dcf-a19a-dd4c94e9b9ef","resolution":{"observed_at":"2026-08-07T00:24:31.518960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:31.296043Z","title":"Olausson, Lionel Wong, Gabriel Grand, Joshua B","venue":null,"work_id":"6d62d102-8112-462d-ad1b-1ddb2a593b0b","year":2023},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.568290Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:c9f7df10beaeb2c781d17eca6d2e380f8e9d2b672721dd9e1c2b2a970169cd83","observation_id":"c0928049-af5e-4fa8-a75c-86986db7d231","resolution":{"observed_at":"2026-08-07T00:24:31.369063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:31.088342Z","title":"Babble: Learning better abstractions with e-graphs and anti-unification","venue":null,"work_id":"9993b91b-635f-468f-9b07-f33d380f81e8","year":2023},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.623900Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:483ea45ea6ac788abc6edf60529615a04d731b7daaa872309da49b64ff61b645","observation_id":"3d2f82a4-d236-4da1-a742-c013e89aba84","resolution":{"observed_at":"2026-08-07T00:24:31.173696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:24.682449Z","title":"Empirical evaluation of gated recurrent neural networks on sequence modeling, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.682449Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:d9fc729a4a8b21ddbb99ed3a701e38e2490a6aeca76765dec80e5e346194bf65","observation_id":"f3e66895-f08b-47e6-88da-df02c52173dc","resolution":{"observed_at":"2026-08-07T00:24:24.682449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:24.783231Z","title":"Dijkstra","venue":null,"work_id":null,"year":1959},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.783231Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:12c6755b940a3effe64374248b642b476d40635f7a238b094808c098050f96f3","observation_id":"ab7354ee-ee7f-491c-a0bc-a74a46a0dda8","resolution":{"observed_at":"2026-08-07T00:24:24.783231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:30.925065Z","title":"Dreamcoder: growing generalizable, interpretable knowledge with wake?sleep bayesian program learning","venue":null,"work_id":"6f8741e6-4973-4504-9a7e-ff802b8ddc17","year":2023},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.831681Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:2a4f2f33e043139e5fc458f236e23c9d3b523730343e959e867c7ddeaed09f4b","observation_id":"d48d8739-afd1-41ed-b373-15dcd0bdbc56","resolution":{"observed_at":"2026-08-07T00:24:30.986298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:30.754658Z","title":"Taylor, A","venue":null,"work_id":"a6e7a3b6-8686-4167-bdfd-71acc6a9d38a","year":2024},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:24.881831Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:c992eac810bcaf11d543d260d0ff9e960d62d071dca8b08c1b231c14a6d1f23f","observation_id":"12478ca4-927b-41c2-88df-905531747906","resolution":{"observed_at":"2026-08-07T00:24:30.828607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:30.597638Z","title":"Long short-term memory","venue":null,"work_id":"c67d31a8-25c3-4b51-a7e0-b4fea927d05c","year":1997},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.014625Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:6b7fd8e5e8eeacbbe09c10baf7ea838944d85c8565110f29a2ca7f8569c5a11f","observation_id":"1bf2dd75-2e31-412e-925e-f24bdada3e56","resolution":{"observed_at":"2026-08-07T00:24:30.673485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:30.456592Z","title":"Synthesizing programmatic policies that inductively generalize","venue":null,"work_id":"5615cba1-6a5d-44ff-8315-4e04afd67237","year":2020},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.090304Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:06d98ec73535bcd8659fa4594e2e1d973930d497c0fa6a40f75027699f7fd0a3","observation_id":"536ec4aa-9c9a-4c30-91cf-0bdcf6b9f3b1","resolution":{"observed_at":"2026-08-07T00:24:30.524241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:30.253639Z","title":"Inferring algorithmic patterns with stack-augmented recurrent nets","venue":null,"work_id":"da1d11d7-dacb-4dcf-b4e5-07b5b1069d14","year":2015},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.170492Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:d8a49e9e408c65fcfbe0466f553ab54d9ae5bb4e42d6ba13b6f9aa482c537864","observation_id":"c070fefd-9fd5-4432-801c-e969b4043981","resolution":{"observed_at":"2026-08-07T00:24:30.336928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:30.104884Z","title":"Kingma and Max Welling","venue":null,"work_id":"95372f60-3d7e-409d-91de-1344ccd5097e","year":2014},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.257096Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:89a8c4359d472543d04cfa21faed55a86601b804f816596761521892097af5a3","observation_id":"7a56048a-8b13-4405-83a1-b4a242eb4120","resolution":{"observed_at":"2026-08-07T00:24:30.154175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:25.350457Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.350457Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:d469ed6436237fd057527a340360f46087cb0ea4d0c649866ff723999d779a8a","observation_id":"15a664e3-51d0-4399-a195-3acb48f4dc9c","resolution":{"observed_at":"2026-08-07T00:24:25.350457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:29.950337Z","title":"Rubinstein, and Yohai Gat","venue":null,"work_id":"903a8439-a3f3-424e-918f-47a051cc6125","year":2003},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.479684Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:7cc781282c2ee8514a688bd20c4cd487ad02dd539fe5ab02c6414f31408409bd","observation_id":"c016d48f-9aa2-48a3-acd7-6628d1deeb7a","resolution":{"observed_at":"2026-08-07T00:24:30.005284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:29.803857Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":"b323a273-f352-49aa-9e88-a00e339053ff","year":2015},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.552952Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:061b60a3b135ef636b079377b8cbb16d0ec25c8afe56340bdf4cae1c9e633dde","observation_id":"224e344c-4365-4974-9340-c7f56ba7493a","resolution":{"observed_at":"2026-08-07T00:24:29.877806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:29.653718Z","title":"Palmarini, Christopher G","venue":null,"work_id":"aa91e92d-6006-4020-b25b-6cca4f88cd0f","year":2024},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.657125Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:c34aae320418826f99171eaaad2c986c4b2de909853a35c007cbaacf86f984eb","observation_id":"d7db9feb-16fc-4d64-a77a-c4b21e20c2aa","resolution":{"observed_at":"2026-08-07T00:24:29.723542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:29.445597Z","title":"Programmatic reinforcement learning without oracles","venue":null,"work_id":"b2f2376c-cc3e-4169-bc42-6814329a5a0a","year":2021},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.735850Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:d17191c6d3e09c89c0a6072998f017311fa63d35aa46703b8055951352570906","observation_id":"50144bc9-2ff7-426b-954d-0e69c816b9e5","resolution":{"observed_at":"2026-08-07T00:24:29.538860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:29.251745Z","title":"Synthesizing libraries of programs with auxiliary functions","venue":null,"work_id":"b06df6f3-1a8e-4b7c-a128-09c5d5e33e58","year":2024},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.851549Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:8653485f4419dcdb2e7751f5762ae5a5bd4c3d72d80cd60afab6cc60d0ed91a6","observation_id":"b6bc77e5-f0b0-419d-9d5b-40b1314792a8","resolution":{"observed_at":"2026-08-07T00:24:29.358860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:29.048525Z","title":"Pawan Kumar, Emilien Dupont, Francisco J","venue":null,"work_id":"8ee47b43-3661-42af-b2db-4ad16c4dc231","year":2023},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:25.953863Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:df573cf66a3605688da06a3248dcdc0a6a45a9001c547af3693133ff16cdc8af","observation_id":"6504eb1e-9e05-4fdb-bc7e-1155b9add056","resolution":{"observed_at":"2026-08-07T00:24:29.146352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:28.877611Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":"5a7d7f3e-2989-4bba-a033-e0368825c51c","year":2011},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.043133Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:5e30243cf7dde77e8e1b406b5e0c7529ca6737b41de9a0a85b68a02ed314f483","observation_id":"8e812504-1a83-45d2-a8a1-b5a80a9609b1","resolution":{"observed_at":"2026-08-07T00:24:28.960074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T00:24:26.131603Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.131603Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:4979a505041b9664b9e53da6c5c423921bb2d60764ba5d62eaa9680cad81fd79","observation_id":"e8f8a462-93c9-4c27-86f2-13c01bceaf97","resolution":{"observed_at":"2026-08-07T00:24:26.131603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:28.607820Z","title":"Siegelmann and Eduardo D","venue":null,"work_id":"5727f2cf-81f0-44f8-8f78-22e7df443cf9","year":1994},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.236979Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:d86941043b75bd4786ec2d567a9a0ef97927c030ebdc0d5ec8f03814cb9eb553","observation_id":"bc4f9ab6-fcc9-4521-8974-70fab293be19","resolution":{"observed_at":"2026-08-07T00:24:28.760277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:28.404047Z","title":"Siegelmann and Eduardo D","venue":null,"work_id":"3900199b-ec36-4952-96ce-d6f5ddea46f3","year":1995},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.328571Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:bbffcaa04bc1c5d4cda64e7f8b1eda47c6ceb93c0b0ba3a441b6d9c94b7c72b1","observation_id":"7575e484-c8f9-45cb-aaab-b2921e57e7ff","resolution":{"observed_at":"2026-08-07T00:24:28.498717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:28.146043Z","title":null,"venue":null,"work_id":"6c7030ae-1ecb-4f77-8dfd-034531979ac7","year":2012},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.426924Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:2b490e6526fe57ac799c2778de62aa0efb59acc1e805cbeb6ac960cc4e954c99","observation_id":"33596d3e-63e0-42e6-b948-62df59513989","resolution":{"observed_at":"2026-08-07T00:24:28.249927Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:27.973017Z","title":null,"venue":null,"work_id":"96eb8a25-7375-4f67-b180-b5b5ac20b0eb","year":2021},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.491726Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:8aaaca4e2e5a8f5339ef1b6f2f562974cd74e05a77600b19204fbd02be56e95d","observation_id":"66fe22cf-15ff-43bd-831d-d795793f9263","resolution":{"observed_at":"2026-08-07T00:24:28.070023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:27.843068Z","title":"Deshmukh, Sela Mador-Haim, Milo M.K","venue":null,"work_id":"e4efd8e7-ad09-4555-8dd2-895f52654a40","year":2013},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.554607Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:827b552e91d96c2ab5a4bceae5483ac89e1fa35090f9d5612cf09feb187a5004","observation_id":"f6f8d18d-6dfb-45d4-a4ea-df2db9e87bd9","resolution":{"observed_at":"2026-08-07T00:24:27.925595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:27.666448Z","title":"Programmatically interpretable reinforcement learning","venue":null,"work_id":"a0ebae85-55ef-44b7-b8f2-c60b28901a87","year":2018},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.690608Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:8ad7ba77de2665af56fff4e229524aa624a75d73ecb5f3ce61f788d0f2893d87","observation_id":"a5115db3-76ad-43eb-b8eb-e2e00e3d9a77","resolution":{"observed_at":"2026-08-07T00:24:27.763126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:27.482096Z","title":"Imitation-projected programmatic reinforcement learning","venue":null,"work_id":"7051f728-02c9-4f88-87e7-51c97654bf76","year":2019},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.798040Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:ae2c3cae969d973811767a6a74a67916d4c90c0855d4f1b16712593e0a480751","observation_id":"8f06d682-8153-4594-9e0a-43bdd1ede863","resolution":{"observed_at":"2026-08-07T00:24:27.572256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:27.323267Z","title":"On the practical computational power of finite precision rnns for language recognition","venue":null,"work_id":"7c3e1544-9369-46ea-850e-dddadd4d1ccf","year":2018},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.878300Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:ae32b78a24fdb051ec7cfd3a42b7a7d901c34a9f07d333a49d85052ea5e266a0","observation_id":"5b048b05-b984-441c-93c2-9940990be8e4","resolution":{"observed_at":"2026-08-07T00:24:27.392607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:24:27.117595Z","title":"Torcs, the open racing car simulator","venue":null,"work_id":"517adff0-7b1b-47bf-b71f-ce2f7d45d4b7","year":2000},"citing_paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:26.960195Z"},"links":{"citing_paper":"/paper/2506.14162"},"observation_digest":"sha256:8acaad1aa88e73d32489596d908b1bc3ac0b4f7ffd8ea7501cba6b1f34993e98","observation_id":"314ae24f-e9ba-43b2-9239-45322674bac9","resolution":{"observed_at":"2026-08-07T00:24:27.227135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.14162","last_updated":"2025-06-17T03:53:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T00:15:45.635217Z","submitted_at":"2025-06-17T03:53:18Z","title":"Common Benchmarks Undervalue the Generalization Power of Programmatic Policies"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2506.14162."}