{"as_of":"2026-08-15T07:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:052eb81c5188ca556c9b3dd0e020e359ce0db2725b5b7791c94e0d92141b2de7","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:32:45.303935Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.13053/citation-record","integrity":"/paper/2412.13053/integrity","json":"/paper/2412.13053/citation-record.json","paper":"/paper/2412.13053"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.008801Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.008801Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:3e0ecae72a3254e06c77d35b3fcd9b27ccc403546274e057f960365cd5077b48","observation_id":"56018101-3918-40d4-97f8-7da795576cfe","resolution":{"observed_at":"2026-08-11T13:32:45.008801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.015499Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.015499Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:d50659aadcdba5dba3885d8bba871305fae43947755d7b5edd62f9e4d86316c3","observation_id":"3091961d-5de7-40b2-a0da-91bf3da2372c","resolution":{"observed_at":"2026-08-11T13:32:45.015499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.284473Z","title":null,"venue":null,"work_id":"bbf1e67c-8e9b-48bd-ad47-d8fc6eef31e7","year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.022012Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:d0ace7ab9ed6a5c22fe910af00aa12c246a571fc05200189ad94df6ed3fe3135","observation_id":"5c1393fb-b153-44df-a984-9f53c62174cb","resolution":{"observed_at":"2026-08-11T13:32:46.292483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.028624Z","title":"B.; D \\' az-Rodr \\' guez, N.; Del Ser, J.; Bennetot, A.; Tabik, S.; Barbado, A.; Garc \\' a, S.; Gil-L \\'o pez, S.; Molina, D.; Benjamins, R.; et al","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.028624Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:bfa81fd24a4b5b5e0776b4828e700764dae0ec7205ffc35252cbbadb0cfeb862","observation_id":"ac545bc6-e45b-41eb-adad-931449baae02","resolution":{"observed_at":"2026-08-11T13:32:45.028624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08328","last_updated":"2019-01-24T02:53:31Z","snapshot_observed_at":"2026-08-14T19:12:43.709138Z","submitted_at":"2018-05-22T00:14:32Z","title":"Verifiable Reinforcement Learning via Policy Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.08328","snapshot_observed_at":"2026-08-11T13:32:45.034503Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.034503Z"},"links":{"cited_paper":"/paper/1805.08328","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:85bb3507389b32a9b12c26d2235fce7d302eb5d5966c3686dc535aadec17226d","observation_id":"49f1c858-e2bc-47a0-866d-a645ed397d7e","resolution":{"observed_at":"2026-08-11T13:32:45.034503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05514","last_updated":"2022-04-12T04:02:17Z","snapshot_observed_at":"2026-08-13T16:04:00.039169Z","submitted_at":"2022-04-12T04:02:17Z","title":"A Comparative Study of Faithfulness Metrics for Model Interpretability Methods","version":1},"cited_work":{"arxiv_id":"2204.05514","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.05514","snapshot_observed_at":"2026-08-11T13:32:45.818295Z","title":"A Comparative Study of Faithfulness Metrics for Model Interpretability Methods","venue":"cs.CL","work_id":"18dfb5ed-4ad9-422b-80df-b48b8f2325c8","year":2022},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.041119Z"},"links":{"cited_paper":"/paper/2204.05514","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:ba36c7ec6672024e55fafa277fc4abd847658dba5ab05b1b9c7f1737cab15f4c","observation_id":"2fbad8ee-a90e-4543-ad5c-6299fb4ab01f","resolution":{"observed_at":"2026-08-11T13:32:45.824661Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.252397Z","title":null,"venue":null,"work_id":"ece9dd01-0d21-4a8a-870f-10509b78ec58","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.050053Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:b7199e6800e91e0af97b29d2046830a2f4791626739177c12b2026e2e6c9deb6","observation_id":"f336f205-7aaf-4ae2-a837-a211105622d9","resolution":{"observed_at":"2026-08-11T13:32:46.260221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.233320Z","title":"L.; and Iacca, G","venue":null,"work_id":"7dc8cf8d-c144-45b2-9c44-df86f581d447","year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.055451Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:db730b285afcb4ffeb3831bdc2ab393e3a98e624846ebcc70de523e65c071077","observation_id":"ed8cbdea-22b9-4516-9c26-a8801507c108","resolution":{"observed_at":"2026-08-11T13:32:46.239110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.217736Z","title":"L.; and Iacca, G","venue":null,"work_id":"1f0c154b-6cda-4ac7-aba6-bbc1c968123b","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.061491Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:b8190f81882162a1e24ec9e01bc2b026eb1db0e283e965bdf5d77bf769e585cb","observation_id":"52fa2825-6a0c-4cbf-8441-e0fc6a54044b","resolution":{"observed_at":"2026-08-11T13:32:46.222577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15480","last_updated":"2025-01-21T18:49:43Z","snapshot_observed_at":"2026-08-15T06:16:38.136200Z","submitted_at":"2024-01-27T19:05:21Z","title":"Social Interpretable Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2401.15480","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.15480","snapshot_observed_at":"2026-08-11T13:32:45.795206Z","title":"Social Interpretable Reinforcement Learning","venue":"cs.LG","work_id":"f1dd73a3-b4dc-4df4-a637-c9c6f73f34ab","year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.066821Z"},"links":{"cited_paper":"/paper/2401.15480","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:37eb40f9e07de56a6444f6eccc2e22ef91e198b9c01f7a4f3ff404afbb992c24","observation_id":"1a224147-1276-4985-855a-4c69ca67fb28","resolution":{"observed_at":"2026-08-11T13:32:45.800705Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01439","last_updated":"2023-10-25T16:40:27Z","snapshot_observed_at":"2026-08-13T11:25:50.495008Z","submitted_at":"2023-06-02T10:59:44Z","title":"Interpretable and Explainable Logical Policies via Neurally Guided Symbolic Abstraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01439","snapshot_observed_at":"2026-08-11T13:32:45.076871Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.076871Z"},"links":{"cited_paper":"/paper/2306.01439","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:ba6c6a4d2dc7edc6ca7a4fb132c87203350befb5eb3f8b258511c13407c86fcd","observation_id":"c885c4ad-3f4f-4e05-a429-4a6fd4de01c3","resolution":{"observed_at":"2026-08-11T13:32:45.076871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05821","last_updated":"2024-10-28T18:38:00Z","snapshot_observed_at":"2026-08-14T16:26:56.175653Z","submitted_at":"2024-01-11T10:38:22Z","title":"Interpretable Concept Bottlenecks to Align Reinforcement Learning Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05821","snapshot_observed_at":"2026-08-11T13:32:45.082937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.082937Z"},"links":{"cited_paper":"/paper/2401.05821","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:a7b1c71fb655296d5834e70ae13dddce654e15f996eb9c57edc1d48034f4edb2","observation_id":"055e87c2-872c-4614-92e8-bdc72a4e23b6","resolution":{"observed_at":"2026-08-11T13:32:45.082937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09521","last_updated":"2021-04-06T17:28:51Z","snapshot_observed_at":"2026-08-14T17:19:27.764833Z","submitted_at":"2020-09-20T20:41:57Z","title":"Towards Interpretable-AI Policies Induction using Evolutionary Nonlinear Decision Trees for Discrete Action Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09521","snapshot_observed_at":"2026-08-11T13:32:45.088950Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.088950Z"},"links":{"cited_paper":"/paper/2009.09521","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:14a025a634b6b2b2b647392ba9d7d5563be139812e484d56c0af12e7f4fe7c3f","observation_id":"4ca8392b-6662-4264-96f3-61ab9e8e9367","resolution":{"observed_at":"2026-08-11T13:32:45.088950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.200364Z","title":null,"venue":null,"work_id":"38913d00-3e5c-43e9-bc27-356227269588","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.094056Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:f6fad5a4660ec029a7946452413bb996f7e0d9c153ef54cde7b5bcbcf1655c82","observation_id":"8b210593-1cd6-4d93-9b3a-8cbc2ed0fd3e","resolution":{"observed_at":"2026-08-11T13:32:46.206220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.099000Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.099000Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:13afa87188b23773190250da2a1cdf6de375da6e331dfa7d0b768df1e16dc2a8","observation_id":"83f737ea-fe93-436f-b71b-ebcc9d6d4ba3","resolution":{"observed_at":"2026-08-11T13:32:45.099000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.172304Z","title":"H.; Kovach, T.; Miller, K.; and Dubrawski, A","venue":null,"work_id":"d0b900b8-7bba-493b-a28a-08698b90164e","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.104425Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:d44241f7a8d799bb3c1fe1927dff64b9c32cdade4508eca4da7c29e134800c00","observation_id":"613da353-6400-4451-9fd0-fdf08b7ab0c2","resolution":{"observed_at":"2026-08-11T13:32:46.177711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01290","last_updated":"2018-08-08T21:27:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T09:50:50Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01290","snapshot_observed_at":"2026-08-11T13:32:45.110176Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.110176Z"},"links":{"cited_paper":"/paper/1801.01290","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:5012b6f638867025336978dd7a8ce469371b1f1c13f33901d7276269c776c93e","observation_id":"d8dbd196-c24c-43b1-8bca-99bfe34eaa5a","resolution":{"observed_at":"2026-08-11T13:32:45.110176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.155882Z","title":null,"venue":null,"work_id":"e4699ffa-0e97-47e9-a388-abfad6ff1f42","year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.116774Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:ad8e5f114132248f808212352c32ad2743768365a855cdecc9ffeb61f181e70d","observation_id":"3f52c25a-c4da-4825-95bb-3b5feb1e0d6b","resolution":{"observed_at":"2026-08-11T13:32:46.161188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.136910Z","title":null,"venue":null,"work_id":"11c2270c-bc12-46a7-9b23-7f883a13c225","year":2022},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.122957Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:0434948cd11511d06b7d732f08726308f76c094efdab7ac312a65a399c9f444b","observation_id":"8f1deed5-0d36-42b7-9d88-e060bbfa18f2","resolution":{"observed_at":"2026-08-11T13:32:46.142097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.116823Z","title":null,"venue":null,"work_id":"0a71f1ac-0548-4342-8429-6ee65c124100","year":2020},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.128115Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:afad58b9427c5562e2e363cf47a8903511b7c67e181cd582c5d7802bdffad5c6","observation_id":"d5e2bed2-f5b1-49c3-b492-32a66450d81b","resolution":{"observed_at":"2026-08-11T13:32:46.123423Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.095356Z","title":"T.; and Alpayd n, E","venue":null,"work_id":"03d4fc7e-734e-4528-b984-2d4641f4be82","year":2012},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.133882Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:25cf8b197dc1fbef0ed6f10e9e18607cea49ebd79c8f6200354c0a12adea4c7d","observation_id":"ebcc9f13-2336-45db-8a0d-062b79ccd815","resolution":{"observed_at":"2026-08-11T13:32:46.100649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10729","last_updated":"2019-07-10T03:45:15Z","snapshot_observed_at":"2026-08-14T16:42:12.664750Z","submitted_at":"2019-04-24T10:24:35Z","title":"Neural Logic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1904.10729","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.10729","snapshot_observed_at":"2026-08-11T13:32:45.703358Z","title":"Neural Logic Reinforcement Learning","venue":"cs.LG","work_id":"9636dff2-9f93-4520-9552-8843d86ab9ee","year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.139164Z"},"links":{"cited_paper":"/paper/1904.10729","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:21cb51b21f5978679fae4b1731ed90c6ff1d303f9643cc9c437dce9b7941fdc2","observation_id":"c915c229-cb12-4324-b72e-26e4cac02390","resolution":{"observed_at":"2026-08-11T13:32:45.709064Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.10963","last_updated":"2021-10-21T08:21:49Z","snapshot_observed_at":"2026-08-13T17:48:58.410697Z","submitted_at":"2021-10-21T08:21:49Z","title":"Neuro-Symbolic Reinforcement Learning with First-Order Logic","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.10963","snapshot_observed_at":"2026-08-11T13:32:45.144657Z","title":"J.; Tatsubori, M.; Munawar, A.; and Gray, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.144657Z"},"links":{"cited_paper":"/paper/2110.10963","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:4f7ee56cbf72774749d14e0ecb74b2ab4c1ae6c293fd8c7cca1789e43697832b","observation_id":"48495234-14e0-45b8-b25f-3b76e1a6a1b0","resolution":{"observed_at":"2026-08-11T13:32:45.144657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14956","last_updated":"2024-05-23T18:07:38Z","snapshot_observed_at":"2026-08-12T23:59:28.062726Z","submitted_at":"2024-05-23T18:07:38Z","title":"Interpretable and Editable Programmatic Tree Policies for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14956","snapshot_observed_at":"2026-08-11T13:32:45.150684Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.150684Z"},"links":{"cited_paper":"/paper/2405.14956","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:2640f3bbc94a829bed0d3376de691317cef0c7088d69808eaf3e8f37c978c9ec","observation_id":"cec939f8-62dc-45ad-8e6b-bf0c0563917d","resolution":{"observed_at":"2026-08-11T13:32:45.150684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12950","last_updated":"2023-05-31T09:08:07Z","snapshot_observed_at":"2026-08-14T02:12:32.650206Z","submitted_at":"2023-01-30T14:50:46Z","title":"Hierarchical Programmatic Reinforcement Learning via Learning to Compose Programs","version":2},"cited_work":{"arxiv_id":"2301.12950","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.12950","snapshot_observed_at":"2026-08-11T13:32:45.642944Z","title":"Hierarchical Programmatic Reinforcement Learning via Learning to Compose Programs","venue":"cs.LG","work_id":"5ce8bb6c-d1e7-41d2-a8be-94b9ad0b47c0","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.157572Z"},"links":{"cited_paper":"/paper/2301.12950","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:5d16c88930fbe52f63cb782cb25b7799e0b789de8bd583044769f75648c15d60","observation_id":"ef7ad309-a82c-4406-9a4f-b630eb0f41dc","resolution":{"observed_at":"2026-08-11T13:32:45.648688Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.073147Z","title":null,"venue":null,"work_id":"179c3f0a-3098-484c-8f54-d022306c0ed8","year":1996},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.166433Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:38a0b921de85c48e32be2f4bd9d7be95b8fbf526a530c1d73477075d3f26d627","observation_id":"91dc8984-f811-4851-bff0-1a38330d83c0","resolution":{"observed_at":"2026-08-11T13:32:46.079664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.042039Z","title":null,"venue":null,"work_id":"aa781c36-482c-478b-99a0-3edf174bda7e","year":2018},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.171934Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:6dc5c2beb29e57854b9cb7b46712872beb588f34152cf70c10534b0a2c742209","observation_id":"231f472e-7b28-46de-9543-60196270f286","resolution":{"observed_at":"2026-08-11T13:32:46.053267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.018769Z","title":null,"venue":null,"work_id":"aa189d53-b68e-4032-885d-d660cc60424b","year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.177237Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:a8f7205035dde53cbb7b3b253d884f02712d26eb6d1f1b198ff4d944e82f0512","observation_id":"f4153a02-103f-40f2-9d34-312c7b5d8f74","resolution":{"observed_at":"2026-08-11T13:32:46.024916Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08609","last_updated":"2024-06-26T16:50:01Z","snapshot_observed_at":"2026-08-13T04:19:40.205440Z","submitted_at":"2024-02-13T17:18:56Z","title":"Mixtures of Experts Unlock Parameter Scaling for Deep RL","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08609","snapshot_observed_at":"2026-08-11T13:32:45.182019Z","title":"K.; Precup, D.; and Castro, P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.182019Z"},"links":{"cited_paper":"/paper/2402.08609","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:6735f4b9ebb80c8ce193c63b349591f2521931001afe3d0895888d671d243235","observation_id":"91e45054-ce96-40d5-9cd6-b43a458de564","resolution":{"observed_at":"2026-08-11T13:32:45.182019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10041","last_updated":"2023-11-16T17:37:46Z","snapshot_observed_at":"2026-08-13T05:23:42.350506Z","submitted_at":"2023-11-16T17:37:46Z","title":"Interpretable Reinforcement Learning for Robotics and Continuous Control","version":1},"cited_work":{"arxiv_id":"2311.10041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.10041","snapshot_observed_at":"2026-08-11T13:32:45.598596Z","title":"Interpretable Reinforcement Learning for Robotics and Continuous Control","venue":"cs.RO","work_id":"9817c3db-a8cb-4581-a5b5-e009b6bceaee","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.187544Z"},"links":{"cited_paper":"/paper/2311.10041","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:d2639959a2d9a8b037c64bf2f5ba9a18fbd11646a2daa67f66036a2edd60c490","observation_id":"c08f235b-36cf-45c2-99a2-d82accd3345b","resolution":{"observed_at":"2026-08-11T13:32:45.604647Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.998724Z","title":"D.; Howe, A","venue":null,"work_id":"611e6208-4976-4584-a237-6f8555821c95","year":2001},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.192706Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:17c2e9acd06edff3b24b66360157bfe13ac1d1101d4a7bcd528193b857766fa3","observation_id":"315399f9-01b0-453f-9c19-692468fd8a93","resolution":{"observed_at":"2026-08-11T13:32:46.004564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09122","last_updated":"2021-04-19T08:21:56Z","snapshot_observed_at":"2026-08-13T19:37:40.494853Z","submitted_at":"2021-04-19T08:21:56Z","title":"Probabilistic Mixture-of-Experts for Efficient Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09122","snapshot_observed_at":"2026-08-11T13:32:45.197714Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.197714Z"},"links":{"cited_paper":"/paper/2104.09122","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:86024cb86b17414c239545b8a90f63cfe44160c62f2cb77f250e590c0bb500c4","observation_id":"00df51e9-3f83-425c-9503-fa60fe2fb8de","resolution":{"observed_at":"2026-08-11T13:32:45.197714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.05974","last_updated":"2021-06-10T17:10:56Z","snapshot_observed_at":"2026-08-13T19:05:40.642938Z","submitted_at":"2021-06-10T17:10:56Z","title":"Scaling Vision with Sparse Mixture of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.05974","snapshot_observed_at":"2026-08-11T13:32:45.203218Z","title":"S.; Keysers, D.; and Houlsby, N","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.203218Z"},"links":{"cited_paper":"/paper/2106.05974","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:4cc6731163118e8210061484dd25828c5e39e31e691b55b989c1251d388c090d","observation_id":"11b06ef2-b636-48ca-8a50-fb04bf77a510","resolution":{"observed_at":"2026-08-11T13:32:45.203218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1011.0686","last_updated":"2011-03-16T18:51:21Z","snapshot_observed_at":"2026-08-15T05:04:07.152443Z","submitted_at":"2010-11-02T17:55:55Z","title":"A Reduction of Imitation Learning and Structured Prediction to No-Regret Online Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1011.0686","snapshot_observed_at":"2026-08-11T13:32:45.209139Z","title":"J.; and Bagnell, J","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.209139Z"},"links":{"cited_paper":"/paper/1011.0686","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:c04263fb95673e98c1ef7e874ecf07eb7690079ed4ddb59ed2ea0bca9aa0d8e0","observation_id":"f1a6fd87-30bb-450b-8c9d-f57869b34714","resolution":{"observed_at":"2026-08-11T13:32:45.209139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01180","last_updated":"2019-07-02T05:51:04Z","snapshot_observed_at":"2026-08-05T03:40:23.581115Z","submitted_at":"2019-07-02T05:51:04Z","title":"Conservative Q-Improvement: Reinforcement Learning for an Interpretable Decision-Tree Policy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01180","snapshot_observed_at":"2026-08-11T13:32:45.215032Z","title":"M.; Topin, N.; Jamshidi, P.; and Veloso, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.215032Z"},"links":{"cited_paper":"/paper/1907.01180","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:73193c376a233827bbe1bbe867d96ee1da94d61be93e6d92906a2aa119e5c452","observation_id":"922eac69-5746-48f8-8e59-dda09641fe3c","resolution":{"observed_at":"2026-08-11T13:32:45.215032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.220287Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.220287Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:c8f5c611ab42426629f89c3719da18cc33224d56a9cd55f892fe87bd5c37c78f","observation_id":"c9d93b89-7792-486c-b872-6e1678c5f258","resolution":{"observed_at":"2026-08-11T13:32:45.220287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.11251","last_updated":"2021-07-10T01:20:27Z","snapshot_observed_at":"2026-08-14T23:41:50.065234Z","submitted_at":"2021-03-20T21:58:27Z","title":"Interpretable Machine Learning: Fundamental Principles and 10 Grand Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.11251","snapshot_observed_at":"2026-08-11T13:32:45.225767Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.225767Z"},"links":{"cited_paper":"/paper/2103.11251","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:7b45e5036e809850f7ab348f22077a851b315354bb4fb54fe71c74272c92e506","observation_id":"e21e9ec9-d4a7-46c2-9aac-f4e737005bea","resolution":{"observed_at":"2026-08-11T13:32:45.225767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00731","last_updated":"2019-06-17T04:30:19Z","snapshot_observed_at":"2026-08-14T18:05:20.046729Z","submitted_at":"2018-11-02T04:14:09Z","title":"The age of secrecy and unfairness in recidivism prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00731","snapshot_observed_at":"2026-08-11T13:32:45.231952Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.231952Z"},"links":{"cited_paper":"/paper/1811.00731","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:151c5dde847ddb809c8d88730060a29bb4a5e193c1c37014356f0b2d16a79aaa","observation_id":"5bb6aa8a-c3f3-4557-9b16-8cd84402f500","resolution":{"observed_at":"2026-08-11T13:32:45.231952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-11T13:32:45.237116Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.237116Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:4588fc509d62e0c3871dc5da2af0317037e12ed7cd67e5cfc4fc8682678e7642","observation_id":"82aea2a7-f7ae-4df0-bcd8-ca006b6f3f07","resolution":{"observed_at":"2026-08-11T13:32:45.237116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06107","last_updated":"2024-06-10T08:46:49Z","snapshot_observed_at":"2026-08-12T23:46:39.486185Z","submitted_at":"2024-06-10T08:46:49Z","title":"EXPIL: Explanatory Predicate Invention for Learning in Games","version":1},"cited_work":{"arxiv_id":"2406.06107","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06107","snapshot_observed_at":"2026-08-11T13:32:45.431133Z","title":"EXPIL: Explanatory Predicate Invention for Learning in Games","venue":"cs.AI","work_id":"8a137542-44a3-4e67-ae07-e26c865c2673","year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.242477Z"},"links":{"cited_paper":"/paper/2406.06107","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:241802a7a691d52c6cad7e52d714deaca7ea027e372cb4cf6b2be4bfc00b0225","observation_id":"19a8739d-4b31-4d85-9100-610eee34392a","resolution":{"observed_at":"2026-08-11T13:32:45.436766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-11T13:32:45.248037Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.248037Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:96ec3645405d091d70888833c4a754b8beefcd55881c91290191ced5fed409cf","observation_id":"22a1ef4e-c9cb-4c0b-9d10-bdd711804b5e","resolution":{"observed_at":"2026-08-11T13:32:45.248037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.970491Z","title":null,"venue":null,"work_id":"cefb6d5d-13ce-46c3-b992-558d63ecf988","year":2020},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.253495Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:7007286421a797b418efb83a502076c3e6bed087dd7577cdc2392e82f1461f4b","observation_id":"6151c00c-357e-4030-9f50-fc2eba1195a6","resolution":{"observed_at":"2026-08-11T13:32:45.975560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.955915Z","title":null,"venue":null,"work_id":"fde848b2-b40e-49c6-b6e6-1b26e9ed5337","year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.259007Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:bd16c7d4671a6edfd89f989326fad09127e59da3d2f08416b8b5cf4333b5840a","observation_id":"7db04995-f866-4023-9b74-30d631b6009b","resolution":{"observed_at":"2026-08-11T13:32:45.960591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.939386Z","title":"M.; Kosut, R","venue":null,"work_id":"c26c760e-b49f-41e9-9807-288e7bbae4ab","year":1994},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.264001Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:2354ff951275cf0d83f83f2b8743c67fd1dc9e3ce68f9dde78d520cd0b71270f","observation_id":"5648963b-dcc5-4a85-b412-fea4ccd2a1d6","resolution":{"observed_at":"2026-08-11T13:32:45.944726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.922713Z","title":null,"venue":null,"work_id":"2fe817db-d429-4f30-8e93-51749b534538","year":2004},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.268973Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:f6305354511219a4cd355155d48a17c744f34c2721a4a11113ffe3adcc10c347","observation_id":"0dc366ad-3103-4f40-86a5-85f667d03ff8","resolution":{"observed_at":"2026-08-11T13:32:45.927744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.906139Z","title":null,"venue":null,"work_id":"1c8d3a55-3427-473e-ac37-cb7ce58dad10","year":2012},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.274082Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:84394cbf199cc409c5b93adff9e95c2f0aa16d24d19b5992ff5589e1a693a2c2","observation_id":"298381fe-b965-4303-a9f1-4942a8ce32e0","resolution":{"observed_at":"2026-08-11T13:32:45.911654Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.889293Z","title":"R.; and Alemzadeh, H","venue":null,"work_id":"e9c865ae-5bfb-4520-92d4-e5c6a4de198c","year":2017},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.279233Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:3a9d6f4e388d49f9385ec5574600f78036a6188f153d1437d10fd179d71f9c93","observation_id":"fed40590-01f0-4c04-a571-1a0a65b32236","resolution":{"observed_at":"2026-08-11T13:32:45.894922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05431","last_updated":"2021-01-19T20:52:42Z","snapshot_observed_at":"2026-08-15T06:43:25.452644Z","submitted_at":"2019-07-11T18:00:56Z","title":"Imitation-Projected Programmatic Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1907.05431","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.05431","snapshot_observed_at":"2026-08-11T13:32:45.385778Z","title":"Imitation-Projected Programmatic Reinforcement Learning","venue":"cs.LG","work_id":"8ababe92-71bb-47e5-b3bd-41c6f092c8dd","year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.284169Z"},"links":{"cited_paper":"/paper/1907.05431","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:a7280f1649c10a27eb3ac47e2f357465fc53e778c1156b3eb64511aec43956ee","observation_id":"dfbb4739-8559-487a-9aee-1a2b896e123a","resolution":{"observed_at":"2026-08-11T13:32:45.393771Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.02477","last_updated":"2019-04-10T09:09:46Z","snapshot_observed_at":"2026-08-14T19:28:23.894824Z","submitted_at":"2018-04-06T22:17:18Z","title":"Programmatically Interpretable Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.02477","snapshot_observed_at":"2026-08-11T13:32:45.289019Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.289019Z"},"links":{"cited_paper":"/paper/1804.02477","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:3cc5077ed943a054b9cbb735faf0c0e94d4781cc95016d827207b2aae9fe6037","observation_id":"c7f6db6b-7ed0-40fe-a688-951d90b2ae18","resolution":{"observed_at":"2026-08-11T13:32:45.289019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.873543Z","title":null,"venue":null,"work_id":"f768dbeb-7dfe-4487-b0a6-9e2ff2903b83","year":2022},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.294230Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:69b04316ab2eb7d86e0be80e82218d6978e1782a7ce78038c2140a3574f57119","observation_id":"e52267e0-57e8-401c-ae94-e46e3d609e46","resolution":{"observed_at":"2026-08-11T13:32:45.878692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.856983Z","title":null,"venue":null,"work_id":"23bedd24-decc-494c-b97d-36e04c7388d5","year":2017},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.299276Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:557e40b9ca947058b92f5eaeef4f5ec3cf93f0505f0582ff75e03490c9b32312","observation_id":"91f1d224-3414-4ba9-982e-6186ec594df8","resolution":{"observed_at":"2026-08-11T13:32:45.861916Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18420","last_updated":"2024-06-26T15:15:15Z","snapshot_observed_at":"2026-08-12T23:34:23.987648Z","submitted_at":"2024-06-26T15:15:15Z","title":"Mixture of Experts in a Mixture of RL settings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18420","snapshot_observed_at":"2026-08-11T13:32:45.303935Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.303935Z"},"links":{"cited_paper":"/paper/2406.18420","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:b98dcea93411d4315fdc1338818432df8231a6aef0a529b2816bc0b7e9a62da6","observation_id":"5c4a2e66-b4d1-429b-a24e-da4f3db4503f","resolution":{"observed_at":"2026-08-11T13:32:45.303935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":38,"verified_exact":5,"verified_fuzzy":7},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2412.13053."}