{"as_of":"2026-08-08T07:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ca2b7577643beda03f3c52a02bedc8e1f7474c96b7ce616d16f5b8ad23d4fd4c","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T15:18:07.263704Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:10:42.960233Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T22:56:20.121244Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"cited_work":{"arxiv_id":"2509.20623","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.20623","snapshot_observed_at":"2026-07-01T22:56:20.121244Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","venue":"cs.RO","work_id":"68f16755-4910-4dcd-b525-3f597ab0b3c0","year":2025},"citing_paper":{"arxiv_id":"2606.02027","last_updated":"2026-06-01T10:16:07Z","snapshot_observed_at":"2026-08-02T05:09:20.766590Z","submitted_at":"2026-06-01T10:16:07Z","title":"World-Task Factorization for Robot Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T14:53:20.935074Z"},"links":{"cited_paper":"/paper/2509.20623","citing_paper":"/paper/2606.02027"},"observation_digest":"sha256:0bdab21f3ab0de8bc3e374f412c9628bdbf4f0f463a890527465934fd273c8b6","observation_id":"ce3b6b32-e463-4680-a8a4-9fc91b679c80","resolution":{"observed_at":"2026-07-01T22:56:20.122929Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.20623","snapshot_observed_at":"2026-08-04T01:10:42.960233Z","title":"Latent activation editing: Inference-time refinement of learned policies for safer multirobot navigation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00175","last_updated":"2026-07-31T18:00:50Z","snapshot_observed_at":"2026-08-07T07:35:55.235015Z","submitted_at":"2026-07-31T18:00:50Z","title":"Inference-Time Policy Alignment for Fair Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T01:10:42.960233Z"},"links":{"cited_paper":"/paper/2509.20623","citing_paper":"/paper/2608.00175"},"observation_digest":"sha256:1a58df3b475bf03f2cbf7b35aa347c54b17b409b9fd4c7865469d5fb42a862a1","observation_id":"b1c37c58-b0f9-4032-ae3f-9db44825504e","resolution":{"observed_at":"2026-08-04T01:10:42.960233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.20623/citation-record","integrity":"/paper/2509.20623/integrity","json":"/paper/2509.20623/citation-record.json","paper":"/paper/2509.20623"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:02.085453Z","title":"Recent advances in robot learning from demonstration,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:02.085453Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:c1a3e981c64c19d073d215c505ce6ec8490fa7ba43193fa1140e8bf9205d4e67","observation_id":"87b7ffa2-ae0e-4bb9-91f8-9afa02da1b34","resolution":{"observed_at":"2026-08-04T15:18:02.085453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:02.180527Z","title":"Collision avoidance and navigation for a quadrotor swarm using end-to-end deep reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:02.180527Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:70996af798e45a56a38e7de3763c5c8ffe3a1a9776ae0246bf7cee0b4622279b","observation_id":"97866fcd-cb9a-4264-bff9-f46c7d8dde64","resolution":{"observed_at":"2026-08-04T15:18:02.180527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:02.323494Z","title":"Decentralized control of quadrotor swarms with end-to- end deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:02.323494Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:445932ed8be93257aa1603e84f6778fe22213e67eb81356caaa6fce4bfdbb0b5","observation_id":"e1b2cce3-0971-466d-a28f-d4bbbde7cac8","resolution":{"observed_at":"2026-08-04T15:18:02.323494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03539","last_updated":"2024-09-16T15:41:05Z","snapshot_observed_at":"2026-07-06T18:57:43.764663Z","submitted_at":"2024-08-07T04:35:38Z","title":"Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03539","snapshot_observed_at":"2026-08-04T15:18:02.500174Z","title":"Deep reinforcement learning for robotics: A survey of real- world successes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:02.500174Z"},"links":{"cited_paper":"/paper/2408.03539","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:315be4d9412bacfe9686437741f3aa095a3ec7b338b5f4743de440e873e27cf1","observation_id":"2f9521a9-f171-4ad0-bdd4-1165b78b3942","resolution":{"observed_at":"2026-08-04T15:18:02.500174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:02.600089Z","title":"The mythos of model interpretability: In machine learning, the concept of interpretability is both important and slippery","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:02.600089Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:04754750751ee42ffdb04953f21ba6faa9ac8be28a3e31559d30cea8117402c5","observation_id":"db29d5e4-80a0-4f44-ab0f-aaa21b620567","resolution":{"observed_at":"2026-08-04T15:18:02.600089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.10087","last_updated":"2018-06-26T13:31:37Z","snapshot_observed_at":"2026-07-06T06:01:51.192687Z","submitted_at":"2017-09-28T17:51:13Z","title":"Learning Complex Dexterous Manipulation with Deep Reinforcement Learning and Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.10087","snapshot_observed_at":"2026-08-04T15:18:02.726945Z","title":"Learning complex dexterous manipulation with deep reinforcement learning and demonstrations,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:02.726945Z"},"links":{"cited_paper":"/paper/1709.10087","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:720030701dc00463733e39b834dea24d57fd114f2e33d8df1883aeb65709074d","observation_id":"aea5bd7e-1db6-4ccc-b03e-02ac68cd9d24","resolution":{"observed_at":"2026-08-04T15:18:02.726945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:02.844983Z","title":"Learning to modulate pre-trained models in rl,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:02.844983Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:5eccd6591729521e0c3c6a33d6f52827aed4052ee796fd396d22fa908869fc6e","observation_id":"88397ea7-c346-46ba-9e64-ac324400d29f","resolution":{"observed_at":"2026-08-04T15:18:02.844983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02868","last_updated":"2024-07-17T09:29:19Z","snapshot_observed_at":"2026-07-06T17:25:22.551344Z","submitted_at":"2024-02-05T10:30:47Z","title":"Fine-tuning Reinforcement Learning Models is Secretly a Forgetting Mitigation Problem","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02868","snapshot_observed_at":"2026-08-04T15:18:03.002844Z","title":"Fine-tuning reinforcement learning models is secretly a forgetting mitigation problem,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.002844Z"},"links":{"cited_paper":"/paper/2402.02868","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:71e5f6badc1b7eeabe93ae264e1688e4962d05209ff894e1c095222ac5c1b94c","observation_id":"1124903d-673a-4b0f-92b1-02e47c66d594","resolution":{"observed_at":"2026-08-04T15:18:03.002844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:03.092780Z","title":"Deep reinforcement learning that matters,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.092780Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:862922796bbb597941ac1675856b64f1aa3e319683ef36acf5e9819af0c6eb12","observation_id":"b008a52d-3ff4-40b3-a8dd-7085f52c9235","resolution":{"observed_at":"2026-08-04T15:18:03.092780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12901","last_updated":"2019-04-29T18:40:15Z","snapshot_observed_at":"2026-07-06T07:49:17.886466Z","submitted_at":"2019-04-29T18:40:15Z","title":"Challenges of Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12901","snapshot_observed_at":"2026-08-04T15:18:03.210758Z","title":"Challenges of real- world reinforcement learning,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.210758Z"},"links":{"cited_paper":"/paper/1904.12901","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:06660bec77a1e07d9d101b02ad5fd3b06dd26bef422f9f45697ac5d7d4ee65e9","observation_id":"3d82f5ed-341d-4555-9d36-126042b4c233","resolution":{"observed_at":"2026-08-04T15:18:03.210758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-04T15:18:03.293607Z","title":"Steering language models with activation engi- neering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.293607Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:3269a564e3e19b9b3eff9780bcb5c4f764fe28fec04d09b0f3ba99b75dbbc44a","observation_id":"249308d2-c36c-44cd-835d-ce2d0ad49c02","resolution":{"observed_at":"2026-08-04T15:18:03.293607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-04T15:18:03.396426Z","title":"Representation engineering: A top-down approach to ai transparency,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.396426Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:c4bb3c4c7638377bfc6dfef2f99de68021213f8aaa351bc536f0bd47b7f576d9","observation_id":"22dc3fd8-51dd-4805-bc2e-db64fed14bb1","resolution":{"observed_at":"2026-08-04T15:18:03.396426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:03.470923Z","title":"Templeton,Scaling monosemanticity: Extracting interpretable fea- tures from claude 3 sonnet","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.470923Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:177ddf2dd7e2ec4b4ceb399b2259e8af7bfd176d71e409b43ba2c037683f91e2","observation_id":"2c114ac2-9114-44d2-9e6e-4ae19b9f2452","resolution":{"observed_at":"2026-08-04T15:18:03.470923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:03.555329Z","title":"Ganspace: Dis- covering interpretable gan controls,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.555329Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:80f6ab00f8409fe23356315c967e422426675bec41c6a9ada1f34698c7da4847","observation_id":"90b901bc-8b47-4e4b-b304-6f066fb772ce","resolution":{"observed_at":"2026-08-04T15:18:03.555329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-08T06:35:17.078531Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-04T15:18:03.651430Z","title":"Sdedit: Guided image synthesis and editing with stochastic differen- tial equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.651430Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:81fda8d840deddbbca34d8467804b4fd0e913517bd964fa8ab9d46ed4e95b3f8","observation_id":"6a99ffd9-0108-4f3b-96da-86163e5bdd53","resolution":{"observed_at":"2026-08-04T15:18:03.651430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-04T15:18:03.738954Z","title":"World models,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.738954Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:fbd19f706697fe9938631c2f777e9bef0c7ae959b35fdd63727e6221baeeeb3b","observation_id":"a5dd48d0-000f-443e-845c-9978c4ed0f67","resolution":{"observed_at":"2026-08-04T15:18:03.738954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:03.811391Z","title":"Learning latent dynamics for planning from pixels,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.811391Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:5f01c5029911454161ca67f6c66e2c68b9864eb4406a2a6e751a384b844100f5","observation_id":"0e92c84d-88d3-429c-97fa-58b5a5388a57","resolution":{"observed_at":"2026-08-04T15:18:03.811391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-03T15:20:23.515607Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-04T15:18:03.892460Z","title":"Dream to control: Learning behaviors by latent imagination,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.892460Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:5322d105af91fcc3c3a55e44edc7ba40434a0bf800c8c3cd7ce8678c22e30b44","observation_id":"a54bfdc7-9ba7-4ad4-ba98-23f14217d62a","resolution":{"observed_at":"2026-08-04T15:18:03.892460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-04T15:18:03.978925Z","title":"Efficient estimation of word representations in vector space,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:03.978925Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:ff8d7ad8e5fd2901f3cccbd1f533bda2b55ae130a74953dc1f242b2a7b957154","observation_id":"8d864de9-3f39-4169-8571-dca0d91e407b","resolution":{"observed_at":"2026-08-04T15:18:03.978925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.01444","last_updated":"2017-04-06T09:48:20Z","snapshot_observed_at":"2026-07-06T05:36:39.612294Z","submitted_at":"2017-04-05T14:20:28Z","title":"Learning to Generate Reviews and Discovering Sentiment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.01444","snapshot_observed_at":"2026-08-04T15:18:04.079057Z","title":"Learning to generate reviews and discovering sentiment,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:04.079057Z"},"links":{"cited_paper":"/paper/1704.01444","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:0e7a5c9787f6e2d71efcc5755a5e20999d2a93fa29826ea1d0311af8bd05d32a","observation_id":"9504e9f9-f39f-4a2a-a251-12974ca3300a","resolution":{"observed_at":"2026-08-04T15:18:04.079057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:04.156695Z","title":"Emerging properties in self-supervised vision trans- formers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:04.156695Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:4bca1a7ec7da74f8c01224af140b5544abc602f8dfc08fe1757f88b90ceed7d6","observation_id":"862af5a2-0a41-4d49-b07c-1876a861b47e","resolution":{"observed_at":"2026-08-04T15:18:04.156695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-07-06T05:13:30.860932Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-04T15:18:04.265355Z","title":"Understanding intermediate layers using linear classifier probes,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:04.265355Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:0e8a4ab4d4ba05c7409fc301f79227d9142e9835e25e1febe8bbb5b2705a5f94","observation_id":"179a57e9-4947-4c45-a243-73666df31a0b","resolution":{"observed_at":"2026-08-04T15:18:04.265355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:04.366068Z","title":"Interpretability beyond feature attribution: Quantitative testing with concept activation vectors (tcav),","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:04.366068Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:9a5e018522dc7980c15fbae45b09c68f1173181f484ba7e6e0033841ca65934a","observation_id":"4f945cdd-ae38-48a9-80a7-8c58545e1e10","resolution":{"observed_at":"2026-08-04T15:18:04.366068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:04.532448Z","title":"Interfacegan: Interpreting the disentangled face representation learned by gans,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:04.532448Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:56134ad8390eacde055d576f6f0f1ecb25ca7f26a5a29e3f5442b0954a624465","observation_id":"a4790ad6-5486-40d2-8634-4007980dab2d","resolution":{"observed_at":"2026-08-04T15:18:04.532448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-04T15:18:04.670275Z","title":"Prompt-to-prompt image editing with cross attention control.(2022),","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:04.670275Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:e49841607171c8635c52fb28def428eb980e0841cb9d136a1ec129f8c3c1bd92","observation_id":"a87c6162-45d4-4c40-8ffc-afcbee40e597","resolution":{"observed_at":"2026-08-04T15:18:04.670275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-03T22:14:53.516423Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-04T15:18:04.834479Z","title":"P- tuning v2: Prompt tuning can be comparable to fine-tuning universally across scales and tasks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:04.834479Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:4252c311a4d47a0f4be6f87ac214392607b6ed35c4bfb5739f18ca973e96b078","observation_id":"f7a0dd14-83c8-42b5-81f4-48beb1a547bb","resolution":{"observed_at":"2026-08-04T15:18:04.834479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:04.957568Z","title":"Plug and play language models: A simple approach to controlled text generation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:04.957568Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:26c09a393e11d85cc6f05d8d35dc1e8c0e93c68a79778a036c654d33dae3ae49","observation_id":"5c6c5e23-728d-4b5f-891f-d9e6ea526a4a","resolution":{"observed_at":"2026-08-04T15:18:04.957568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:05.117341Z","title":"Locating and editing factual associations in gpt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:05.117341Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:79668ccbe41a5da804da98dd6ccd1af6994ad2fc19afd15426e893cc419f7bd7","observation_id":"85cbbff4-52a9-4100-8bf8-8b39a2d91957","resolution":{"observed_at":"2026-08-04T15:18:05.117341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:05.242832Z","title":"Elad,Sparse and redundant representations: from theory to appli- cations in signal and image processing","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:05.242832Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:82052628b82a3a1fcce4b72ef31e46eb0f78efcc53564e52052d61fa919b6640","observation_id":"3c8df2dc-ca8c-4880-a266-2371122523d4","resolution":{"observed_at":"2026-08-04T15:18:05.242832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-04T15:18:05.413127Z","title":"Toy models of superposition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:05.413127Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:cb2da1944825b32f84eb0a9fdbad6189c92b7600a23e5c1ed9849db51be02239","observation_id":"e68fd3e4-fcb1-4425-833e-9ee0aa8bbffc","resolution":{"observed_at":"2026-08-04T15:18:05.413127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-07-06T16:19:05.495349Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-04T15:18:05.515086Z","title":"Sparse autoencoders find highly interpretable features in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:05.515086Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:a5c66f77b1d2458bf3fb8b7e1fcb77e1e7001b5c1c8bc751612de6539e377f79","observation_id":"4c80af33-6eda-480f-992e-437d55595ca1","resolution":{"observed_at":"2026-08-04T15:18:05.515086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:05.635676Z","title":"Ls3: Latent space safe sets for long-horizon visuomotor control of sparse reward iterative tasks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:05.635676Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:31c8ec5adb84317d6fba9e9bc271a081c8f72feeb5169577625aa7386fd79b26","observation_id":"3be8570d-b6ff-461d-a176-e62b58333cd3","resolution":{"observed_at":"2026-08-04T15:18:05.635676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:05.706735Z","title":"Latent safety- constrained policy approach for safe offline reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:05.706735Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:1824f5bd2b2b57ba624620b412f20f45380bd95e566c9ba62dc0edf073f9a3d3","observation_id":"caca997a-ef10-49b1-bacd-bdfb60cce7ac","resolution":{"observed_at":"2026-08-04T15:18:05.706735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01801","last_updated":"2022-10-02T19:55:42Z","snapshot_observed_at":"2026-08-05T15:43:12.178192Z","submitted_at":"2022-10-02T19:55:42Z","title":"Safe Reinforcement Learning From Pixels Using a Stochastic Latent Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01801","snapshot_observed_at":"2026-08-04T15:18:05.879386Z","title":"Safe reinforcement learning from pixels using a stochastic latent represen- tation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:05.879386Z"},"links":{"cited_paper":"/paper/2210.01801","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:823836349f51a07c8f5440818a80f559d7d91975fd8bd5096aed755a88750a53","observation_id":"7575a794-e980-47dd-a9c1-b402038af2d2","resolution":{"observed_at":"2026-08-04T15:18:05.879386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:06.055684Z","title":"Generalizing safety beyond collision-avoidance via latent-space reachability analysis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:06.055684Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:919c4bc00efd053e6c4babeb70c9d24f92db9422e9ed3aa5a71275320b5d13c8","observation_id":"a7edb8bc-9c1e-4cfd-979d-5896c4e2a2f1","resolution":{"observed_at":"2026-08-04T15:18:06.055684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:06.187933Z","title":"A scalable dis- tributed collision avoidance scheme for multi-agent uav systems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:06.187933Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:cf839e9bc6f00c62ea2011b35a773bacb1c824f1faf5d288c063d7ec475732f5","observation_id":"a4822167-1449-4fe0-8916-70b4b16e2dd7","resolution":{"observed_at":"2026-08-04T15:18:06.187933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:06.338904Z","title":"Ego-swarm: A fully autonomous and decentralized quadrotor swarm system in cluttered environments,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:06.338904Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:532737cea5b27a7d04fbec4536b10615ed08a069b4bcb7f702b9f547b6144f60","observation_id":"488f96fa-21a0-4827-8c81-f976beedb9e7","resolution":{"observed_at":"2026-08-04T15:18:06.338904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:06.491579Z","title":"Safety barrier certificates for heterogeneous multi-robot systems,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:06.491579Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:e06b8542433f7315c474dc6441a16fea415753445449e52909ee50f567d630a4","observation_id":"33835488-daf6-4941-83b1-4f6d7e09b67b","resolution":{"observed_at":"2026-08-04T15:18:06.491579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:06.638356Z","title":"Gcbf+: A neural graph control barrier function framework for distributed safe multi-agent control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:06.638356Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:4434acf6baa20c97764833328f836829a62d72bf286dccb638f867b92adac8c4","observation_id":"684a6d17-ac29-47c1-b1a7-d1a85034cc08","resolution":{"observed_at":"2026-08-04T15:18:06.638356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09537","last_updated":"2023-06-15T22:46:20Z","snapshot_observed_at":"2026-08-03T18:57:31.948257Z","submitted_at":"2023-06-15T22:46:20Z","title":"QuadSwarm: A Modular Multi-Quadrotor Simulator for Deep Reinforcement Learning with Direct Thrust Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09537","snapshot_observed_at":"2026-08-04T15:18:06.768072Z","title":"Quadswarm: A modular multi-quadrotor simulator for deep reinforcement learning with direct thrust control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:06.768072Z"},"links":{"cited_paper":"/paper/2306.09537","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:38b2b3c85661dcac964e7342da3b3d540a4b314390c73fcc0419bc24b2a09eb1","observation_id":"0da3a115-c17a-4167-a98b-1a413abe30f3","resolution":{"observed_at":"2026-08-04T15:18:06.768072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10812","last_updated":"2024-03-27T00:15:16Z","snapshot_observed_at":"2026-07-06T17:04:17.738921Z","submitted_at":"2023-12-17T20:39:54Z","title":"Learning to Act without Actions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10812","snapshot_observed_at":"2026-08-04T15:18:06.919976Z","title":"Learning to act without actions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:06.919976Z"},"links":{"cited_paper":"/paper/2312.10812","citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:41ffbb3aac9f93db86a06f2ac0a88e066626d2e468f97ce272a2af98358b6c3d","observation_id":"8118872f-da45-4c38-a5c3-ddb4d7f1d958","resolution":{"observed_at":"2026-08-04T15:18:06.919976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:07.052755Z","title":"Sample factory: Egocentric 3d control from pixels at 100000 fps with asynchronous reinforcement learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:07.052755Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:998e513d6673dcbc51f5c953958073dd8bd7605dd4081bccea488902851f1b76","observation_id":"062a2d5b-ab07-47e2-8d8e-239bcfa231ec","resolution":{"observed_at":"2026-08-04T15:18:07.052755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:07.164948Z","title":"Parametric umap embeddings for representation and semisupervised learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:07.164948Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:dab504753dbc9f8a2a226dcb98d17cdd96504c11d952a6c111a9c42326145474","observation_id":"7b9da0a7-2da1-44b6-9606-66d400d5d040","resolution":{"observed_at":"2026-08-04T15:18:07.164948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:18:07.263704Z","title":"Barlow twins: Self-supervised learning via redundancy reduction,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T15:18:07.263704Z"},"links":{"citing_paper":"/paper/2509.20623"},"observation_digest":"sha256:54a6918f2c9a68f78cfc79dea570b549764cb5803ac1c930660f15e81934c097","observation_id":"29f19624-9fdc-4db3-8a99-70de7104e875","resolution":{"observed_at":"2026-08-04T15:18:07.263704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.20623","last_updated":"2026-06-01T22:34:49Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-04T15:18:01.516373Z","submitted_at":"2025-09-24T23:58:23Z","title":"Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 2 inbound Pith citation observations for arXiv:2509.20623."}