{"as_of":"2026-08-08T12:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:47ba83374468076526be03af487add98d0306883b2aceb58b72c5e7f9865ee35","coverage":[{"denominator":300,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:04:19.556483Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13175/citation-record","integrity":"/paper/2607.13175/integrity","json":"/paper/2607.13175/citation-record.json","paper":"/paper/2607.13175"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:08.625922Z","title":"2006 , month =","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:08.625922Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:825579056a3caf88e894b802235368734a64335486900625275402806158c7b5","observation_id":"4c8603d5-5b52-4dd2-a03d-2526103f2f2f","resolution":{"observed_at":"2026-08-02T06:04:08.625922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:08.765994Z","title":"Vannithamby and G","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:08.765994Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:dc33cdc62dd6837a62ea7244a806a4c83c3fa095ea7a0ee8f867e0c09f69b269","observation_id":"ae618ba1-5893-4951-8e16-8ecba56e89f5","resolution":{"observed_at":"2026-08-02T06:04:08.765994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:08.911412Z","title":"Aalto and P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:08.911412Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:b1e717f8304c1eb55fa1893fac2bd42ed220e339b4b7d038c0f9446176b65498","observation_id":"a7cb61dd-ff88-4c00-a204-7e5b93a3bfcb","resolution":{"observed_at":"2026-08-02T06:04:08.911412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.041108Z","title":"and Lassila, P","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.041108Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:aa562fb9f7e7ad9ab6b251a42202ebcfb4ab50b06972c2f971a476e176e19b17","observation_id":"a837212c-44b5-4fcd-a92b-93dcc4247e84","resolution":{"observed_at":"2026-08-02T06:04:09.041108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.299074Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.299074Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:5c3cd07bcae3d6710d995c53d3b2076b05713dec66249db07b108f86757821d7","observation_id":"688cc3c4-16b1-4377-863a-5a28336fe0d9","resolution":{"observed_at":"2026-08-02T06:04:09.299074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.412883Z","title":"and Yi Lu and Campbell, R.H","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.412883Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:f70ad0f19b25165f5cae02157285d1ea878aefbe356dc0c7b6bccefb7597774e","observation_id":"5063c6d9-3b8e-44bf-b831-bbad4bbbac79","resolution":{"observed_at":"2026-08-02T06:04:09.412883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.635646Z","title":"and Cuomo, F","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.635646Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:f75b77d9dbf7f45394e679fb0bd074fdc30043c9aec2d6936b94d8b428e2bb26","observation_id":"68ef79c5-f1da-41b7-8dd8-cfd43449a7d9","resolution":{"observed_at":"2026-08-02T06:04:09.635646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.794360Z","title":"2011 , volume =","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.794360Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:0cf8517e571c814871a82b46346c6532b76f4489113963a69f29da4eb0f14ee0","observation_id":"df7e729e-ea7d-40eb-9648-5081c03f0de5","resolution":{"observed_at":"2026-08-02T06:04:09.794360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.994609Z","title":"Abe and A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.994609Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:fd389ad6bd6a8df2fd48e7ee8a9e1c63b38dde0221d034b92d294e06e771820c","observation_id":"b7bb6c77-86eb-4c1f-817f-03de150793b6","resolution":{"observed_at":"2026-08-02T06:04:09.994609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.135232Z","title":"Abrams and H","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.135232Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:1f84aa0cccecce75d1419eb677155f81532e5a0a1a54f0c166ffb4f74a7db552","observation_id":"3f25818e-e19e-4fa1-a3c7-bb3a2e22a5ab","resolution":{"observed_at":"2026-08-02T06:04:10.135232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.365566Z","title":"2006 , pages =","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.365566Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:64885327470e401a29f4e93e66a298887b1781dd0837922544561fce353c5153","observation_id":"632a313a-f844-40a5-948f-745cc3494af6","resolution":{"observed_at":"2026-08-02T06:04:10.365566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.561373Z","title":"and Lobel, Ilan and Ozdaglar, Asuman , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.561373Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:2aa5600d4ce1964dcfc2a1b3fe0c32b808f4fc1d2559c79270f162c76fa4398d","observation_id":"79d6d9cf-a76f-45de-946a-3f430510df47","resolution":{"observed_at":"2026-08-02T06:04:10.561373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.700343Z","title":"Adireddy and L","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.700343Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:a19adc23f45f23a03934d7fba94d7448ee91d2783064f82dabb5a5df676953eb","observation_id":"e36e8d99-5011-4ccd-9783-34b7927e37c1","resolution":{"observed_at":"2026-08-02T06:04:10.700343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.799359Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.799359Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:11726566470b7bee045f9103ad9c8dbb2816e6c01f5efff94200e19e4ce0d5ee","observation_id":"cffe906c-d405-4afa-90aa-790d7c972d69","resolution":{"observed_at":"2026-08-02T06:04:10.799359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.940933Z","title":"Aeron and V","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.940933Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:c3088fbc6e6dcc331adf96474ee54a2d82fff0c9fbbf21fa16774ded7cd5e285","observation_id":"c2de790b-2f25-411c-a398-74f0eab1d4ea","resolution":{"observed_at":"2026-08-02T06:04:10.940933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.120227Z","title":"Agarwal and P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.120227Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:248da15fde164c89576d0f0debca31232c102b70e8cffaa2670362c2e17b095c","observation_id":"a8eee2ef-5021-4e02-9f50-9dc066bf13be","resolution":{"observed_at":"2026-08-02T06:04:11.120227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.215987Z","title":"SPIE Optical Engineering and Applications , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.215987Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:52fba30b960bdc3638383f0583461ddb6a22824bf28158d8cb0ac3c8d2cd5e64","observation_id":"8190dfb5-e08f-461e-8c8d-dd6a9ecaa995","resolution":{"observed_at":"2026-08-02T06:04:11.215987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.414166Z","title":", title =","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.414166Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:3ccbe0cf31236e7c97f393bcaf00dff33b45c9a737812ee43a488a8d96596d56","observation_id":"15e0dbae-b0e1-4e4e-89d1-19af64f1b687","resolution":{"observed_at":"2026-08-02T06:04:11.414166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.551874Z","title":"2000 , pages =","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.551874Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:bee65839d16a43a57af17bae6097ccba538c3b3eec31b65f5d38addbc57c232b","observation_id":"37fede57-5c6b-4c1d-b27c-54425cc42ae3","resolution":{"observed_at":"2026-08-02T06:04:11.551874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.746537Z","title":"Ahmad and U","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.746537Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:13c99673bf0beceac50109432c8e6225d059d69c79ad01745cfe1c3b77009c84","observation_id":"ff3f3581-7403-4d78-9359-b130ddf410d8","resolution":{"observed_at":"2026-08-02T06:04:11.746537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.860950Z","title":"Aikat and J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.860950Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:95a31c2553bb8e628c616b423152955c072608c0792636e5bdf3d2328ed62670","observation_id":"787e20b8-d83f-4a65-bcfe-7bf14ab49391","resolution":{"observed_at":"2026-08-02T06:04:11.860950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.970727Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.970727Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:f31bcab1247391cbd90a0e1c735c81b41608d1dd7a80e9ca56f23b9698e8900b","observation_id":"bb56f219-18e7-4e71-85d3-884eac12d014","resolution":{"observed_at":"2026-08-02T06:04:11.970727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.097602Z","title":"and Tanaka, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.097602Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:0bfaa285b60f6360078320a5f8c09ff5da3576444065e8e6d8ad70557258c7cb","observation_id":"5e11333d-69ee-4593-87f7-9fd867ad6300","resolution":{"observed_at":"2026-08-02T06:04:12.097602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.287285Z","title":"and Andrews, M","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.287285Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:abec93be62d6228ad480a51d0dc6c8df804a68a3489dbf6af94e8d8afe0c4a28","observation_id":"169222a4-b3e8-448d-a4ee-4bd9608bf441","resolution":{"observed_at":"2026-08-02T06:04:12.287285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.347909Z","title":"and Lee, W.Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.347909Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:36fece6a24810973d179ee67eda22c7a32597a1c1aa0aaf0d8184a8b63b5e76a","observation_id":"f19fbb37-1c98-4be7-9656-9f3e38713484","resolution":{"observed_at":"2026-08-02T06:04:12.347909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.404951Z","title":"Albert and H","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.404951Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:2f6201b8240cd497323811166f763f0fbbb4ff39158b8758a187b90c709df51e","observation_id":"9c5633b1-983d-4b2a-9bcf-04773c6996ff","resolution":{"observed_at":"2026-08-02T06:04:12.404951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.454084Z","title":", title =","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.454084Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:b7acaa271b2273f93e2c2b4bde0e2774b3a86ada5b112b7963ec0b2274cb0670","observation_id":"49f983a9-4bb5-4171-b066-d110a3a8eb44","resolution":{"observed_at":"2026-08-02T06:04:12.454084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.540529Z","title":"2008 , pages =","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.540529Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:da357271d3de2b8796ce8d0d125ec944f2baeaed8cb3aae91a079b65dc2ef48d","observation_id":"c91ed57b-a98b-4587-afed-2e4427a80a87","resolution":{"observed_at":"2026-08-02T06:04:12.540529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.617663Z","title":"and Basar, T","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.617663Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:7c022eed6401208ba0b0fca0aa7d31a778df9c38cc0becdc3cd17bfac28920f3","observation_id":"e47c07a4-c338-45be-b0c0-a80f38bdbe86","resolution":{"observed_at":"2026-08-02T06:04:12.617663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.677699Z","title":"and Basar, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.677699Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:406b6e1081f36d4e82eca123e89eaf7f9f60ea2e6488464ae6f83eaa63a5d97a","observation_id":"34107c31-ced3-467f-893a-b6669fc1419f","resolution":{"observed_at":"2026-08-02T06:04:12.677699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.762909Z","title":"Differential Privacy: On the Trade-Off between Utility and Information Leakage , booktitle =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.762909Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:158077cd4dac35073564dd086af2decf4747c79efcc50a36252346ce4c293f7e","observation_id":"469da460-f314-4bbc-a2d5-e62cd65e2c1a","resolution":{"observed_at":"2026-08-02T06:04:12.762909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.909554Z","title":"User Modeling, Adaptation, and Personalization , publisher =","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.909554Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:010d84d8c1cee26e032fe79802dc285c325f3ed3f5be7f328306231260c689c4","observation_id":"861a84f8-a423-43fd-ad19-fbbdea7db818","resolution":{"observed_at":"2026-08-02T06:04:12.909554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.028168Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.028168Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ef3043801e5e6899122ff701cd005e3bccfee5ae792bf9dd9606a99cc3d9fe0c","observation_id":"02ff49a2-f345-4a03-b7ab-6db954f665e3","resolution":{"observed_at":"2026-08-02T06:04:13.028168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.138310Z","title":"2011 , pages =","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.138310Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:f0ea383fa23eae60a5c33ff82f909587900aa094f2fa479a0749db0e2ef3029e","observation_id":"d66f9912-f1e0-4198-bd4c-86d5b2fe49a0","resolution":{"observed_at":"2026-08-02T06:04:13.138310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.282698Z","title":"Probability in the engineering and informational sciences , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.282698Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ce316bb820e77d562c310ff515eece4d44476e94a18a45af2c15c6e35ff51eb8","observation_id":"e8f502c8-d5d3-4180-acbd-25a8072525e5","resolution":{"observed_at":"2026-08-02T06:04:13.282698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.406649Z","title":"2012 , pages =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.406649Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:43347b1bed5d9536689d62f3dfab89d2d1d130c03fec07aefea4febd4b2ef290","observation_id":"c89e53ca-707d-4d92-ad96-94ec7ff22966","resolution":{"observed_at":"2026-08-02T06:04:13.406649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.516834Z","title":"2010 , pages =","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.516834Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ef0386d5b7759a41b8fa3f699113fb4be1b1762c39e8302573349b8a357f6eb4","observation_id":"6c28ebf1-7573-43da-8c1f-f407822589b9","resolution":{"observed_at":"2026-08-02T06:04:13.516834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.694115Z","title":"Anderegg and S","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.694115Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:969e62d45285e57cdba2908b6bba3e87a2bda0342f536cdface2cc1d7c7c431f","observation_id":"0c05e812-0542-4557-a627-d694de35c9b5","resolution":{"observed_at":"2026-08-02T06:04:13.694115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.810670Z","title":"Andrews and K","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.810670Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:fd8ba96234e6eed469b9afcee6cb41a89cda7467b7f2fd3ea6a2468bcdff3b84","observation_id":"05866463-389f-4184-887a-4a50154395ca","resolution":{"observed_at":"2026-08-02T06:04:13.810670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.923630Z","title":"Andrews and K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.923630Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:86649ca1fc1e8cbd8bc78175e62606269fa67ff9947ef87fdb222c2fa3fdd810","observation_id":"bf7ccf9a-7bb7-49dc-b64c-d92dbcfb4198","resolution":{"observed_at":"2026-08-02T06:04:13.923630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.035280Z","title":"and Shakkottai, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.035280Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:54e36988ea6947233b564543192a49cba03fb4914eab28a1adfdf1ccde8e3c15","observation_id":"9c49e957-6811-47ca-abe7-21400a150e67","resolution":{"observed_at":"2026-08-02T06:04:14.035280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.158580Z","title":"Anshelevich and A","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.158580Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:9c077f9e8306ebf4357b6278e6c824982a714776dfa90f9b4280f0ff76918529","observation_id":"b0df3807-5dee-4327-aba1-2fbeb4087e55","resolution":{"observed_at":"2026-08-02T06:04:14.158580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.289746Z","title":"IEEE Data Engineering Bulletin, , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.289746Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:560379351e1a7f4fbab2357da464d6d03f154d867a9c8099837d9efc368d41f7","observation_id":"5055f825-da3e-4e78-b567-6ed16be29e57","resolution":{"observed_at":"2026-08-02T06:04:14.289746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.361404Z","title":"2013 , pages =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.361404Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:4dc4f2abd88b3f014abb5b4024f5a667f5550004988e742486d1583dad407691","observation_id":"283774b5-fd62-4a78-b15f-aaf6c033ae41","resolution":{"observed_at":"2026-08-02T06:04:14.361404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.454040Z","title":"Arisoylu and T","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.454040Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:6a0bc88fb53b4cdc3b6d5d141f8ae7ab52b652f3fba0b5634f2f31aefb21397e","observation_id":"6a551fc5-2b78-494b-afe5-4604bb35a652","resolution":{"observed_at":"2026-08-02T06:04:14.454040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.538714Z","title":"Armony and N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.538714Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:b53ada6bd5d4692e99496cabfa4ef5855fdaabba3c3aca971e41daacc12833c5","observation_id":"c9bb1e1c-188e-442a-be77-fb951f13a9ba","resolution":{"observed_at":"2026-08-02T06:04:14.538714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.628792Z","title":"and Fox, A","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.628792Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:1474d14e6ba32a55ddcb783b09b681c64ea7cf322dcddc7ac8ce7f024d4ae9bb","observation_id":"fd3aa400-7860-49a8-9b09-836c00375df4","resolution":{"observed_at":"2026-08-02T06:04:14.628792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.725088Z","title":"2003 , author =","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.725088Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:09304bfa3bed91cb59fe3ac8ca718374d5acacc9cb44d500a8770b360b9aa1ad","observation_id":"2626532b-dc29-4587-9a27-21f461bdac14","resolution":{"observed_at":"2026-08-02T06:04:14.725088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.810048Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.810048Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:49f0c0c23f0528ead33c94415736faf3b0d93b47bd3a21d51d0781bf809f3406","observation_id":"136274b2-1547-4062-a1ac-b54264d2ba4d","resolution":{"observed_at":"2026-08-02T06:04:14.810048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1005.4984","last_updated":"2010-05-27T04:31:05Z","snapshot_observed_at":"2026-08-03T09:59:44.036329Z","submitted_at":"2010-05-27T04:31:05Z","title":"Backpressure-based Packet-by-Packet Adaptive Routing in Communication Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1005.4984","snapshot_observed_at":"2026-08-02T06:04:14.873411Z","title":"and Bui, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.873411Z"},"links":{"cited_paper":"/paper/1005.4984","citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:2850582818d96ecd31adeca601d05789d2b210be7583da2b0f23bc1f74ea53b3","observation_id":"0e3fad15-f6e8-4c7d-9971-f3476280fc85","resolution":{"observed_at":"2026-08-02T06:04:14.873411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.979593Z","title":"and Bui, L","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.979593Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:27718d8568264609d46ecd1a690b17fa888401dbccae486913eacf38d4aaadf4","observation_id":"19b4219f-30bb-4e22-973c-f70ce659618c","resolution":{"observed_at":"2026-08-02T06:04:14.979593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.051956Z","title":"Athreya and Soumendra N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.051956Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:e0b68eb34d99853325db9402018970e555ef4aa94c6e1fd5f0e4dac6b1d99e26","observation_id":"0eafb62a-cd9b-4c27-b61c-56b063b84de6","resolution":{"observed_at":"2026-08-02T06:04:15.051956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.129303Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.129303Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:e91187e318ddc0ee75467199036874dec4f75c97de410803e253c432986ae619","observation_id":"ebebfd89-85cc-4d55-b990-746c5a213564","resolution":{"observed_at":"2026-08-02T06:04:15.129303Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.224815Z","title":"Auer and N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.224815Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:30649c603f3d80dd4294ec133819533d382489256e30fc97084700068f0ffc25","observation_id":"3f9908d8-5b6a-4225-bc7e-ac1752385d24","resolution":{"observed_at":"2026-08-02T06:04:15.224815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.301641Z","title":"and Azar, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.301641Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:826c6acb2d088056399d1178b96f3358cfc5088ee56c712fc6622cf7dc59441f","observation_id":"176229f4-e003-4c86-b9d5-9acb5c4591df","resolution":{"observed_at":"2026-08-02T06:04:15.301641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.397428Z","title":"Axelrod , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.397428Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:79ca89599371d33c3e0df89409113527841975958ba5dff1cd040b998e0ae72d","observation_id":"d7b1ba66-3e1a-4f4d-a2ea-7d5e661278ae","resolution":{"observed_at":"2026-08-02T06:04:15.397428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.520890Z","title":"and Erausquin, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.520890Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:2d2695a296c175f2a3d9f7be2459e8711fc32736f5cfe9bd9e50114f7f38a175","observation_id":"8edb92c6-90ee-41f6-a386-d03dc6141e56","resolution":{"observed_at":"2026-08-02T06:04:15.520890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.599051Z","title":"2007 , pages =","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.599051Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:88ecc2b0fddfb931fed8b4b91dcf76e6e8ca6f2b505ce39f520dcfa7523f47e1","observation_id":"f6680a55-bb69-4cab-923b-73bbce69357e","resolution":{"observed_at":"2026-08-02T06:04:15.599051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.717037Z","title":"2009 , author =","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.717037Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:4aa8ec1c97a0d03d3b8f49f540a845c8f33d940a9d833d90d684bf155a596257","observation_id":"a58b0d77-cc57-4fc9-b58a-9c579ba17a8e","resolution":{"observed_at":"2026-08-02T06:04:15.717037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.772179Z","title":"and Khude, N","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.772179Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:199fb507adf3b6a6c19a6c4a68598e351045378ef17c0cf8d1b3737341fa4326","observation_id":"6b42d9af-64ce-4474-9fec-e67a7170dedc","resolution":{"observed_at":"2026-08-02T06:04:15.772179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.833044Z","title":"and Li, J","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.833044Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:569cf6913b0adce60e46bdcbd75a6cf4c10b1b9ab3fe2505244bd834939fefd2","observation_id":"b9d781f6-d5cf-4bf8-83fb-c1ff8174ce1e","resolution":{"observed_at":"2026-08-02T06:04:15.833044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.931118Z","title":"and Har-Peled, S","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.931118Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:7d92871ca92d3a50f8e2101232356c36a9006b611c65ba481c871274439f65f6","observation_id":"0da3e92f-51c1-48f7-8db1-ed0042e88985","resolution":{"observed_at":"2026-08-02T06:04:15.931118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.012285Z","title":"1975 , author =","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.012285Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:5198aeed470da872e690e0cfad135259f7e620b5ec300d1675bd14a86921f49a","observation_id":"3301aafc-16b2-4e3f-a297-ef2752bc8b3b","resolution":{"observed_at":"2026-08-02T06:04:16.012285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.081212Z","title":"Ballester and A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.081212Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:d7791b8e885bcb253dd783d9689c1cdcfef283ac90adab1c9c0e1234558a28be","observation_id":"609679b3-bc8a-4dfb-bc29-a7f9eebd9ee0","resolution":{"observed_at":"2026-08-02T06:04:16.081212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.183732Z","title":"Bala and S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.183732Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:5054c7dcbc63e0f00dd6363ebfd742f664978da29f576d6bc5ba7f2d9ed925f5","observation_id":"0563b8e8-2ce2-4973-b564-db9fea259e7e","resolution":{"observed_at":"2026-08-02T06:04:16.183732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.240413Z","title":"Balasubramanian and B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.240413Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:f8e8994895d1d4ebb9d7170f221d41a73ae9cf46e0964702a7fff50b59619290","observation_id":"dae56b26-db04-456e-9ab4-aeb21813e6c5","resolution":{"observed_at":"2026-08-02T06:04:16.240413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.303912Z","title":"Bansal and M","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.303912Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:3b3bc2d84ca5dc05305c7aa18e0e838fd04c02ec2dd37ee4f1761390eded89e0","observation_id":"f7558ef4-ff41-48ff-84e8-2d8cb24420e4","resolution":{"observed_at":"2026-08-02T06:04:16.303912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.429777Z","title":"Bansal and Z","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.429777Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:1900bdcf6d78e248ef4ad97eaa5d00a5c2c0845fd4873ee7f9c7d157fa50bcd0","observation_id":"9a59eb14-02e8-4529-abaa-40f93a9ef665","resolution":{"observed_at":"2026-08-02T06:04:16.429777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.518600Z","title":"1988 , pages =","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.518600Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:1930e54068fa161989db7f0866484d67e1b8677941fc0c7434d4370f6fccc960","observation_id":"b71be42e-eca4-4c88-8a9a-a19b91e03d0f","resolution":{"observed_at":"2026-08-02T06:04:16.518600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.631888Z","title":"Barabasi and R","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.631888Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:8178d713d879e5729364f3d0c62724db120b6020b8e08252a77cbe7ead4014dd","observation_id":"4f9a312f-86d0-403e-8ca3-4c337fd43f8d","resolution":{"observed_at":"2026-08-02T06:04:16.631888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.760955Z","title":"2005 , publisher=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.760955Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:73566a26a3a58b3a36bad3a0769c96e38b03348ef0f46183c086523d2692b22c","observation_id":"15e25146-9512-4ba8-9bfe-c573d94761bc","resolution":{"observed_at":"2026-08-02T06:04:16.760955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.834924Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.834924Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:b54a50484d0d7c64ef7e910bc5395acf34abee2b5c64973549d9ea2eb020c630","observation_id":"50161783-c97f-4a2d-8eb4-5117b7d2b6e4","resolution":{"observed_at":"2026-08-02T06:04:16.834924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.895671Z","title":"Journal of statistical physics , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.895671Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:4bb5064dc90f2189722cf2f790400ca977d2360244472d0258beb0239dfef9ff","observation_id":"bf7cdbdd-22ce-4668-8dcd-79671806b9e9","resolution":{"observed_at":"2026-08-02T06:04:16.895671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.021934Z","title":"New York Times , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.021934Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:82d65d8e51036e6bbabeb173084c0ddf19fdaae96ec37b5f911aae32125d3aa5","observation_id":"f8971c78-0e6e-41a5-b3fd-712cf826958a","resolution":{"observed_at":"2026-08-02T06:04:17.021934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.108948Z","title":"2015 , pages =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.108948Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:45b17a1c8173379e3be4a2bc9a7631271ff3a7baf4a6c1c2e4f691fb3d6158d0","observation_id":"e2924e32-7b66-440c-94f3-077f9a2446a8","resolution":{"observed_at":"2026-08-02T06:04:17.108948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.270521Z","title":"Bayati and B","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.270521Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:23aff01a87defff645c1b3714f4ed5fdc3cb83ec52c892c2c26bb8df836b8814","observation_id":"cbb163a7-20f5-42ad-abb2-1ebfe5b707e0","resolution":{"observed_at":"2026-08-02T06:04:17.270521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.441014Z","title":"Bayati and D","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.441014Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:813f6bce90c494b9d21c1ffb27d24f7b171dac234c754397ddd931212846a591","observation_id":"811b2d1e-aeba-4914-9224-d1d5817248cb","resolution":{"observed_at":"2026-08-02T06:04:17.441014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.609612Z","title":"and Buyya, R","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.609612Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:a07719a504903c9cd817fcdbd24726478382af0acea09b1a00e8fe6ad6f6c732","observation_id":"9e9a3496-5c3c-4497-9af9-ee181b1d4d05","resolution":{"observed_at":"2026-08-02T06:04:17.609612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.704877Z","title":"Benson and A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.704877Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:b0c3728e5e493da0b54d38971a868178f7e9e7c8b0c5ebbf6456495354bdef46","observation_id":"88430f98-4aa4-493c-af01-85793da0cb7b","resolution":{"observed_at":"2026-08-02T06:04:17.704877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.799918Z","title":"Approximating st minimum cuts in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.799918Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:b6a4ca154351c3310131b26f10d3b0f503df488191f9aa9d90b318747f2fcbeb","observation_id":"2a0d5376-8006-43b2-b469-386709ff1c70","resolution":{"observed_at":"2026-08-02T06:04:17.799918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.877954Z","title":"and Peres, Y","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.877954Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:6813d624fffdc32df6142911a18e9dd10e8eb0555753f27024158c518ca0872e","observation_id":"6b4410dc-2727-4161-8420-2a978268a7a7","resolution":{"observed_at":"2026-08-02T06:04:17.877954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.983602Z","title":"1999 , author =","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.983602Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:a5993d148126f72c4860318d4d3aaed59164b0463d622bcd16235d65c7a88639","observation_id":"56aa69d9-3347-4056-969b-6a36720dc391","resolution":{"observed_at":"2026-08-02T06:04:17.983602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.068315Z","title":"Berry and R","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.068315Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:a27fdb65184d175e5ad9dcbb7ac66ca2515f96b46309d48938bcb219362d94b3","observation_id":"7c0aec66-550c-4cbf-83c3-cbba05b40c59","resolution":{"observed_at":"2026-08-02T06:04:18.068315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.193385Z","title":"Tsitsiklis , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.193385Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:8e20c166217be1ef215463f253888455ee743bef508a6c1f5a095faa1e1506ba","observation_id":"d3bcc715-c306-402d-83a4-a612ee561d31","resolution":{"observed_at":"2026-08-02T06:04:18.193385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.301027Z","title":"Bertsimas and I","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.301027Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:6cac357deb0c01b06f12e942da8be2a3d013319e49a04567793892bf1a48b3e9","observation_id":"8da07777-6d20-4ac2-83c5-95e3a116b5cf","resolution":{"observed_at":"2026-08-02T06:04:18.301027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.371362Z","title":"1989 , author =","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.371362Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:34d4a34b744d1ec7d0eb2cbc5149c635871b256e0c0d94ddec4ae29d49c9d9e3","observation_id":"e9529b78-4264-4d8c-8287-4f56dd9d0e61","resolution":{"observed_at":"2026-08-02T06:04:18.371362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.451414Z","title":"Bettesh and S","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.451414Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:9d1df09a4c74bd3b9698d8fe6c494d073a80a91f2e9de98df2b36d18927e83dc","observation_id":"372810ff-5237-41c3-9d97-f085495e8884","resolution":{"observed_at":"2026-08-02T06:04:18.451414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.543985Z","title":"2012 , pages =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.543985Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:9bf7346d1f7ce4a501ff337a14ebe60e43b13f68275fc0e63f54bee09c867700","observation_id":"5df734fd-738d-4862-b8de-8a918a01843d","resolution":{"observed_at":"2026-08-02T06:04:18.543985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.639254Z","title":"and Kempe, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.639254Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:1c09b7c9f2bfe67294282762ae03de2c8065fc8bdf9473e0f6d2a69769d54447","observation_id":"de1299f4-d256-4c5f-9e1c-c9b24a976f30","resolution":{"observed_at":"2026-08-02T06:04:18.639254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.729603Z","title":"Bhatia and M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.729603Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:724ffbb42a9f2518d5882604f74a657d695258bde301d275e264b9ca78a478e1","observation_id":"dfb5c7d7-71ce-49ef-8c93-fcdb663787a9","resolution":{"observed_at":"2026-08-02T06:04:18.729603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.793978Z","title":"1992 , volume =","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.793978Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:3a9e7f9f8992686ff95dbad90d31693b2f143f359345867551d989830e914f63","observation_id":"935496b1-c7b0-4f03-9119-bd81885e1824","resolution":{"observed_at":"2026-08-02T06:04:18.793978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.865807Z","title":"Philadelphia: SIAM , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.865807Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:f73d680369f0e6a2f6e9347c9762b5f341bde676d470463679ec14c9fd5c66e9","observation_id":"941aac58-9acc-437c-8602-5951ae507ef9","resolution":{"observed_at":"2026-08-02T06:04:18.865807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.936267Z","title":"2012 , volume =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.936267Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:5a3aac578461557074e3cd2c55c1fff38f40862fc3f83b4089724366ac740ac7","observation_id":"c2ecb0f1-d1a5-4ebe-a1e2-28e232175e5d","resolution":{"observed_at":"2026-08-02T06:04:18.936267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.007925Z","title":", title =","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.007925Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:444c0bf4534a9dff68cc6617e8d7a807f999073339a4653822003a60880e0983","observation_id":"0c2e3827-8a14-488d-be06-d96e4cd90697","resolution":{"observed_at":"2026-08-02T06:04:19.007925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.065012Z","title":"PRISM: Privacy-preserving Search in Mapreduce , booktitle = pets, year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.065012Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ed42e61fc72b015d494da31bbfd755fe0a4a11fa8327b65bd5319508887aab2e","observation_id":"d6633261-bf71-41c7-92e3-ade282c8c007","resolution":{"observed_at":"2026-08-02T06:04:19.065012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.156515Z","title":"2012 , pages =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.156515Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:0684a01bb38c7d203e4deedbff7fb89d0aee5ef43a9e58ba03b87b6a3844c6c0","observation_id":"facc538f-ba2e-44c2-a488-3c4b21a40cf2","resolution":{"observed_at":"2026-08-02T06:04:19.156515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.269152Z","title":"2005 , pages =","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.269152Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:6d37b71ee7576befeb4103fa84a09ac8592e89c71ea0a4b62c8dce24fdbb6416","observation_id":"75411e66-7539-43b2-a112-e8a13fad4c9e","resolution":{"observed_at":"2026-08-02T06:04:19.269152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.386954Z","title":"2008 , pages =","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.386954Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ec58637a8e60ae5fa443ceacd57e8f9039258920537f088ce91fab9033544b25","observation_id":"e845c56c-c650-4136-8355-364bf758c1a5","resolution":{"observed_at":"2026-08-02T06:04:19.386954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.482043Z","title":"and Kochut, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.482043Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:b4917a06a0d8f3821fa3ceca5e26fabb022b7996bde5b2ebb981812e49bc602d","observation_id":"8233ae83-09de-4230-97d6-5d4c131eb1f2","resolution":{"observed_at":"2026-08-02T06:04:19.482043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.556483Z","title":"Bodas and S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.556483Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:2d7808d21d7ac69818fa34a5c3b9a1f2f01d32327bacff85e70b27e26b39c482","observation_id":"c0fd3d80-76b2-49fa-ab56-33e43f7c3d5f","resolution":{"observed_at":"2026-08-02T06:04:19.556483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T06:04:02.287963Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":99,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":300},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 300 outbound references and 0 inbound Pith citation observations for arXiv:2607.13175."}