{"as_of":"2026-08-21T13:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1a1caec75c17eb87831b0398862cccbd7ee84e4db4b2ad667b34bd3899aee533","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T04:24:46.357505Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T22:25:22.293704Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.19722","snapshot_observed_at":"2026-07-31T22:25:22.293704Z","title":"arXiv preprint arXiv:2605.19722 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27951","last_updated":"2026-07-30T09:59:08Z","snapshot_observed_at":"2026-08-21T03:44:05.348192Z","submitted_at":"2026-07-30T09:59:08Z","title":"Safeguards Based on Copyable Context Cannot Provide Reliable Safety for LLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-31T22:25:22.293704Z"},"links":{"cited_paper":"/paper/2605.19722","citing_paper":"/paper/2607.27951"},"observation_digest":"sha256:29a44bb98c9ffbcb6e7bcf16f5f146ee4cfc471be8cf2ae415cf277f78ebe4a2","observation_id":"f050463d-cd1d-4e14-9d4e-7d3f342d1085","resolution":{"observed_at":"2026-07-31T22:25:22.293704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.19722/citation-record","integrity":"/paper/2605.19722/integrity","json":"/paper/2605.19722/citation-record.json","paper":"/paper/2605.19722"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":"1eb5b4bc-6f4a-40d4-b195-2169cc76cbb1","year":2017},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:16747021a3117af16ad1524839c32bedbb6e1c7def7d93be7a83fe9bd77e9d3d","observation_id":"220f1528-4a7f-49d4-820b-3050b76235a8","resolution":{"observed_at":"2026-05-20T04:33:23.316205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-16T00:15:57.597094Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":"1909.08593","doi":"10.48550/arxiv.1909.08593","metadata_source":"pith","pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fine-Tuning Language Models from Human Preferences","venue":"cs.CL","work_id":"4f54aad1-f3b6-404f-b9c7-e21ba0a33b99","year":2019},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:831da8c90b9fed37eb46eddbb7081b3130a94237b840b30f47264483e6cf3434","observation_id":"418ad41f-d931-4834-b4f0-24ca7d35dc73","resolution":{"observed_at":"2026-05-20T04:28:05.955711Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-08T21:08:07.78032+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T21:08:07.78032+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ziegler, Ryan Lowe, Chelsea V oss, Alec Radford, Dario Amodei, and Paul Christiano","venue":null,"work_id":"81a1c11e-9074-4c92-a2f6-ab56d2491d59","year":2020},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:3ae24ace16fa31fe86a28734da0da7933147e7145b19a0b7f0b73f8a932487bd","observation_id":"bba8e7d0-162c-4b34-8a43-9543a106f6d9","resolution":{"observed_at":"2026-05-20T04:33:23.319444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-08-10T12:03:10.373653Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":"2112.00861","doi":"10.48550/arxiv.2112.00861","metadata_source":"pith","pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A General Language Assistant as a Laboratory for Alignment","venue":"cs.CL","work_id":"a43f9ea0-01be-47d5-b8ee-a1a9f73381c5","year":2021},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:4c41efaca6ac683e9a9a38a579bbe48c4f2f58740a4454c504498a8d8e90753e","observation_id":"3804f4c3-570d-400c-a2b2-aad6e6729709","resolution":{"observed_at":"2026-05-20T04:28:05.963243Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:13.802987+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:13.802987+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"be5bcb01-9fe2-424c-b443-7d974d01e8b5","year":2022},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:38e81a839188a645c529784a1e7eeb9099b51c45c11f368f95d1c0a2792219fa","observation_id":"f008e3e8-6c37-4891-828e-426bb8eabf12","resolution":{"observed_at":"2026-05-20T04:33:23.308097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":"2212.08073","doi":"10.48550/arxiv.2212.08073","metadata_source":"pith","pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Constitutional AI: Harmlessness from AI Feedback","venue":"cs.CL","work_id":"faaaa4e0-2676-4fac-a0b4-99aef10d2095","year":2022},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:d0c38f4b670674db89f2649fd3a793a695554e3100605552a4d472a59da8a4c4","observation_id":"ec530f60-5bc1-457e-83ff-ee2c48e621fb","resolution":{"observed_at":"2026-05-20T04:28:05.976082Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-15T03:08:13.900899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T03:08:13.900899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TruthfulQA: Measuring how models mimic human falsehoods","venue":null,"work_id":"a694655b-54ea-4138-85e4-e8fc3dab2129","year":2022},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:37d7507fb926f7cc77cdbe2f2b64bed577bc5e1f4a931055aafd66a0d797959f","observation_id":"9c3e0a6e-49b3-4230-8e44-b6d404b88b38","resolution":{"observed_at":"2026-05-20T04:33:23.322490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aligning AI with shared human values","venue":null,"work_id":"9368e4f6-ba32-4d60-ae07-3aa8939dccf0","year":2021},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:81ce865d12276c57785df3901ed3a4f131194f78686624c365bb33d92a6daf57","observation_id":"95ec4f96-4b7a-4caf-924c-c79700b78a70","resolution":{"observed_at":"2026-05-20T04:33:23.312384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-08-09T15:17:43.394064Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"cited_work":{"arxiv_id":"2112.04359","doi":"10.48550/arxiv.2112.04359","metadata_source":"pith","pith_arxiv_id":"2112.04359","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ethical and social risks of harm from Language Models","venue":"cs.CL","work_id":"b4ce1c45-ef69-445a-a872-dbb785b485e9","year":2021},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2112.04359","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:8de161d840a7e93bad2805288dd3e75a35e02574c350d20bed4eae3010148402","observation_id":"cda6f5ab-4562-4c1c-80b1-6d8beda9763b","resolution":{"observed_at":"2026-05-20T04:28:05.949585Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-12T23:50:40.702477+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T23:50:40.702477+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"XSTest: A test suite for identifying exaggerated safety behaviours in large language models","venue":null,"work_id":"2cc2a6a3-d8cb-4a68-bd0a-56188a62e48c","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:b74963975878fc26cc8daa5e1fe32eecab98543128cf494eb189e978a33d81c7","observation_id":"f964082b-0be8-4452-835d-1d262726894a","resolution":{"observed_at":"2026-05-20T04:28:07.407220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"HarmBench: A standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":"52d242c8-be2c-4b77-81cc-a3a54a0a4f58","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:813db8b701f2ea2643aaf6ee36cac95cdc79188e10d39c9450b99ee6200ee24b","observation_id":"b9ad7247-074b-4fde-9dc7-fe6fd2c6d444","resolution":{"observed_at":"2026-05-20T04:28:07.412221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pappas, Florian Tramèr, Hamed Hassani, and Eric Wong","venue":null,"work_id":"a5987b50-c00a-4570-bdaf-db6f8aaca027","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:00c69234d41a5ba4ae5c919625ddc74ff9b75fa22bd82d0ace54e03fa98a92f7","observation_id":"ebc3ab62-8b90-4211-b0dd-f746002d709b","resolution":{"observed_at":"2026-05-20T04:33:23.303464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A StrongREJECT for empty jailbreaks","venue":null,"work_id":"7173d882-b9b9-46b6-bc4a-0f4133b3c1ee","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:6de76070e4ec7f5d24a7faef53efb529770df3ccc97d19223b5113855445c1f7","observation_id":"6e90c35a-427c-4e0b-a388-5e9e9fe3088f","resolution":{"observed_at":"2026-05-20T04:28:07.402133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2307.15043","doi":"10.48550/arxiv.2307.15043","metadata_source":"pith","pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":"cs.CL","work_id":"3322fa86-1768-4677-8425-dd326b45e078","year":2023},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:9446f237dcdf98bac0e273c0a41d85b1adf6ddf4f114a58ab2c11cb625f06200","observation_id":"17527ca2-a382-41aa-b45d-139de78f1618","resolution":{"observed_at":"2026-05-20T04:28:05.969962Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jailbroken: How does LLM safety training fail? InAdvances in Neural Information Processing Systems 36","venue":null,"work_id":"4b4c9f77-9bb4-439f-ab16-d63e21555624","year":2023},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:41b34a49bd4bf587ab30a2b15da5aecc01efb54dc81f7b24a8905eae9466130f","observation_id":"2849437a-18b7-4d90-9859-d3229a6cc7b0","resolution":{"observed_at":"2026-05-20T04:28:07.397419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13161","last_updated":"2024-04-19T20:11:12Z","snapshot_observed_at":"2026-08-19T22:01:43.251521Z","submitted_at":"2024-04-19T20:11:12Z","title":"CyberSecEval 2: A Wide-Ranging Cybersecurity Evaluation Suite for Large Language Models","version":1},"cited_work":{"arxiv_id":"2404.13161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.13161","snapshot_observed_at":"2026-07-08T23:05:44.229651Z","title":"CyberSecEval 2: A wide-ranging cybersecurity evaluation suite for large language models","venue":"cs.CR","work_id":"78dcbaa4-90bc-418c-a587-f93dcd7b9c85","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2404.13161","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:af59160d4c9428e3fd55daaaacaed0263e1a738b8cb9942eb74b2d632d95230a","observation_id":"33321e15-c800-4725-ace6-6b33edf20776","resolution":{"observed_at":"2026-05-20T04:28:05.936380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01605","last_updated":"2024-09-06T18:17:07Z","snapshot_observed_at":"2026-08-19T21:56:58.303635Z","submitted_at":"2024-08-02T23:47:27Z","title":"CYBERSECEVAL 3: Advancing the Evaluation of Cybersecurity Risks and Capabilities in Large Language Models","version":2},"cited_work":{"arxiv_id":"2408.01605","doi":"10.48550/arxiv.2408.01605","metadata_source":"pith","pith_arxiv_id":"2408.01605","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CyberSecEval 3: Advancing the evaluation of cybersecurity risks and capabilities in large language models","venue":"cs.CR","work_id":"0a06199e-9108-413c-9992-d7c4809340ea","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2408.01605","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:b70a86d8ddc32808678c6d7667164e0e0c237d81e17fc57f530092b0ecdf9bf3","observation_id":"1fd1169f-7319-49c8-9434-816def9d1576","resolution":{"observed_at":"2026-05-20T04:28:05.943272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5ef12c93-7dd5-4866-9d09-fd0abdb9d6bc","year":2025},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:60d1aa11b77ce1414f52ebabb7ebd24d7d0257c05e20c503dc9842149c275fa6","observation_id":"41639c6d-07f6-4455-9fcc-daca9c01376f","resolution":{"observed_at":"2026-05-20T04:28:07.378273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"NYU CTF bench: A scalable open-source benchmark dataset for evaluating LLMs in offensive security","venue":null,"work_id":"67b7ad6e-2bd4-4244-967f-91037dfd6e48","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:fd3cb28aa282e377b2e7cf90a76fb8d7df8da48a1b5cd2569179f246be72fd9c","observation_id":"76a31408-5d3c-4e96-98d8-fd9c9e15328a","resolution":{"observed_at":"2026-05-20T04:28:07.369642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jimenez, Farshad Khorrami, Prashanth Krishnamurthy, Brendan Dolan-Gavitt, Muhammad Shafique, Karthik R","venue":null,"work_id":"fe562efa-83a6-4e28-9ef5-c3b0916f45fa","year":2025},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:5d83c12e819ce5461241723f82736e4495f36ba2b80e23b33a8a36e909d120b8","observation_id":"400283d2-2649-4040-8004-be19f07e0161","resolution":{"observed_at":"2026-05-20T04:28:07.374065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SEC-bench: Automated bench- marking of LLM agents on real-world software security tasks","venue":null,"work_id":"a5032e3c-9881-4ebe-89ed-aa64d8faedc6","year":2025},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:d9c6d8ca681f8e4cc6825dcd6b5f6faa34c1c52faf3d39a040d1762e04c4287a","observation_id":"f03c3be7-038e-4f54-a246-c534a2308f11","resolution":{"observed_at":"2026-05-20T04:28:07.383513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AgentBench: Evaluating LLMs as agents","venue":null,"work_id":"b5524dbb-8a3c-40c0-aea5-1ceed4f0312d","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:3fc0d58672a525007afe1620b0419e165f31365668b32600172dce9eda5b4804","observation_id":"27019421-34fd-42fc-86ab-9158bfcfd9bd","resolution":{"observed_at":"2026-05-20T04:28:07.354803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ReAct: Synergizing reasoning and acting in language models","venue":null,"work_id":"6a7fdb70-d554-4261-b13c-8edd9f91924a","year":2023},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:3b94973e7b979d7f7a668998b80c7fbaf884a4d78f9aabf2c815e59d85821f9d","observation_id":"d3b29e2f-9f92-4800-9812-56596e3d0007","resolution":{"observed_at":"2026-05-20T04:28:07.359667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toolformer: Language models can teach themselves to use tools","venue":null,"work_id":"613e21cc-b482-4de4-9e34-7987fbf2fb6f","year":2023},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:74296a09152c5fe996b84ed21919ccf79a30f70e15a69bb477b764999ed1266c","observation_id":"4dfd1d19-94b7-474f-8c4a-e53b2fcb1ece","resolution":{"observed_at":"2026-05-20T04:28:07.364045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"WebShop: Towards scalable real-world web interaction with grounded language agents","venue":null,"work_id":"f7d75b6d-1f3e-44d1-84b8-d930bfb2109e","year":2022},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:9b46e127caa47c9a0a6e5f95438410f74d58ac181c867a52628bb77856e50ea6","observation_id":"a8118503-132f-49ff-905c-f419a7d1f340","resolution":{"observed_at":"2026-05-20T04:28:07.336725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xu, Hao Zhu, Xuhui Zhou, Robert Lo, Abishek Sridhar, Xianyi Cheng, Tianyue Ou, Yonatan Bisk, Daniel Fried, Uri Alon, and Graham Neubig","venue":null,"work_id":"9e59a014-826d-4975-8972-eb725061e1e0","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:c58ebcbeceaab758f7775f1989bcf842c86bb77ba5a3be528dcfc90c5a9da8a6","observation_id":"bfb5362c-a5df-471a-9d0b-4dc59079293f","resolution":{"observed_at":"2026-05-20T04:28:07.345780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InterCode: Standard- izing and benchmarking interactive coding with execution feedback","venue":null,"work_id":"6cdfe137-8fa9-4c94-8d95-be9d7e4e7aa4","year":2023},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:9f12ee8e966e35ab612b633879a9511cdb9e3b9bcf9da2f1308a5c528f70d637","observation_id":"661f81f5-df7c-42f5-8cd3-2737a4dc60ba","resolution":{"observed_at":"2026-05-20T04:28:07.311554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":"09fe33c4-da9a-4c45-a7b3-8b61c5a3af99","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:d97429c46746ca387ee074052a5b18c5febf5ae46357d1f7769ac1064a0903e2","observation_id":"b25b258d-9600-43bd-bc1f-17ddeab392cd","resolution":{"observed_at":"2026-05-20T04:28:07.306636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jimenez, Alexander Wettig, Kilian Lieret, Shunyu Yao, Karthik Narasimhan, and Ofir Press","venue":null,"work_id":"71d9c71d-254e-4133-af8c-ae548a9e5541","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:844fbcc393610b85d2ffc09cc802a28ef5abf7518be809b2865eccfc3eb8298e","observation_id":"4e592cfa-8a6e-427b-aab5-108aa9f137f0","resolution":{"observed_at":"2026-05-20T04:28:07.316366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hua, Zhoujun Cheng, Dongchan Shin, Fangyu Lei, Yitao Liu, Yiheng Xu, Shuyan Zhou, Silvio Savarese, Caiming Xiong, Victor Zhong, and Tao Yu","venue":null,"work_id":"122d0d04-d411-4c0f-b701-68497a21ccb8","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:36420824973e425c49172e80c25ae1613d1549ed7fbdf6f7f104befc396c83fc","observation_id":"1379ec2b-efb3-4963-b406-5bd9979eb19a","resolution":{"observed_at":"2026-05-20T04:28:07.350528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01502","last_updated":"2024-07-01T17:48:14Z","snapshot_observed_at":"2026-08-19T14:24:18.304488Z","submitted_at":"2024-07-01T17:48:14Z","title":"AI Agents That Matter","version":1},"cited_work":{"arxiv_id":"2407.01502","doi":"10.48550/arxiv.2407.01502","metadata_source":"pith","pith_arxiv_id":"2407.01502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Siegel, Nitya Nadgir, and Arvind Narayanan","venue":"cs.LG","work_id":"07877e57-5393-47ee-ae5f-563ff8f9a6b2","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2407.01502","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:210bc9f8bad8799b874053b86158a1c0de91e10ac09c9c904ce2eca40a300e50","observation_id":"2a5617d7-1b01-49d4-84b9-6b9a2a614570","resolution":{"observed_at":"2026-05-20T04:28:05.909030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:07.572928+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:07.572928+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Refusal in language models is mediated by a single direction","venue":null,"work_id":"713118f4-1e8f-4ced-afc1-a29046c667e1","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:6c5a3fdeda4f9b11bc33f90efa007a40566ecec69f0cc022fd235274ce7d3bcc","observation_id":"a0cd6025-45f8-44dc-9a09-b2e67efb4328","resolution":{"observed_at":"2026-05-20T04:28:07.388192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemma 4: Byte for byte, the most capable open mod- els","venue":null,"work_id":"1c297de2-ab65-4cb0-bd26-1da07257c306","year":2026},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:5ba218cd41bfbe940ba18c9bd242f5b94c6107660dfe665201d639e9e090a4ee","observation_id":"f1545e90-6371-4de2-a540-e08bc201e08e","resolution":{"observed_at":"2026-05-20T04:28:07.292643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"google/gemma-4-31b-it","venue":null,"work_id":"61ae434a-588c-4016-b64f-27eab27409f1","year":2026},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:e3d72e2ae63940399230d043dead33555643af8b583e3ec522ffc2fbfc2ae5ee","observation_id":"2de2b40f-a39c-4519-b79a-c3eadddd3639","resolution":{"observed_at":"2026-05-20T04:28:07.296953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"google/gemma-4-26b-a4b-it","venue":null,"work_id":"96d7aa76-acf4-41c4-b384-16ce73d2799c","year":2026},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:1f351b97378e16e1683adbd112e27af00ac49ac6a792f54419ecbce6691e5d18","observation_id":"3bbb32eb-4182-49a3-8793-914da6920925","resolution":{"observed_at":"2026-05-20T04:28:07.301497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemma 4 uncensored","venue":null,"work_id":"f5508dda-c3b9-43e3-8a4c-2bf4d581f761","year":2026},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:574022916edd762c2a5e7001632692bc3e03aa93c42dd6f652611ea4caf3d39a","observation_id":"3a4d70e4-c6d5-4d12-b1fa-3d08fd5ba7a3","resolution":{"observed_at":"2026-05-20T04:28:07.392340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trevorjs/gemma-4-31b-it-uncensored","venue":null,"work_id":"d045e523-5147-4f5e-9a96-5ed24eaf455f","year":2026},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:ac327b18e364cbd3ee26527f2efc2feddbc1db9448cf71c2e10a00c1d67259bc","observation_id":"85347c1c-327a-4c5e-be3a-73aaf70318da","resolution":{"observed_at":"2026-05-20T04:33:23.312689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trevorjs/gemma-4-26b-a4b-it-uncensored.https://huggingface.co/TrevorJS/ gemma-4-26B-A4B-it-uncensored","venue":null,"work_id":"88df1876-cd9d-457c-9c94-ebc9925f7792","year":2026},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:50a4c96b288e80ea2801a1a6f921dbae9bb40432bac816450d02ccda00a82b15","observation_id":"b0b0aa9f-6419-46f4-b3c9-dff5906c0f21","resolution":{"observed_at":"2026-05-20T04:28:07.283158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"unsloth/gemma-4-26b-a4b-it-gguf","venue":null,"work_id":"2b07b7aa-ac55-45ef-b2ce-ac1b548a7463","year":2026},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:3e6dcec6aed5c7c0ab1e21231c0a7ebdb88fc091ce567329ddccacf452bcf82a","observation_id":"f2cc92d1-e814-4abc-b757-27b5bfc4e98a","resolution":{"observed_at":"2026-05-20T04:28:07.287235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trevorjs/gemma-4-26b-a4b-it-uncensored-gguf","venue":null,"work_id":"3fe8c5cb-fca3-48bc-b8c9-9ab350dd34b9","year":2026},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:29368b924aa3a7024d763f2ad64770f011291cf581efafe881456a972b80242e","observation_id":"03a3de1a-533f-4214-99fb-2bbfdb4b912e","resolution":{"observed_at":"2026-05-20T04:28:07.274516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen/qwen2.5-coder-7b-instruct-gguf","venue":null,"work_id":"b9da5639-4f96-4b6b-984e-2b5dc64ab4d3","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:0bd2e5597933dfb0b5332b63f7c8e29bddb02d1cc22f3d5318d10e17df0d3074","observation_id":"32258fff-5d6c-4ef5-adf5-fec5a139efe4","resolution":{"observed_at":"2026-05-20T04:28:07.278713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"bartowski/qwen2.5-coder-7b-instruct-abliterated-gguf","venue":null,"work_id":"f1233de6-387b-4f14-8af2-6ed7baf34b00","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:a85d3a5475ae5b172cc83dc2e89cc3d0fdea28f9d9216abdf3a928bb425c2282","observation_id":"c9f19cfb-eeee-4a94-b47e-adc614e8c540","resolution":{"observed_at":"2026-05-20T04:28:07.269782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"bartowski/meta-llama-3.1-8b-instruct-gguf","venue":null,"work_id":"6dd31801-e235-419e-8327-af7ff26e940c","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:37f642c4289df64ebbdc5fe447903fe4b577ef71763defb187b278f559712edc","observation_id":"fc0af708-fba0-4e45-bec9-b62df1096b9f","resolution":{"observed_at":"2026-05-20T04:28:07.260335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"bartowski/meta-llama-3.1-8b-instruct-abliterated-gguf","venue":null,"work_id":"2be6b3c7-850a-48de-90a3-c4cf4766d748","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:b5580c1a4b5df405aa6c06e4bc19df17d4d8570fc013260f300dc3a3aefdd6d3","observation_id":"ac746392-720e-46d4-8ae3-6314d678a31d","resolution":{"observed_at":"2026-05-20T04:28:07.251233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trevorjs/gemma-4-31b-it-uncensored-gguf","venue":null,"work_id":"5a53631e-3fac-44a2-909d-0133d5ce9aef","year":2026},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:f0345eeefc195687e74e5cbdbdac888b9ecdb6502419206815e1cd5918544070","observation_id":"237585d9-e280-4f38-9eaf-40615192bbf1","resolution":{"observed_at":"2026-05-20T04:28:07.255755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-08-17T08:35:42.452149Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":"2209.07858","doi":"10.1136/bcr-2013-201554","metadata_source":"pith","pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","venue":"cs.CL","work_id":"1aabd84d-3779-4ba9-ba2f-15ce264a9b1e","year":2022},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:5aa03774bfdbe7303694457342f9dae1ac903c8c72b6ee95f0922e2c70095d52","observation_id":"a4bc177a-d148-48e1-bb31-53b4ea71c81c","resolution":{"observed_at":"2026-05-20T04:28:05.888463Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The GEM benchmark: Natural language generation, its evaluation and metrics","venue":null,"work_id":"d2b9b340-1f40-44f3-bfc5-2d589ff6b0fa","year":2021},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:e96ebb0cfc05be943d41096179e0a17310d29ee974aa0773d7fc13a3f76d9874","observation_id":"5536f233-0c18-4819-8a80-64ee0d9fa500","resolution":{"observed_at":"2026-05-20T04:28:07.246895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Inspect AI: Framework for large language model evaluations","venue":null,"work_id":"89fd002a-8020-4c22-8cc4-65a8838d3c41","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:8d90438b658f16ae2147651cbaf762cc096d3a707c2259801b9236edd36554b7","observation_id":"c4e7561d-cf84-46dd-b731-288d3f0d31d2","resolution":{"observed_at":"2026-05-20T04:28:07.264756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13793","last_updated":"2024-04-05T12:26:11Z","snapshot_observed_at":"2026-08-16T14:07:56.490852Z","submitted_at":"2024-03-20T17:54:26Z","title":"Evaluating Frontier Models for Dangerous Capabilities","version":2},"cited_work":{"arxiv_id":"2403.13793","doi":"10.48550/arxiv.2403.13793","metadata_source":"pith","pith_arxiv_id":"2403.13793","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating frontier models for dangerous capabilities","venue":"cs.LG","work_id":"2f7df923-9116-4ade-9fca-e78987af4e53","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2403.13793","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:68c294f698ac7a52be27472bb2c95d680c909fee62f51be560b191fe6e91f0ce","observation_id":"0672b9c5-6fb0-439c-9e09-65e98af93209","resolution":{"observed_at":"2026-05-20T04:28:05.916500Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-08-18T23:10:44.101812Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Model evaluation for extreme risks","venue":"arXiv (Cornell University)","work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:3f5672508ef42159b1ddeca1f9d25b3699024ca0fa944de6d6e0745ce0e06667","observation_id":"ce90f471-643a-4f7f-a4ff-9105b12525d2","resolution":{"observed_at":"2026-05-20T04:28:05.922999Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":"2108.07258","doi":"10.1016/j.specom.2008.12.003","metadata_source":"pith","pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"On the Opportunities and Risks of Foundation Models","venue":"cs.LG","work_id":"a18039e9-928d-47c9-a836-32656a71bf71","year":2021},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:7b892a9912085405125179b45ec4b423d2cf81693ab29eb549c4132e3a1b9d63","observation_id":"529e7e09-8a84-4916-b552-9c5359f675af","resolution":{"observed_at":"2026-05-20T04:28:05.901772Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:22:59.787075+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:22:59.787075+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09203","last_updated":"2019-11-13T03:54:12Z","snapshot_observed_at":"2026-08-03T18:37:05.537362Z","submitted_at":"2019-08-24T20:41:40Z","title":"Release Strategies and the Social Impacts of Language Models","version":2},"cited_work":{"arxiv_id":"1908.09203","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.09203","snapshot_observed_at":"2026-07-09T08:16:05.662858Z","title":"Release Strategies and the Social Impacts of Language Models","venue":"cs.CL","work_id":"d5600a1d-8baa-4d76-a815-1bfc7be1ded0","year":2019},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/1908.09203","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:b1278fd15befed5857f54fcefa58bf36a6f8d3a9876dded6525c4393a4d1f328","observation_id":"8d4e8e4e-0b82-49b3-913e-fe21b06442b2","resolution":{"observed_at":"2026-05-20T04:28:05.929250Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13952","last_updated":"2023-12-23T08:22:29Z","snapshot_observed_at":"2026-08-19T00:56:33.436706Z","submitted_at":"2023-06-24T12:48:49Z","title":"Artificial intelligence and biological misuse: Differentiating risks of language models and biological design tools","version":8},"cited_work":{"arxiv_id":"2306.13952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.13952","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Artificial intelligence and biological misuse: Differentiating risks of language models and biological design tools [Internet]","venue":null,"work_id":"1657dafd-62fb-4d17-848b-26ab1dbe4bf3","year":2023},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2306.13952","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:3cfc13ac1cdf18c9ecdbb12a690b4f070fa78608b89640efca074798ad4268a3","observation_id":"23f97ab3-c3d4-405e-9b4e-e7eda5c8e8a3","resolution":{"observed_at":"2026-05-20T04:28:05.895469Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Common weakness enumeration","venue":null,"work_id":"bebf4fc5-3e52-4354-b8ea-13ca5adf7cb6","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:a3134a581fb63ba2294018a55f498657f4697a5e879720d5804cc9a115315f87","observation_id":"98654d1c-29cb-4718-a0a2-97625e5f0f9e","resolution":{"observed_at":"2026-05-20T04:28:07.242343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OWASP Top 10: The ten most critical web application security risks","venue":null,"work_id":"62a62dff-10e7-454b-a410-ae83ae4696d5","year":2021},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:3c0bf03f5da17ee42b3ecbcde08e48a37a487bf4cd93e7f577a0e2172d632994","observation_id":"fcff3578-61f0-4486-98cb-12060f569178","resolution":{"observed_at":"2026-05-20T04:28:07.228976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"llama.cpp: LLM inference in C/C++","venue":null,"work_id":"8699a110-c786-40d0-ae29-6ae525e698e0","year":2023},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:56ec36a38f591542f31118c348cbf1308ec75a818cd843d2f5c0731f7caf9df4","observation_id":"926c670f-a1fa-40de-b8e9-c4efa0b9b39d","resolution":{"observed_at":"2026-05-20T04:28:07.233038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Hugging Face Hub: Machine learning collaboration platform","venue":null,"work_id":"2b647db5-fa76-45cb-9a94-93e4ca568401","year":2024},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:7c7938f31525415abc6191fc8ffb308045bf8d1a5e8eb6822da34cdcc1b80195","observation_id":"f8821e5b-8e86-492d-9bbc-6d133934d26f","resolution":{"observed_at":"2026-05-20T04:28:07.237863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"JSON Schema draft 2020-12","venue":null,"work_id":"dd5a9a18-ef77-4d97-9012-fafa5c4e63f0","year":2020},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:f7c219ef66e11bcfbb4f8fd09156b2d9a95feb042d4037eb3e239c836088cdd5","observation_id":"c9e4f9ae-021d-4d91-a3bc-c29a28ddec44","resolution":{"observed_at":"2026-05-20T04:28:07.224764Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-16T02:40:10.272246Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":1,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":2,"verified_exact":10,"verified_fuzzy":41},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 1 inbound Pith citation observation for arXiv:2605.19722."}