{"as_of":"2026-08-20T19:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:394f1b4accf0a9487cd3e8d7ed81d1f987e768eef6939a1b2ebc7e46bfcaa4d8","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:04:21.557975Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12851/citation-record","integrity":"/paper/2608.12851/integrity","json":"/paper/2608.12851/citation-record.json","paper":"/paper/2608.12851"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.378849Z","title":"arXiv preprint arXiv:2508.19005 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.378849Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:1457f0c6902406cc60b86882a858e9e7cfb02c773017bf61809fe6a03b4e6661","observation_id":"29f65e75-4bb1-4a2a-a451-b13130a6f68e","resolution":{"observed_at":"2026-08-15T22:04:21.378849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.02947","last_updated":"2026-04-03T10:29:31Z","snapshot_observed_at":"2026-07-29T16:09:43.498926Z","submitted_at":"2026-04-03T10:29:31Z","title":"AgentHazard: A Benchmark for Evaluating Harmful Behavior in Computer-Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.02947","snapshot_observed_at":"2026-08-15T22:04:21.383625Z","title":"arXiv preprint arXiv:2604.02947 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.383625Z"},"links":{"cited_paper":"/paper/2604.02947","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:396a826b1afd0d35e27e89c90719a1dbf41e724ce41f2819c8f35b9f3aa84043","observation_id":"ec77adfb-9972-4ccb-a22a-78dad98c22c1","resolution":{"observed_at":"2026-08-15T22:04:21.383625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.11698","last_updated":"2026-07-13T15:31:04Z","snapshot_observed_at":"2026-08-15T22:28:44.810757Z","submitted_at":"2026-07-13T15:31:04Z","title":"Agent Hacks Agent: Autoresearch for Production-Agent Red-Teaming","version":1},"cited_work":{"arxiv_id":"2607.11698","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.11698","snapshot_observed_at":"2026-08-15T22:04:22.179051Z","title":"Agent Hacks Agent: Autoresearch for Production-Agent Red-Teaming","venue":"cs.CR","work_id":"c60c05ca-bd66-4ccd-b8c6-eb5ca37bbdc8","year":2026},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.388115Z"},"links":{"cited_paper":"/paper/2607.11698","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:f18034396689b5aa0a3f290e016a7f2dbc3ac9f23ca2481a116724c458a95618","observation_id":"935a8678-c07a-4d8b-b237-262c2f006817","resolution":{"observed_at":"2026-08-15T22:04:22.185660Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12015","last_updated":"2026-05-27T06:26:15Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T12:03:54Z","title":"SkillSafetyBench: Evaluating Agent Safety under Skill-Facing Attack Surfaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.12015","snapshot_observed_at":"2026-08-15T22:04:21.392228Z","title":"arXiv preprint arXiv:2605.12015 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.392228Z"},"links":{"cited_paper":"/paper/2605.12015","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:0007d5215d2575b63edff46dea3111b21333dd94a031ca4e103713c3b2ce3f96","observation_id":"76cbcabd-9f83-48db-a73f-a21e62dc0256","resolution":{"observed_at":"2026-08-15T22:04:21.392228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07131","last_updated":"2026-06-19T05:32:49Z","snapshot_observed_at":"2026-08-14T06:21:20.449752Z","submitted_at":"2026-06-05T10:43:19Z","title":"MalSkillBench: A Runtime-Verified Benchmark of Malicious Agent Skills","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07131","snapshot_observed_at":"2026-08-15T22:04:21.396643Z","title":"arXiv preprint arXiv:2606.07131 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.396643Z"},"links":{"cited_paper":"/paper/2606.07131","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:d198c6f5e9979f04441258f6d6e86ef40becbf343ed607e4f16cd803083cb9e8","observation_id":"876f65f3-da93-4952-8737-0afc422e1285","resolution":{"observed_at":"2026-08-15T22:04:21.396643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12670","last_updated":"2026-03-13T07:33:01Z","snapshot_observed_at":"2026-08-12T09:12:28.700231Z","submitted_at":"2026-02-13T07:06:06Z","title":"SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12670","snapshot_observed_at":"2026-08-15T22:04:21.400883Z","title":"arXiv preprint arXiv:2602.12670 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.400883Z"},"links":{"cited_paper":"/paper/2602.12670","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:4de0edbd5d386c8ec2dafaa611dab39249d42fdd6938a2b7ec48a534b9a6fb67","observation_id":"d220a01c-7455-41da-9c82-75d80a92db46","resolution":{"observed_at":"2026-08-15T22:04:21.400883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20087","last_updated":"2026-04-22T01:07:37Z","snapshot_observed_at":"2026-08-15T05:12:26.979135Z","submitted_at":"2026-04-22T01:07:37Z","title":"SkillLearnBench: Benchmarking Continual Learning Methods for Agent Skill Generation on Real-World Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20087","snapshot_observed_at":"2026-08-15T22:04:21.405688Z","title":"arXiv preprint arXiv:2604.20087 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.405688Z"},"links":{"cited_paper":"/paper/2604.20087","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:e8573b2d89088cc3ece731426e9880e953e99b5a0e0dfd62bd5da799cbf4d3bb","observation_id":"df8e359c-7003-4c40-98d7-6c2998bf653e","resolution":{"observed_at":"2026-08-15T22:04:21.405688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02766","last_updated":"2026-03-03T09:07:22Z","snapshot_observed_at":"2026-08-15T16:32:40.226808Z","submitted_at":"2026-03-03T09:07:22Z","title":"EvoSkill: Automated Skill Discovery for Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.02766","snapshot_observed_at":"2026-08-15T22:04:21.410437Z","title":"arXiv preprint arXiv:2603.02766 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.410437Z"},"links":{"cited_paper":"/paper/2603.02766","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:5fb1447ec709d7d559242ed2179b393706a30aa278cc44c826505d8bc11238aa","observation_id":"bdb23f5b-a4be-4ccd-b10b-eea57cebe778","resolution":{"observed_at":"2026-08-15T22:04:21.410437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.415809Z","title":"arXiv preprint arXiv:2603.01145 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.415809Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:f94b59fb352152cf9f9bc475b1cd69af5cdea4b0913eb20874fa01edf5ec11ec","observation_id":"fcdfd702-6ebe-410f-a877-d0541f5c241a","resolution":{"observed_at":"2026-08-15T22:04:21.415809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08377","last_updated":"2026-08-10T11:40:00Z","snapshot_observed_at":"2026-08-13T23:38:44.225146Z","submitted_at":"2026-04-09T15:38:27Z","title":"SkillClaw: Let Skills Evolve Collectively with Agentic Evolver","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08377","snapshot_observed_at":"2026-08-15T22:04:21.419240Z","title":"arXiv preprint arXiv:2604.08377 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.419240Z"},"links":{"cited_paper":"/paper/2604.08377","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:ada67b55db6be0e16ffdf22185038bbf9617910b2241ae957bcd80a473566d4f","observation_id":"d79c8954-aa84-4978-983c-9487315b1b52","resolution":{"observed_at":"2026-08-15T22:04:21.419240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18401","last_updated":"2026-05-18T13:44:19Z","snapshot_observed_at":"2026-08-12T19:45:01.180219Z","submitted_at":"2026-05-18T13:44:19Z","title":"SkillsVote: Lifecycle Governance of Agent Skills from Collection, Recommendation to Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18401","snapshot_observed_at":"2026-08-15T22:04:21.422994Z","title":"arXiv preprint arXiv:2605.18401 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.422994Z"},"links":{"cited_paper":"/paper/2605.18401","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:5e76bb2907c63da194ec63fd8c677ab78bf008b5bdf4f027eaac867ad32f336d","observation_id":"bd43d7c1-218b-43db-8ebe-d3dec77d60ca","resolution":{"observed_at":"2026-08-15T22:04:21.422994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.23904","last_updated":"2026-05-25T17:58:16Z","snapshot_observed_at":"2026-08-19T08:34:45.633036Z","submitted_at":"2026-05-22T17:59:50Z","title":"SkillOpt: Executive Strategy for Self-Evolving Agent Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.23904","snapshot_observed_at":"2026-08-15T22:04:21.426994Z","title":"arXiv preprint arXiv:2605.23904 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.426994Z"},"links":{"cited_paper":"/paper/2605.23904","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:44ea5e7e3d9904c2f81637f646f891547348734c08fc3604fecf23d323f497a3","observation_id":"e48a6af3-d109-4207-95c3-e8ac4f2368b3","resolution":{"observed_at":"2026-08-15T22:04:21.426994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.01687","last_updated":"2026-08-10T23:18:05Z","snapshot_observed_at":"2026-08-14T23:09:21.620258Z","submitted_at":"2026-04-02T06:43:20Z","title":"CoEvoSkills: Self-Evolving Agent Skills via Co-Evolutionary Verification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.01687","snapshot_observed_at":"2026-08-15T22:04:21.430591Z","title":"arXiv preprint arXiv:2604.01687 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.430591Z"},"links":{"cited_paper":"/paper/2604.01687","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:d78a950e8fcd15fee76eea99a7b37dc70fa18e6525b3025ae5d413e50af921bb","observation_id":"888c1d0d-3d32-4b03-8963-aa768b317ebb","resolution":{"observed_at":"2026-08-15T22:04:21.430591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27366","last_updated":"2026-07-03T08:22:38Z","snapshot_observed_at":"2026-08-16T05:31:32.102310Z","submitted_at":"2026-05-26T17:59:19Z","title":"MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27366","snapshot_observed_at":"2026-08-15T22:04:21.434517Z","title":"arXiv preprint arXiv:2605.27366 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.434517Z"},"links":{"cited_paper":"/paper/2605.27366","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:fbba28741e08e01c43ac068e906f8aff07f06ae8f1b5d34b49567ba07b2bb689","observation_id":"e04a4d99-168b-44f1-8fa4-cdf234c2eb4e","resolution":{"observed_at":"2026-08-15T22:04:21.434517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.438406Z","title":"arXiv preprint arXiv:2606.14239 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.438406Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:bb08f34861401ee39624eacdc6444a23ba753836ea31d225fb17d395cf884ede","observation_id":"281883ba-7d67-46c1-85c3-a9fce39469a5","resolution":{"observed_at":"2026-08-15T22:04:21.438406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09316","last_updated":"2026-06-19T10:27:56Z","snapshot_observed_at":"2026-08-13T11:21:52.007668Z","submitted_at":"2026-06-08T10:24:32Z","title":"Anything2Skill: Compiling External Knowledge into Reusable Skills for Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.09316","snapshot_observed_at":"2026-08-15T22:04:21.441790Z","title":"arXiv preprint arXiv:2606.09316 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.441790Z"},"links":{"cited_paper":"/paper/2606.09316","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:927715f94075343bee9680b215b4b30bad4ff002eefd11ca267639a0610ba11d","observation_id":"738c0697-8011-4f21-8458-62b7560dc474","resolution":{"observed_at":"2026-08-15T22:04:21.441790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07412","last_updated":"2026-06-05T16:00:17Z","snapshot_observed_at":"2026-08-15T23:39:44.339079Z","submitted_at":"2026-06-05T16:00:17Z","title":"Socratic-SWE: Self-Evolving Coding Agents via Trace-Derived Agent Skills","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07412","snapshot_observed_at":"2026-08-15T22:04:21.445587Z","title":"arXiv preprint arXiv:2606.07412 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.445587Z"},"links":{"cited_paper":"/paper/2606.07412","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:62606c9afe6ef16621a088a712fc9b4df302b6fee2f1cfa2c1c3968ae34d576e","observation_id":"14673bdc-fca2-4285-ad00-8f26cb291e58","resolution":{"observed_at":"2026-08-15T22:04:21.445587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.25430","last_updated":"2026-05-25T05:12:49Z","snapshot_observed_at":"2026-08-19T11:23:58.827227Z","submitted_at":"2026-05-25T05:12:49Z","title":"CODESKILL: Learning Self-Evolving Skills for Coding Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.25430","snapshot_observed_at":"2026-08-15T22:04:21.449368Z","title":"arXiv preprint arXiv:2605.25430 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.449368Z"},"links":{"cited_paper":"/paper/2605.25430","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:e8f549ca2651ac4a8498bec16aa187e03281f2e3f6456c1d32e14d9b8a07371c","observation_id":"c30e20be-b8a3-4229-a617-cbb8cb9f48e4","resolution":{"observed_at":"2026-08-15T22:04:21.449368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.08234","last_updated":"2026-02-09T03:17:17Z","snapshot_observed_at":"2026-08-16T15:35:02.889986Z","submitted_at":"2026-02-09T03:17:17Z","title":"SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.08234","snapshot_observed_at":"2026-08-15T22:04:21.453477Z","title":"arXiv preprint arXiv:2602.08234 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.453477Z"},"links":{"cited_paper":"/paper/2602.08234","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:39e71813609195dfdebf547f246b1d8eb9d00c6e3ce3a4da10e46618048560ec","observation_id":"1b5cd27c-d2e2-4cf1-adc6-5bfa34ecbfc3","resolution":{"observed_at":"2026-08-15T22:04:21.453477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.01139","last_updated":"2026-06-17T05:10:07Z","snapshot_observed_at":"2026-08-19T13:35:02.753099Z","submitted_at":"2026-05-31T10:19:13Z","title":"SkillRevise: Improving LLM-Authored Agent Skills via Trace-Conditioned Skill Revision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.01139","snapshot_observed_at":"2026-08-15T22:04:21.458110Z","title":"arXiv preprint arXiv:2606.01139 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.458110Z"},"links":{"cited_paper":"/paper/2606.01139","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:f85e26392fe02c67c23faf7c5a135f522eba7f8aee3d847700d471137933d566","observation_id":"c01c65cf-4d9c-4ebd-b850-5a3b098d4d6d","resolution":{"observed_at":"2026-08-15T22:04:21.458110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.03056","last_updated":"2026-06-02T02:45:21Z","snapshot_observed_at":"2026-08-17T03:28:46.496210Z","submitted_at":"2026-06-02T02:45:21Z","title":"SkillDAG: Self-Evolving Typed Skill Graphs for LLM Skill Selection at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.03056","snapshot_observed_at":"2026-08-15T22:04:21.462466Z","title":"arXiv preprint arXiv:2606.03056 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.462466Z"},"links":{"cited_paper":"/paper/2606.03056","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:b580303b59d79ba95fbdc6dac95c7dd405f9fd582ef9346d15bd431302287e49","observation_id":"69551db2-91e0-4a22-8bc4-bef855be46b9","resolution":{"observed_at":"2026-08-15T22:04:21.462466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.466960Z","title":"arXiv preprint arXiv:2603.15401 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.466960Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:aba7142a3cc7808569a83059823965e19962faf6a1120e9e5173a7cc644ba5b8","observation_id":"3d26f46c-cfd0-428b-84bf-360b6c1bba6a","resolution":{"observed_at":"2026-08-15T22:04:21.466960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.470772Z","title":"arXiv preprint arXiv:2509.26354 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.470772Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:e0789d21d8fdcb8bf1310c8d5bd0311a9eadc04cb986b2edd63af978ac18920f","observation_id":"f8598ecd-c8af-4450-9371-1e1ad8ad53f6","resolution":{"observed_at":"2026-08-15T22:04:21.470772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.475080Z","title":"Findings of the Association for Computational Linguistics: ACL 2026 , pages=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.475080Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:5327c17da52c5e56e1e5e327331c11d328bb5c56bc3bf3358f579736a9fe629e","observation_id":"bdff057e-a432-48f4-9f7b-04075dea8db2","resolution":{"observed_at":"2026-08-15T22:04:21.475080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15774","last_updated":"2026-05-21T09:29:59Z","snapshot_observed_at":"2026-08-11T01:32:05.376469Z","submitted_at":"2026-04-17T07:29:52Z","title":"MemEvoBench: Benchmarking Safety Risks from Memory Misevolution in LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.15774","snapshot_observed_at":"2026-08-15T22:04:21.480294Z","title":"arXiv preprint arXiv:2604.15774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.480294Z"},"links":{"cited_paper":"/paper/2604.15774","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:6782b0e8d52580f669bfb2227acf78e2f5d7ec4d69ae6214e72592db32e84e8c","observation_id":"497ae427-5fc2-4714-a548-b796b28f2e42","resolution":{"observed_at":"2026-08-15T22:04:21.480294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.03224","last_updated":"2026-06-06T09:48:09Z","snapshot_observed_at":"2026-08-15T23:04:27.030669Z","submitted_at":"2026-02-03T07:52:26Z","title":"TAME: A Trustworthy Test-Time Evolution of Agent Memory with Systematic Benchmarking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.03224","snapshot_observed_at":"2026-08-15T22:04:21.484934Z","title":"arXiv preprint arXiv:2602.03224 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.484934Z"},"links":{"cited_paper":"/paper/2602.03224","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:af52dd26453d5da70b64501572f20443d1322fcd8b2e0f90d670ab3bc9999903","observation_id":"24a07787-8ddd-452f-b491-99eda92aa8ef","resolution":{"observed_at":"2026-08-15T22:04:21.484934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09315","last_updated":"2026-05-10T04:20:24Z","snapshot_observed_at":"2026-07-06T23:21:26.017420Z","submitted_at":"2026-05-10T04:20:24Z","title":"Do Self-Evolving Agents Forget? Capability Degradation and Preservation in Lifelong LLM Agent Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.09315","snapshot_observed_at":"2026-08-15T22:04:21.490117Z","title":"arXiv preprint arXiv:2605.09315 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.490117Z"},"links":{"cited_paper":"/paper/2605.09315","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:14e88ae6557437b93b2058fabd7aaf77293ae5fcdad073503f45d2f564a1bb3e","observation_id":"63f7c422-8b03-48ac-a043-32ec31a2da56","resolution":{"observed_at":"2026-08-15T22:04:21.490117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.23075","last_updated":"2026-06-22T09:23:50Z","snapshot_observed_at":"2026-08-02T06:16:18.387353Z","submitted_at":"2026-06-22T09:23:50Z","title":"Safety in Self-Evolving LLM Agent Systems: Threats, Amplification, and Case Studies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.23075","snapshot_observed_at":"2026-08-15T22:04:21.495032Z","title":"arXiv preprint arXiv:2606.23075 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.495032Z"},"links":{"cited_paper":"/paper/2606.23075","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:858ed45da275d4c9837e57440c33436e870e2d62ada44ba17674febeb3a159f9","observation_id":"680a5b1c-2f90-46fb-8c6d-713cf7fd96ce","resolution":{"observed_at":"2026-08-15T22:04:21.495032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.20156","last_updated":"2026-02-25T18:14:01Z","snapshot_observed_at":"2026-08-11T16:43:10.190893Z","submitted_at":"2026-02-23T18:59:27Z","title":"Skill-Inject: Measuring Agent Vulnerability to Skill File Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.20156","snapshot_observed_at":"2026-08-15T22:04:21.499359Z","title":"arXiv preprint arXiv:2602.20156 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.499359Z"},"links":{"cited_paper":"/paper/2602.20156","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:6d6f60112137d6083c391cfad34a22f9cb553a367122d249015a3db408d7a6a1","observation_id":"72b7dbfa-0962-4a7c-b718-16dabb40febf","resolution":{"observed_at":"2026-08-15T22:04:21.499359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.503867Z","title":"Maddison and Tatsunori Hashimoto , booktitle=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.503867Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:09778da50db67a18efe0942e0f72fa5af8b86f39a7362250a82a944b249b7241","observation_id":"4336d6a3-9603-49fe-bbef-e389e1f69abe","resolution":{"observed_at":"2026-08-15T22:04:21.503867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.507941Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.507941Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:ce6974399efb467dacc3dc9637ba66c1cba353df7fa9ecc1465536f590b8d5a0","observation_id":"f8b5e573-d84a-4b8f-aeba-96ebc95d6ce6","resolution":{"observed_at":"2026-08-15T22:04:21.507941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.512102Z","title":"AgentHarm: A Benchmark for Measuring Harmfulness of","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.512102Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:d2ca8cb3dfe11462ecac48989ce0ddc6dfbfac1758e97e886967488bb8783b2a","observation_id":"39b576ad-2b05-4541-be3d-5ac1cd238982","resolution":{"observed_at":"2026-08-15T22:04:21.512102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:22.326313Z","title":"Agent Security Bench (","venue":null,"work_id":"94b906bc-2624-42c8-bcf5-84d37828e1be","year":2025},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.518249Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:46b71b461415d63c66cb7432dff80345241b961c2769087730513c822ec66e00","observation_id":"4e989116-3886-4319-8075-c63315b5defd","resolution":{"observed_at":"2026-08-15T22:04:22.331832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14470","last_updated":"2025-05-20T05:58:23Z","snapshot_observed_at":"2026-08-06T12:35:19.109481Z","submitted_at":"2024-12-19T02:35:15Z","title":"Agent-SafetyBench: Evaluating the Safety of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14470","snapshot_observed_at":"2026-08-15T22:04:21.522712Z","title":"arXiv preprint arXiv:2412.14470 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.522712Z"},"links":{"cited_paper":"/paper/2412.14470","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:5b7cf57d44b74ad173021467c921523468768e584f8e5516ff5f0630bb607c19","observation_id":"09492616-ed78-40e5-bd47-5450c1ea9829","resolution":{"observed_at":"2026-08-15T22:04:21.522712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:22.310661Z","title":"The Thirty-eight Conference on Neural Information Processing Systems Datasets and Benchmarks Track , year=","venue":null,"work_id":"25bfb3a8-c704-4813-ac0b-5c09ed248da1","year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.527254Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:afc47bb676482b10c88c29b52ef61bedd565f3cd1171a2d401b960a46854fd17","observation_id":"7169a9c4-03c8-4ea2-a9f8-c9de1163e4ad","resolution":{"observed_at":"2026-08-15T22:04:22.316371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:22.295844Z","title":"OpenAgentSafety: A Comprehensive Framework For Evaluating Real-World","venue":null,"work_id":"28a9f9c2-535a-4f6f-90f9-ba0dae6aa58e","year":2026},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.531522Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:db84925ef04268bf5d6a3a5d3b0a3fac237591872e6e3eb10945c70ba551aecc","observation_id":"3bba6d3f-8246-4d6b-b0b8-65a4946b3351","resolution":{"observed_at":"2026-08-15T22:04:22.301512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.04808","last_updated":"2026-05-06T11:59:48Z","snapshot_observed_at":"2026-08-15T09:13:40.640296Z","submitted_at":"2026-05-06T11:59:48Z","title":"DecodingTrust-Agent Platform (DTap): A Controllable and Interactive Red-Teaming Platform for AI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.04808","snapshot_observed_at":"2026-08-15T22:04:21.536137Z","title":"arXiv preprint arXiv:2605.04808 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.536137Z"},"links":{"cited_paper":"/paper/2605.04808","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:d2bcd7dd28a44e214b83e16398d5b7dd7e39603f64b62f892ee0235fbc9aca57","observation_id":"a4dcdecd-02a2-4603-b3f4-d029c6ce3893","resolution":{"observed_at":"2026-08-15T22:04:21.536137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.26269","last_updated":"2026-05-25T18:53:22Z","snapshot_observed_at":"2026-08-15T00:50:18.626097Z","submitted_at":"2026-05-25T18:53:22Z","title":"AgentSecBench: Measuring Prompt Injection, Privacy Leakage, and Tool-Use Integrity in LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.26269","snapshot_observed_at":"2026-08-15T22:04:21.540541Z","title":"arXiv preprint arXiv:2605.26269 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.540541Z"},"links":{"cited_paper":"/paper/2605.26269","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:eb92685448f1c8fd03daf5702286fd1cc6c92ba70faced95e8ff746e988042a7","observation_id":"9be6a542-8daa-471e-8f38-2277f3d7ba5f","resolution":{"observed_at":"2026-08-15T22:04:21.540541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03378","last_updated":"2026-07-08T15:04:28Z","snapshot_observed_at":"2026-08-12T18:46:39.799583Z","submitted_at":"2026-05-05T05:37:00Z","title":"ARGUS: Defending LLM Agents Against Context-Aware Prompt Injection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03378","snapshot_observed_at":"2026-08-15T22:04:21.544774Z","title":"arXiv preprint arXiv:2605.03378 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.544774Z"},"links":{"cited_paper":"/paper/2605.03378","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:dee7209a6eb86f0740f25d7a85cf8d6ca221a7ac0b1b95e59240c791b6e0dc63","observation_id":"92c46af7-e3e8-48ae-ae63-90c5d746ab2d","resolution":{"observed_at":"2026-08-15T22:04:21.544774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.10490","last_updated":"2026-07-11T21:54:20Z","snapshot_observed_at":"2026-08-17T23:02:41.211034Z","submitted_at":"2026-07-11T21:54:20Z","title":"NetInjectBench: Benchmarking Indirect Prompt Injection in Tool-Using Large Language Model Agents for Network Operations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.10490","snapshot_observed_at":"2026-08-15T22:04:21.547978Z","title":"arXiv preprint arXiv:2607.10490 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.547978Z"},"links":{"cited_paper":"/paper/2607.10490","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:feeabde64b74820310e16bc43499f4d787d506cf790bc8122afe162c3ff34992","observation_id":"e5761892-556e-493e-92af-792646a6a01e","resolution":{"observed_at":"2026-08-15T22:04:21.547978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.551481Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.551481Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:6907cfcd17ed81ea0a0ab9f4b77b36bb177e22269b1e8a99af4d7b56ffef97d1","observation_id":"f54ec0e1-6d25-4c77-8ab9-487abc9fc46f","resolution":{"observed_at":"2026-08-15T22:04:21.551481Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:21.554879Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.554879Z"},"links":{"citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:65930a74778b89ff6e1e57732a057012771e020be08a80c6d0036e394583259c","observation_id":"15ceeade-e2c6-465f-a136-9717f20bea27","resolution":{"observed_at":"2026-08-15T22:04:21.554879Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.19576","last_updated":"2026-07-29T05:58:19Z","snapshot_observed_at":"2026-08-15T22:27:10.611757Z","submitted_at":"2026-05-19T09:19:56Z","title":"Library Drift: Diagnosing and Fixing a Silent Failure Mode in Self-Evolving LLM Skill Libraries","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.19576","snapshot_observed_at":"2026-08-15T22:04:21.557975Z","title":"arXiv preprint arXiv:2605.19576 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T22:04:21.557975Z"},"links":{"cited_paper":"/paper/2605.19576","citing_paper":"/paper/2608.12851"},"observation_digest":"sha256:b411ff93701cd581ad09ba419b62b81f7dc4ff17fae0ff5a6ffc05d8029b7450","observation_id":"ab08e74f-48b2-4c88-9c48-3a7617ec1857","resolution":{"observed_at":"2026-08-15T22:04:21.557975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.12851","last_updated":"2026-08-13T05:47:43Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T06:39:51.703194Z","submitted_at":"2026-08-13T05:47:43Z","title":"Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":2,"unresolved":37,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2608.12851."}