{"as_of":"2026-08-08T06:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b8879302fd1e7af5c8818d15603c28e9d5c968630dc6abcd8eb895295f912006","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:02:35.466750Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T12:07:49.656453Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"cited_work":{"arxiv_id":"2506.02048","doi":"10.48550/arxiv.2506.02048","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv:2506.02048","venue":"ArXiv.org","work_id":"fa6ff75b-ffdf-40e9-b3b8-c51ca5ff7749","year":2025},"citing_paper":{"arxiv_id":"2602.05523","last_updated":"2026-04-17T13:49:22Z","snapshot_observed_at":"2026-07-06T22:44:42.380489Z","submitted_at":"2026-02-05T10:30:57Z","title":"Capture the Flags: Family-Based Evaluation of Agentic LLMs via Semantics-Preserving Transformations","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T07:26:55.823329Z"},"links":{"cited_paper":"/paper/2506.02048","citing_paper":"/paper/2602.05523"},"observation_digest":"sha256:b59b10a27dd18df7bdcf2b5e680f52e997835cbb6b1209e2ac2e0196f221eb97","observation_id":"b6e5e358-173b-417b-bc16-3c5d10b9eff6","resolution":{"observed_at":"2026-05-16T07:27:31.463153Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"cited_work":{"arxiv_id":"2506.02048","doi":"10.48550/arxiv.2506.02048","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv:2506.02048","venue":"ArXiv.org","work_id":"fa6ff75b-ffdf-40e9-b3b8-c51ca5ff7749","year":2025},"citing_paper":{"arxiv_id":"2605.28146","last_updated":"2026-05-27T08:29:28Z","snapshot_observed_at":"2026-08-04T10:57:53.122170Z","submitted_at":"2026-05-27T08:29:28Z","title":"Cybersecurity AI (CAI) Dataset","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T12:07:49.656453Z"},"links":{"cited_paper":"/paper/2506.02048","citing_paper":"/paper/2605.28146"},"observation_digest":"sha256:610005e5b72a5c86a5b2828b5b65ce7e82ebf488be2032caa0368255bc76b115","observation_id":"4651da1b-586a-412b-a5cb-8d106f7d7fc5","resolution":{"observed_at":"2026-06-29T12:13:26.833206Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02048/citation-record","integrity":"/paper/2506.02048/integrity","json":"/paper/2506.02048/citation-record.json","paper":"/paper/2506.02048"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.388647Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.388647Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:d09bcac1c8c46ce8502badc786837bfb98842f58bb8f6a5475c3d54e03290979","observation_id":"fa95b339-a0e1-4a06-9995-5bf3b0899e33","resolution":{"observed_at":"2026-08-07T12:02:35.388647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-07T12:02:35.391491Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.391491Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:16ebc4f808835842773777162af5df35b529c4d6b466028e7ab90161e1f5d397","observation_id":"0a64b9f8-2ce1-48d3-8b79-ff9e7372d2f9","resolution":{"observed_at":"2026-08-07T12:02:35.391491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08144","last_updated":"2024-04-17T04:34:39Z","snapshot_observed_at":"2026-08-02T04:29:28.130280Z","submitted_at":"2024-04-11T22:07:19Z","title":"LLM Agents can Autonomously Exploit One-day Vulnerabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08144","snapshot_observed_at":"2026-08-07T12:02:35.394058Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.394058Z"},"links":{"cited_paper":"/paper/2404.08144","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:18ddf68adbd955136d25631a82e4c244045ec89d5de07f322e7b5f1a3241795c","observation_id":"c849b5b3-9a78-4edd-a3ce-a0d2fa71b1b1","resolution":{"observed_at":"2026-08-07T12:02:35.394058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01637","last_updated":"2025-03-30T00:26:48Z","snapshot_observed_at":"2026-08-08T04:41:33.967516Z","submitted_at":"2024-06-02T16:25:26Z","title":"Teams of LLM Agents can Exploit Zero-Day Vulnerabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01637","snapshot_observed_at":"2026-08-07T12:02:35.396718Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.396718Z"},"links":{"cited_paper":"/paper/2406.01637","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:017b78a2222ae882d551496a67c5594ebbf416bcc06e212208c98f07d4b0fbda","observation_id":"3f3342ef-e9b4-4c1d-bcb0-a7af2fb80572","resolution":{"observed_at":"2026-08-07T12:02:35.396718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.703558Z","title":null,"venue":null,"work_id":"6d2babe7-2f5a-4dc5-8fa1-26d07f7607e2","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.399342Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:7357a7a6178965617d5de73bfd793763bddcf9a2f743f2322a19b3772e5284de","observation_id":"4d5dc54c-603a-452c-8238-74877666b44e","resolution":{"observed_at":"2026-08-07T12:02:35.706042Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01778","last_updated":"2024-12-02T18:28:18Z","snapshot_observed_at":"2026-07-06T20:00:23.632792Z","submitted_at":"2024-12-02T18:28:18Z","title":"HackSynth: LLM Agent and Evaluation Framework for Autonomous Penetration Testing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01778","snapshot_observed_at":"2026-08-07T12:02:35.401593Z","title":"Muzsai, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.401593Z"},"links":{"cited_paper":"/paper/2412.01778","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:35367cdd22b71fec37b3465b50b54cbebdbd0d2d511567af06498b513a632b3a","observation_id":"b8433a1f-db6f-44a2-973e-4a657cf4068e","resolution":{"observed_at":"2026-08-07T12:02:35.401593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05590","last_updated":"2025-02-18T12:26:33Z","snapshot_observed_at":"2026-07-06T18:27:36.903877Z","submitted_at":"2024-06-08T22:21:42Z","title":"NYU CTF Bench: A Scalable Open-Source Benchmark Dataset for Evaluating LLMs in Offensive Security","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05590","snapshot_observed_at":"2026-08-07T12:02:35.404055Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.404055Z"},"links":{"cited_paper":"/paper/2406.05590","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:d3041a37728ed291678ed66d94fb5e9ec73cbffc5bcc647110b94c8311eb5810","observation_id":"d163595e-7ebc-4faf-a91d-e25a6264d473","resolution":{"observed_at":"2026-08-07T12:02:35.404055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08926","last_updated":"2025-04-12T21:26:07Z","snapshot_observed_at":"2026-08-06T12:22:30.341073Z","submitted_at":"2024-08-15T17:23:10Z","title":"Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08926","snapshot_observed_at":"2026-08-07T12:02:35.406709Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.406709Z"},"links":{"cited_paper":"/paper/2408.08926","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:12f4cbb6de2f238df4fe681895618e8679fdfc2aad8212e13163e9306e7fedcf","observation_id":"bc7718ec-e1a9-48e5-92f1-5b9dca55f357","resolution":{"observed_at":"2026-08-07T12:02:35.406709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.696438Z","title":null,"venue":null,"work_id":"79698576-e836-424a-a718-944af3cff846","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.409028Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:05e117a7ff9880801b997629ab72c20b5727053903f114b93e8ef9b1aa3c42b9","observation_id":"d08c128a-540e-4610-a949-cf42fcb8faf3","resolution":{"observed_at":"2026-08-07T12:02:35.698882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:02:35.411104Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.411104Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:ef418fbe092ca65c2572d1f2f0f914ddd45bbd686c56b54076f789e940c4c3ee","observation_id":"e8ed4256-efdb-435a-86d0-97e2ce8f940c","resolution":{"observed_at":"2026-08-07T12:02:35.411104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:02:35.413594Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.413594Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:08da6a6a86c6e9fa7bfacd165c0cc5e3a8938d3c5d811e9c406622d055cb1e3b","observation_id":"c3c486ee-fd75-4eb6-935d-bee858c388fc","resolution":{"observed_at":"2026-08-07T12:02:35.413594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.688201Z","title":"1-8B-Instruct, 2024","venue":null,"work_id":"2211944c-0b88-4cf9-bcb1-c9b0c7040bdb","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.415632Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:2ab101088a60fd3fd69f852fcf0666ed878b8e095fc28f081d9850a285f5c1da","observation_id":"f304b23a-89b7-45dd-8787-438e66921a2f","resolution":{"observed_at":"2026-08-07T12:02:35.691624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10443","last_updated":"2023-08-21T03:30:21Z","snapshot_observed_at":"2026-08-05T16:13:40.630996Z","submitted_at":"2023-08-21T03:30:21Z","title":"Using Large Language Models for Cybersecurity Capture-The-Flag Challenges and Certification Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10443","snapshot_observed_at":"2026-08-07T12:02:35.418518Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.418518Z"},"links":{"cited_paper":"/paper/2308.10443","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:06bc329f2c4913922418f8724b35f4b386c79a625c78b59b682f38ab4e53b435","observation_id":"a650f72c-7905-4486-9246-e85a5588b093","resolution":{"observed_at":"2026-08-07T12:02:35.418518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06782","last_updated":"2024-06-02T16:16:49Z","snapshot_observed_at":"2026-08-07T16:46:33.307475Z","submitted_at":"2023-08-13T14:35:50Z","title":"PentestGPT: An LLM-empowered Automatic Penetration Testing Tool","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06782","snapshot_observed_at":"2026-08-07T12:02:35.420795Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.420795Z"},"links":{"cited_paper":"/paper/2308.06782","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:b7060be01ae9662178382bb3815398df1b1b3d4d171f871117f1a833b0b7e134","observation_id":"2ef6cafc-a7e0-428b-af97-083345b4c72b","resolution":{"observed_at":"2026-08-07T12:02:35.420795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.681498Z","title":null,"venue":null,"work_id":"cba3006f-c3f6-429c-8e3c-54d74dddbf74","year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.423032Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:7064e4e9638538ce6295b160e2ff519c26008b5abf0cabd042875a493070d3b0","observation_id":"3e1f2d8c-9178-4981-915e-101501c0aaf9","resolution":{"observed_at":"2026-08-07T12:02:35.683997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.674123Z","title":"URL: https://platform.openai.com/ docs/guides/function-calling, accessed: 2025-05-28","venue":null,"work_id":"57344f68-b42c-4b19-8962-8442dbc077e3","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.424947Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:2c1c53dae597701359632a94b69bb1473c157d473234fcf171e2909487353210","observation_id":"e4a46e96-a38f-418b-a752-da35882d7223","resolution":{"observed_at":"2026-08-07T12:02:35.676718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.666801Z","title":"URL: https://www.anthropic.com/news/model-context-protocol, accessed: 2025-05-28","venue":null,"work_id":"b1212ab6-ed8d-4c2f-91b3-51ec23c4e03e","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.427300Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:3c2d146d179bfcc90285fdb3c0d5a14f1866a47a6227d9d9b37d3e94370e80ca","observation_id":"eb4c0bd1-bc1e-4ee1-be55-24d2cb1cdf17","resolution":{"observed_at":"2026-08-07T12:02:35.669486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23278","last_updated":"2025-10-07T07:13:32Z","snapshot_observed_at":"2026-07-06T21:00:55.979837Z","submitted_at":"2025-03-30T01:58:22Z","title":"Model Context Protocol (MCP): Landscape, Security Threats, and Future Research Directions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23278","snapshot_observed_at":"2026-08-07T12:02:35.429250Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.429250Z"},"links":{"cited_paper":"/paper/2503.23278","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:22b23f18a652f278b99e1ad3605d7464cdf8b3a8450b4350d8543b1dc0ecd141","observation_id":"9cfb5d56-476f-4630-ba35-70a77b042409","resolution":{"observed_at":"2026-08-07T12:02:35.429250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:02:35.431731Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.431731Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:d8118a50bb062c2a2d9e6588ca17eb9c467d20cbb5b92a6eaeb725ce3e2cf4dd","observation_id":"df4f9eb9-7625-4771-ab55-3dd08100d03a","resolution":{"observed_at":"2026-08-07T12:02:35.431731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.660117Z","title":"Ouyang, J","venue":null,"work_id":"e76954d7-f6bc-4e5f-9305-06beec1dbda6","year":2022},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.433763Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:15b99b2c286c000302802e7c8c653f57e31636748388a035e91f57b9590aa0b5","observation_id":"04c3d49e-c949-416e-8d5e-38992414135d","resolution":{"observed_at":"2026-08-07T12:02:35.662626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.653582Z","title":"Dettmers, A","venue":null,"work_id":"446bff8d-37fa-4dd0-b43f-b14d2a8a4f49","year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.436379Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:9827b28234c697871d92e4a01059466f8196f336f58c4de41707cdde8513d501","observation_id":"55ebcec7-faf9-4d9a-8be5-7b373e70a166","resolution":{"observed_at":"2026-08-07T12:02:35.655915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09580","last_updated":"2026-05-27T13:44:11Z","snapshot_observed_at":"2026-08-06T17:49:53.061259Z","submitted_at":"2025-07-13T11:11:01Z","title":"AICrypto: Evaluating Cryptography Capabilities of Large Language Models","version":6},"cited_work":{"arxiv_id":"2507.09580","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.09580","snapshot_observed_at":"2026-08-07T12:02:35.486883Z","title":"AICrypto: Evaluating Cryptography Capabilities of Large Language Models","venue":"cs.CR","work_id":"f0bd9289-b499-44c8-88ef-ba8785fc1b2e","year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.438326Z"},"links":{"cited_paper":"/paper/2507.09580","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:a1fdc4b456cef6237e6a8bdca0c32c422a0a23f9b1a82ec8de397f3688b0dc1e","observation_id":"6834854a-3dcf-426d-8b4a-4e6f000f5704","resolution":{"observed_at":"2026-08-07T12:02:35.491580Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.646601Z","title":"Accessed: 2025-05-28","venue":null,"work_id":"2079bf16-33b5-47db-a82b-a4860e4d9705","year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.440456Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:96bbd6fd5ee299380a944167362874aaa64f88551516e38b97859d2816428f72","observation_id":"ee495015-8739-4612-8855-2b1eb5c8bb6c","resolution":{"observed_at":"2026-08-07T12:02:35.649128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.639922Z","title":"1-70B-Instruct, 2024","venue":null,"work_id":"aa8e2978-a8cc-4679-b959-a41eb96916cf","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.442544Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:4519cc410f52f6121937e9f0c1514bf0c604bce07e90a61da0a1ed9c7b3bdd32","observation_id":"4ed65a50-80c6-4c5b-8f85-d98d31775c57","resolution":{"observed_at":"2026-08-07T12:02:35.642433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.633762Z","title":"Accessed: 2025-05-28","venue":null,"work_id":"29e6d8b3-0c49-415e-bc16-1571de58078c","year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.444652Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:b9da158df5f34813973776b4a01b4c907cf7f2341bf81d47561cfc7892a5c44c","observation_id":"3a30f6db-1837-41f3-9126-252c3552c2c8","resolution":{"observed_at":"2026-08-07T12:02:35.636112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.627432Z","title":"Accessed: 2025-05-28","venue":null,"work_id":"a0fbbc60-c830-4d40-b38a-a29c192a05f0","year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.446866Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:425375510d4c2e4b15635ac8eb39e703276c8bdf76b1fd2755dc5c6012256226","observation_id":"8d26589d-bc1c-4525-8a7d-fdaaf84358c1","resolution":{"observed_at":"2026-08-07T12:02:35.629552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.620667Z","title":null,"venue":null,"work_id":"0866327a-9b13-4658-b3c9-d55ea1af9b79","year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.448948Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:dd76cc50de6629176bea35b0b883f7aeb0b3afacb2eccb3d44f923f0ba7bc4d8","observation_id":"f8c7f1b5-0c0c-4e5d-b517-1dcffd2f5e99","resolution":{"observed_at":"2026-08-07T12:02:35.622828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.614433Z","title":"Schick, J","venue":null,"work_id":"67e1296d-fa2b-4e98-98b5-a61b59670800","year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.451190Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:e012a4011d9cf2b5e37745e8ba1d059e556e40acb5f12a432741923bc8d92a9d","observation_id":"52526601-282f-4b35-9150-d2a2d37060ef","resolution":{"observed_at":"2026-08-07T12:02:35.616563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.608197Z","title":null,"venue":null,"work_id":"635001e0-01c7-4ce1-8ee2-9fe4f44bf072","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.453240Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:fde54833d356cc9e78f21d99b87ee4af8b4b3567965176b667bbe92fbcc34b6c","observation_id":"1b7d647e-c5c3-4b68-9580-0b3b88f47113","resolution":{"observed_at":"2026-08-07T12:02:35.610339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.601597Z","title":"Greshake, S","venue":null,"work_id":"a51639b7-cab3-4b71-9d00-cc9a7ee87d16","year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.455294Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:1f20890f11bb1090307357619b79a6ab6e51886f667d5e65d5933218095827e2","observation_id":"13133585-3972-40d7-9026-8958a1a230e3","resolution":{"observed_at":"2026-08-07T12:02:35.603791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.594867Z","title":"</reasoning> tags","venue":null,"work_id":"2683f0dc-4822-40fd-b894-0180884556d8","year":null},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.457740Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:1d953d407f0f8d89065add080278aea5316028933bf9b9fa6446b4dc305fc501","observation_id":"301f1fce-1070-456c-a0f0-94cada55ab94","resolution":{"observed_at":"2026-08-07T12:02:35.596857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.588024Z","title":"name\": \"execute_python","venue":null,"work_id":"2661c047-490e-4844-a52f-5e970cd213e5","year":null},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.459958Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:07b5a3f2e9e9b67a36f7af34f13e54d13d010ee091eaebd1059f3069a28fd0ae","observation_id":"5e0fcd20-e7db-47ad-b7ea-4909f8751a90","resolution":{"observed_at":"2026-08-07T12:02:35.590219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.581715Z","title":"Wrap the final flag in\\boxed{flag{...}}","venue":null,"work_id":"e2038c47-a630-4fb6-8c22-0266fd049e5a","year":null},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.462101Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:a2c9a0e795c6277cb611381bbd2aeb52ac4ca86a6af76680bf073db7213ad86f","observation_id":"e17357c6-677a-4135-a702-f7710af053d3","resolution":{"observed_at":"2026-08-07T12:02:35.583773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.574860Z","title":"Only write the boxed flagafter the tool’s reply (role=\"tool\") has appeared","venue":null,"work_id":"8b7699ed-2f9c-4701-a82b-fccb5bb79dbb","year":null},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.464584Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:55ad700289d2b8f9b78cc23b2e8da9344c60d23d18754cc835979b5def59e58b","observation_id":"ecd17eef-c375-40ba-b49c-514d6d1ac55f","resolution":{"observed_at":"2026-08-07T12:02:35.577357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.568113Z","title":"A vailable tools MCP_TOOL_LIST Question: QUESTION","venue":null,"work_id":"0d9945ff-9482-47b4-8530-0f5260ee8512","year":null},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.466750Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:de0fd74bff0402b3a1f7423c3ce70606d9f58d1b4a582b1a9c3f4f6980b3cd10","observation_id":"968fe1e8-ea31-402a-95c3-46bf0eb29841","resolution":{"observed_at":"2026-08-07T12:02:35.570547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 2 inbound Pith citation observations for arXiv:2506.02048."}