{"as_of":"2026-08-08T11:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8a91c6271c092a8abdd6a58643c2c004a4854cee8c0e4511d6c856084b556e58","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:01:08.215841Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T20:54:21.584820Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-08-07T12:01:08.215841Z","title":"Beutel, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.215841Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:57f04d09a04bfabc06c959cece57cae431415061a9aac92a37faf0bc0516c0b3","observation_id":"a57cad7f-0a66-442d-ba67-07d698debdec","resolution":{"observed_at":"2026-08-07T12:01:08.215841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-08-07T05:47:06.264820Z","title":"Beutel, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-07T05:39:20.659933Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.264820Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:5e5eff1c30842d62a1416e9301ff73852b6d50367474f4dca1bcad41b4614816","observation_id":"ac7ef433-3e74-412b-8fe7-9589df932fb0","resolution":{"observed_at":"2026-08-07T05:47:06.264820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.18693","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diverse and effective red teaming with auto-generated rewards and multi-step reinforcement learning","venue":null,"work_id":"327614ef-ef41-447c-9f72-6569e5523fd3","year":2024},"citing_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-19T05:48:02.828938Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2507.06261"},"observation_digest":"sha256:496d2bbdb94969645629b86e0ae9f1ecc666ce8db4173f60ea54a6c408cb7104","observation_id":"536888bb-9079-4d5f-ab57-719aa7f2a0f4","resolution":{"observed_at":"2026-05-19T05:52:07.721429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-08-06T14:45:20.401969Z","title":"Diverse and effective red teaming with auto-generated rewards and multi-step reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17922","last_updated":"2025-07-23T20:39:14Z","snapshot_observed_at":"2026-08-06T14:37:37.075855Z","submitted_at":"2025-07-23T20:39:14Z","title":"From Seed to Harvest: Augmenting Human Creativity with AI for Red-teaming Text-to-Image Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:20.401969Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2507.17922"},"observation_digest":"sha256:c7af69cd3c9bbb2e253527559c95ad75fdeb488945f52aa9f1494566a7dba7e4","observation_id":"f65c26c6-c0b8-4993-b6c5-7d009c0c4e55","resolution":{"observed_at":"2026-08-06T14:45:20.401969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.18693","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diverse and effective red teaming with auto-generated rewards and multi-step reinforcement learning","venue":null,"work_id":"327614ef-ef41-447c-9f72-6569e5523fd3","year":2024},"citing_paper":{"arxiv_id":"2510.07239","last_updated":"2026-05-17T13:01:38Z","snapshot_observed_at":"2026-08-02T19:25:51.433055Z","submitted_at":"2025-10-08T17:06:20Z","title":"Red-Bandit: Test-Time Adaptation for LLM Red-Teaming via Bandit-Guided LoRA Experts","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T20:53:58.198974Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2510.07239"},"observation_digest":"sha256:dfac48a09a9bcbdfad99d6b24ba16b5e80c6fb77c3340c895de401ca1e6d62a9","observation_id":"4861d50b-d0bd-417c-95cb-0513527f72a6","resolution":{"observed_at":"2026-05-21T20:54:21.586690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-08-01T01:12:44.118461Z","title":"Beutel, A., Xiao, K., Heidecke, J., and Weng, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.118461Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:8b9a75dd680161af7d823b8d6b6148d14cd67c6814b365aaf323c567285d9b14","observation_id":"e8a800fe-adaf-4bc1-b6ff-5bf651c93279","resolution":{"observed_at":"2026-08-01T01:12:44.118461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18693/citation-record","integrity":"/paper/2412.18693/integrity","json":"/paper/2412.18693/citation-record.json","paper":"/paper/2412.18693"},"outbound":[],"paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2412.18693."}