{"as_of":"2026-08-09T17:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5bca4987ace04ebe06c4712c3b84c02b73b4d0cea173a9fe5efcb379c735a7b2","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:15:45.016767Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T08:17:10.481202Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"cited_work":{"arxiv_id":"2502.07985","doi":"10.48550/arxiv.2502.07985","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07985","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Metasc: Test-time safety specification optimization for language models","venue":"ArXiv.org","work_id":"31090847-eb32-45fa-805c-126e57282c1c","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":194,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2502.07985","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:cb7cff66ffbda201ac456dbf39e60bb876531a1ffc3fa417c91fb9784d1fcc53","observation_id":"3fd0c1e7-a6d4-41c3-87cf-042ecdf831cb","resolution":{"observed_at":"2026-05-12T08:41:23.482650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"cited_work":{"arxiv_id":"2502.07985","doi":"10.48550/arxiv.2502.07985","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07985","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Metasc: Test-time safety specification optimization for language models","venue":"ArXiv.org","work_id":"31090847-eb32-45fa-805c-126e57282c1c","year":2025},"citing_paper":{"arxiv_id":"2606.07539","last_updated":"2026-04-29T17:39:36Z","snapshot_observed_at":"2026-08-02T12:30:34.186010Z","submitted_at":"2026-04-29T17:39:36Z","title":"Prompt Governance? On Governing Technologies Governed by Natural Language","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-07-01T08:17:10.481202Z"},"links":{"cited_paper":"/paper/2502.07985","citing_paper":"/paper/2606.07539"},"observation_digest":"sha256:14db78b85d3f7de8bd2431991f168d45856bf941c8cf9a947123c96b480722c5","observation_id":"ba2fea89-06d9-46f3-aa23-ece80465df79","resolution":{"observed_at":"2026-07-01T08:25:32.875448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07985/citation-record","integrity":"/paper/2502.07985/integrity","json":"/paper/2502.07985/citation-record.json","paper":"/paper/2502.07985"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.16339","last_updated":"2025-01-08T20:11:59Z","snapshot_observed_at":"2026-08-07T23:13:03.652587Z","submitted_at":"2024-12-20T21:00:11Z","title":"Deliberative Alignment: Reasoning Enables Safer Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16339","snapshot_observed_at":"2026-08-08T11:15:44.972604Z","title":"Deliberative alignment: Reasoning enables safer language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.972604Z"},"links":{"cited_paper":"/paper/2412.16339","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:02dd5a6a523a2f260b44f550d3b087d48db98f1909746b166594530d0291151d","observation_id":"2022d310-a28d-4ce0-8134-f1ba8f434780","resolution":{"observed_at":"2026-08-08T11:15:44.972604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-08T11:15:44.977046Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.977046Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:6b9a25a1bac331bacbe94c2089a3820663a718e64c5bbbd2176fa11acb487841","observation_id":"599b5898-dc2b-4146-843a-b5fcd295d9aa","resolution":{"observed_at":"2026-08-08T11:15:44.977046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T11:15:44.984746Z","title":"Aman Madaan, Niket Tandon, Prakhar Gupta, Skyler Hallinan, Luyu Gao, Sarah Wiegreffe, Uri Alon, Nouha Dziri, Shrimai Prabhumoye, Yiming Yang, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.984746Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:046add02995d8ce3df8ca5b537dd5d0e31562a446ea2c7d07b478bd22a8a3637","observation_id":"d282f1f9-1687-410f-9a03-37dda913f7c1","resolution":{"observed_at":"2026-08-08T11:15:44.984746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06255","last_updated":"2024-10-31T12:24:14Z","snapshot_observed_at":"2026-08-04T04:01:58.351175Z","submitted_at":"2024-02-09T09:09:39Z","title":"Fight Back Against Jailbreaking via Prompt Adversarial Tuning","version":4},"cited_work":{"arxiv_id":"2402.06255","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.06255","snapshot_observed_at":"2026-08-08T11:15:45.081276Z","title":"Fight Back Against Jailbreaking via Prompt Adversarial Tuning","venue":"cs.LG","work_id":"67eea855-2835-4690-997e-727340559eda","year":2024},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.988029Z"},"links":{"cited_paper":"/paper/2402.06255","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:49896754d374a85964a6e610a1dc5b6d564e616702a943eb5faa4e3cee88d801","observation_id":"2e7d7c88-ac9b-42c2-9fa1-c29ab2ee356b","resolution":{"observed_at":"2026-08-08T11:15:45.087589Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-08T11:15:44.990935Z","title":"Smoothllm: Defending large language models against jailbreaking attacks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.990935Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:dcac92ed1b4e18055c78106fc6372ce4265dee226baa6bc7db0e7d4cda067b4c","observation_id":"4b5db248-9976-4374-b751-22a3d133c73a","resolution":{"observed_at":"2026-08-08T11:15:44.990935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:15:45.180824Z","title":"” do anything now”: Characterizing and evaluating in-the-wild jailbreak prompts on large language models","venue":null,"work_id":"e04b61fb-42d8-428c-a06b-608d0c8f49c9","year":2024},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.994573Z"},"links":{"citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:60649201ac1b0afbbca25f87a823ade46f2f975b6fd2aa8e001f26d3867811e3","observation_id":"ec7ad2e0-4ac6-4a6c-9c60-59326b626e3b","resolution":{"observed_at":"2026-08-08T11:15:45.184439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:15:45.169802Z","title":"Noah Shinn, Federico Cassano, Ashwin Gopinath, Karthik Narasimhan, and Shunyu Yao","venue":null,"work_id":"9b72fcf6-2bc6-4dc8-9898-7a3020f9e789","year":2025},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.998969Z"},"links":{"citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:fec6053cf3e6520f285a7b10863e7cffdd06773674ad7cc2d04874d228d2b227","observation_id":"169c8b7a-e174-4a73-a2ab-c6fe5b378ac2","resolution":{"observed_at":"2026-08-08T11:15:45.172974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07961","last_updated":"2023-11-14T07:26:32Z","snapshot_observed_at":"2026-07-06T16:47:12.709738Z","submitted_at":"2023-11-14T07:26:32Z","title":"The ART of LLM Refinement: Ask, Refine, and Trust","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07961","snapshot_observed_at":"2026-08-08T11:15:45.002434Z","title":"The art of llm refinement: Ask, refine, and trust","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:45.002434Z"},"links":{"cited_paper":"/paper/2311.07961","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:294434c0399ac8e86e982bad6198a3ea2ed1d3e5d63959cbf8f46e2b489bb0e3","observation_id":"d99bd8a6-60a0-4f3d-ae45-01b02d561c2a","resolution":{"observed_at":"2026-08-08T11:15:45.002434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17703","last_updated":"2025-03-29T15:21:55Z","snapshot_observed_at":"2026-08-06T17:25:43.987350Z","submitted_at":"2025-01-29T15:20:30Z","title":"Critique Fine-Tuning: Learning to Critique is More Effective than Learning to Imitate","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17703","snapshot_observed_at":"2026-08-08T11:15:45.006636Z","title":"Critique fine-tuning: Learning to critique is more effective than learning to imitate","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:45.006636Z"},"links":{"cited_paper":"/paper/2501.17703","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:6e5b2dc4576613491d582b22200920780a1de481688e3ed7d0173df7cf6d633d","observation_id":"2335f18c-ae00-4d3a-aa4c-0bb93ef66df7","resolution":{"observed_at":"2026-08-08T11:15:45.006636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06387","last_updated":"2024-05-25T07:01:15Z","snapshot_observed_at":"2026-08-06T13:25:52.403871Z","submitted_at":"2023-10-10T07:50:29Z","title":"Jailbreak and Guard Aligned Language Models with Only Few In-Context Demonstrations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06387","snapshot_observed_at":"2026-08-08T11:15:45.010325Z","title":"Jailbreak and guard aligned language models with only few in-context demonstrations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:45.010325Z"},"links":{"cited_paper":"/paper/2310.06387","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:c2cb0da2748be7306dec622edb7f7c6c626785cf292d859dab085a0213d09f1b","observation_id":"e2a488f1-08c4-43a6-a2a4-94b88f78a080","resolution":{"observed_at":"2026-08-08T11:15:45.010325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02855","last_updated":"2025-05-20T05:38:08Z","snapshot_observed_at":"2026-07-06T18:40:44.305259Z","submitted_at":"2024-07-03T07:14:05Z","title":"From Theft to Bomb-Making: The Ripple Effect of Unlearning in Defending Against Jailbreak Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02855","snapshot_observed_at":"2026-08-08T11:15:45.013448Z","title":"Zhexin Zhang, Junxiao Yang, Pei Ke, Shiyao Cui, Chujie Zheng, Hongning Wang, and Minlie Huang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:45.013448Z"},"links":{"cited_paper":"/paper/2407.02855","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:4a126500c968dec37f25839b01960d5152e3cfc556fe2d0283ea73860a6579bc","observation_id":"8f65bae9-4b97-4834-8339-ca1575789c22","resolution":{"observed_at":"2026-08-08T11:15:45.013448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:15:45.160901Z","title":"t spect 0 Safety and harmless","venue":null,"work_id":"0c1a9bfc-ead1-43fa-9bd0-8658ab126413","year":2025},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:45.016767Z"},"links":{"citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:fe4e34d2ce7ec486205b899051f43ef8b281ab1160c077474a25879bafb6f104","observation_id":"61923c79-eda0-4f66-ace6-2420611a4b4f","resolution":{"observed_at":"2026-08-08T11:15:45.163848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00495","last_updated":"2024-03-30T23:28:05Z","snapshot_observed_at":"2026-07-06T17:53:31.221833Z","submitted_at":"2024-03-30T23:28:05Z","title":"Configurable Safety Tuning of Language Models with Synthetic Preference Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00495","snapshot_observed_at":"2026-08-08T11:15:44.963870Z","title":"Configurable safety tuning of language models with synthetic preference data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.963870Z"},"links":{"cited_paper":"/paper/2404.00495","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:3003a888a0ad5fe2eac680db1d39dd3019badcd7c2e0c0fc455ee55479b4d432","observation_id":"8d0a213c-c91b-4670-93f4-8d7e9cdff5f3","resolution":{"observed_at":"2026-08-08T11:15:44.963870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-07-06T19:46:24.121362Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-08T11:15:44.960566Z","title":"Haolin Chen, Yihao Feng, Zuxin Liu, Weiran Yao, Akshara Prabhakar, Shelby Heinecke, Ricky Ho, Phil Mui, Silvio Savarese, Caiming Xiong, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.960566Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:dac0f2072b3704216c2fb4110db3ed7a9c20d608b02a31e75ce2597db1f615e3","observation_id":"35a6b2f9-8d39-4f06-adff-8953b346837d","resolution":{"observed_at":"2026-08-08T11:15:44.960566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-08T11:15:44.968673Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.968673Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:f8c6a966b8ced60e08c1e879cfb0d4820d38b1c53731269513c579cb6f66aa09","observation_id":"87375eb2-47a2-4606-a742-5d48d49c85f9","resolution":{"observed_at":"2026-08-08T11:15:44.968673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-08T11:15:44.956043Z","title":"Yuntao Bai, Saurav Kadavath, Sandipan Kundu, Amanda Askell, Jackson Kernion, Andy Jones, Anna Chen, Anna Goldie, Azalia Mirhoseini, Cameron McKinnon, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.956043Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:eab89394e8970f3d1af841ab834ed2cf7362a1ea473b16657cfbe375a3eece00","observation_id":"fbc5c325-868a-42c1-87dc-236572a5aafb","resolution":{"observed_at":"2026-08-08T11:15:44.956043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05761","last_updated":"2025-03-25T07:12:10Z","snapshot_observed_at":"2026-08-07T22:48:13.711556Z","submitted_at":"2024-06-09T12:30:30Z","title":"The BiGGen Bench: A Principled Benchmark for Fine-grained Evaluation of Language Models with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05761","snapshot_observed_at":"2026-08-08T11:15:44.981245Z","title":"The biggen bench: A principled benchmark for fine-grained evaluation of language models with language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T11:15:44.981245Z"},"links":{"cited_paper":"/paper/2406.05761","citing_paper":"/paper/2502.07985"},"observation_digest":"sha256:d3d0e1857a55d386e183f43addbfe16796c767f4882121a4fd07aa889472040b","observation_id":"edf4a044-44f1-432b-a217-65ca0d19f1f8","resolution":{"observed_at":"2026-08-08T11:15:44.981245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07985","last_updated":"2025-04-07T09:15:30Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T11:11:08.143477Z","submitted_at":"2025-02-11T22:06:25Z","title":"MetaSC: Test-Time Safety Specification Optimization for Language Models"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 2 inbound Pith citation observations for arXiv:2502.07985."}