{"as_of":"2026-08-15T03:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a0adaa32423a88952436ed50c4dec89586aa6db45bff495488692129c99fd199","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:49:20.328915Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10621/citation-record","integrity":"/paper/2608.10621/integrity","json":"/paper/2608.10621/citation-record.json","paper":"/paper/2608.10621"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.01081","last_updated":"2025-04-08T18:38:04Z","snapshot_observed_at":"2026-08-11T21:25:27.976515Z","submitted_at":"2025-04-01T18:00:20Z","title":"ShieldGemma 2: Robust and Tractable Image Content Moderation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01081","snapshot_observed_at":"2026-08-12T20:49:20.328915Z","title":"arXiv:2504.01081","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.328915Z"},"links":{"cited_paper":"/paper/2504.01081","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:1f6a3b2840a4d3f09ac88444f64deae65810de9344b977f9be6017d92ff335cc","observation_id":"1bb3a7de-1f5f-4050-a77e-f2a6c3ae0335","resolution":{"observed_at":"2026-08-12T20:49:20.328915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:49:20.252331Z","title":"arXiv:2504.18564","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.252331Z"},"links":{"citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:4a8869d64c6e44a942b7bd25ca230212c0ba4743431d35e553ccc16b4cc6653b","observation_id":"495c0843-63a9-48e7-b64e-963c6f5d4328","resolution":{"observed_at":"2026-08-12T20:49:20.252331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:49:20.907022Z","title":"In Proceedings of the 2025 Annual Meeting of the Association for Computational Linguistics, 31983–32016","venue":null,"work_id":"dd6cb265-54df-457e-9267-c7acfb0345c5","year":2025},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.256956Z"},"links":{"citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:f587b9b459e9dd239f67b2e7691309c262ae826b1878b0208f7ae457fe844e97","observation_id":"3240d50e-4317-472b-8492-fc0c39bb1435","resolution":{"observed_at":"2026-08-12T20:49:20.914016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-12T20:49:20.261976Z","title":"InProceedings of the 2025 Findings of the Association for Computational Linguistics, 5486–5498","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.261976Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:44580b7fe875892fbb72f948cd93c73556518240a40c28c514eec90b135df5f5","observation_id":"f5289892-65ae-4f96-9549-43fb90be8abd","resolution":{"observed_at":"2026-08-12T20:49:20.261976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06452","last_updated":"2024-02-19T14:39:07Z","snapshot_observed_at":"2026-08-14T15:51:49.712613Z","submitted_at":"2023-10-10T09:25:44Z","title":"Understanding the Effects of RLHF on LLM Generalisation and Diversity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06452","snapshot_observed_at":"2026-08-12T20:49:20.267009Z","title":"arXiv:2310.06452","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.267009Z"},"links":{"cited_paper":"/paper/2310.06452","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:bf927141207016f4ad0e1fbc047794d70282fab37320555520fbf2c64b075c06","observation_id":"946ec0d2-675f-4a9a-b234-131600dea20c","resolution":{"observed_at":"2026-08-12T20:49:20.267009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04377","last_updated":"2025-08-07T14:05:19Z","snapshot_observed_at":"2026-08-14T23:29:41.181948Z","submitted_at":"2025-04-06T06:09:21Z","title":"PolyGuard: A Multilingual Safety Moderation Tool for 17 Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04377","snapshot_observed_at":"2026-08-12T20:49:20.272141Z","title":"arXiv:2504.04377","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.272141Z"},"links":{"cited_paper":"/paper/2504.04377","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:106f091c5abea79f68c0df61f65bd1ecda28987e54a845d71af5bed0dce35880","observation_id":"d7ebba70-982e-4c33-94db-516b426e44cd","resolution":{"observed_at":"2026-08-12T20:49:20.272141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:49:20.277192Z","title":"arXiv:2506.09996","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.277192Z"},"links":{"citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:43bb86a81c915a9efc97d60e98fa7e55b4d54a51ee860eb7c4b787ebf69947de","observation_id":"207e9fd0-65dc-4819-8a39-f13d0f0219c1","resolution":{"observed_at":"2026-08-12T20:49:20.277192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15588","last_updated":"2026-07-02T12:42:02Z","snapshot_observed_at":"2026-08-14T12:15:08.999795Z","submitted_at":"2026-01-22T02:23:18Z","title":"YuFeng-XGuard: A Reasoning-Centric, Interpretable, and Flexible Guardrail Model for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.15588","snapshot_observed_at":"2026-08-12T20:49:20.281887Z","title":"arXiv:2601.15588","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.281887Z"},"links":{"cited_paper":"/paper/2601.15588","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:7b280d671afecb0513e0b632551045b5886a6cb788041d0a2d22f4e768ade616","observation_id":"3c06c521-b0b7-40ef-8884-2df24cd5d024","resolution":{"observed_at":"2026-08-12T20:49:20.281887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:49:20.292635Z","title":"arXiv:2506.10805","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.292635Z"},"links":{"citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:4ac6ff2b72b8cb6205aea5d07b5fd01a7182b9dc3b834d5fe56abb9328bb1823","observation_id":"518174ce-d0cf-4fde-a1c2-f0d95fd269c2","resolution":{"observed_at":"2026-08-12T20:49:20.292635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26238","last_updated":"2026-04-21T11:04:39Z","snapshot_observed_at":"2026-08-13T23:08:30.114748Z","submitted_at":"2025-09-30T13:32:59Z","title":"Beyond Linear Probes: Dynamic Safety Monitoring for Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.26238","snapshot_observed_at":"2026-08-12T20:49:20.297142Z","title":"arXiv:2509.26238","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.297142Z"},"links":{"cited_paper":"/paper/2509.26238","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:bbdfaf956b2a810ef8199b78fe8fb88324baf44acb43d597d3cec315c17ad6e3","observation_id":"54a466bc-983e-416f-8d36-cba5664b6ffd","resolution":{"observed_at":"2026-08-12T20:49:20.297142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.19829","snapshot_observed_at":"2026-08-12T20:49:20.302614Z","title":"InProceedings of the 2025 Inter- national Conference on Machine Learning, volume 267, 48439–48469","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.302614Z"},"links":{"cited_paper":"/paper/2607.19829","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:52d144e4c646472c427c31fc93223defe431ad497054d565d080f6e700ce0960","observation_id":"15258ecd-328c-47e5-99ee-d10dba8ba14f","resolution":{"observed_at":"2026-08-12T20:49:20.302614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-12T20:49:20.308135Z","title":"Wang, R.; Zhao, H.; Wu, R.; Zhao, M.; Chu, Z.; Lin, W.; andZheng,T.2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.308135Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:4f1fd5b695ab12d428de78a2680177cd45ef7ecb724d83abcc04073a767a2874","observation_id":"64ec90b4-a756-4b10-8827-737fc81ce45f","resolution":{"observed_at":"2026-08-12T20:49:20.308135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.15081","last_updated":"2026-07-16T14:51:42Z","snapshot_observed_at":"2026-08-15T01:16:48.158309Z","submitted_at":"2026-07-16T14:51:42Z","title":"DataShield: Uncovering Risky Fine-Tuning Data Across LLMs Through Consensus Subspace Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.15081","snapshot_observed_at":"2026-08-12T20:49:20.314151Z","title":"Xiu,K.;Yang,Y.;Zeng,C.;Zheng,T.;Huang,X.;Wang,D.; Zhao, P.; Qin, Z.; and Ren, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.314151Z"},"links":{"cited_paper":"/paper/2607.15081","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:06d09aeba75faecfbd1b2164ab943f1acfd157da1e8626507d290f36145017a5","observation_id":"219e22f1-8b1a-4a43-a204-39458f4fe9f4","resolution":{"observed_at":"2026-08-12T20:49:20.314151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.02422","last_updated":"2026-08-04T19:20:15Z","snapshot_observed_at":"2026-08-14T22:16:37.488380Z","submitted_at":"2025-10-02T16:40:51Z","title":"Dynamic Jailbreaking Attack","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.02422","snapshot_observed_at":"2026-08-12T20:49:20.319212Z","title":"arXiv:2510.02422","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.319212Z"},"links":{"cited_paper":"/paper/2510.02422","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:5311694cffd92c0ff59baa43058016c3ac17cf5dc7e68a070d03ad276f469735","observation_id":"c70a672d-257b-4590-aeee-840a931c7a31","resolution":{"observed_at":"2026-08-12T20:49:20.319212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:49:20.323954Z","title":"arXiv:2602.13540","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.323954Z"},"links":{"citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:69fe438ce3856540438a73300fa24b07e90e8546e2e6bab9a119ead3e49da52a","observation_id":"891ef963-16a0-44a6-a12f-731f123013e9","resolution":{"observed_at":"2026-08-12T20:49:20.323954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14334","last_updated":"2022-06-13T05:04:53Z","snapshot_observed_at":"2026-08-09T23:45:38.167954Z","submitted_at":"2022-05-28T05:02:31Z","title":"Teaching Models to Express Their Uncertainty in Words","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14334","snapshot_observed_at":"2026-08-12T20:49:20.287445Z","title":"arXiv:2205.14334","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.287445Z"},"links":{"cited_paper":"/paper/2205.14334","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:e8d4fb4ab4bdc7882dbec4964cc71f0fb65b4adb4faee15e27f8f3bdb9db509f","observation_id":"a5891261-3a25-471a-9438-06b7a18c3f9d","resolution":{"observed_at":"2026-08-12T20:49:20.287445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T20:49:20.242523Z","title":"arXiv:2407.21783","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.242523Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:1a22a06f9d43dda2061be2a53bfe6c0b375cc5ce72009de9bf8d4da5381cadc4","observation_id":"aa0bde05-616e-43f4-94e8-d77fa0264896","resolution":{"observed_at":"2026-08-12T20:49:20.242523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-14T02:46:12.121034Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-12T20:49:20.236219Z","title":"Alain,G.;andBengio,Y.2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.236219Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:46500455135c6b0b896f59fafbc6517ab964d052cff126b99124e99f798a20a6","observation_id":"1d5cc140-fad5-4e8b-864d-ed5112c74c3d","resolution":{"observed_at":"2026-08-12T20:49:20.236219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-13T14:06:52.403728Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.02999","snapshot_observed_at":"2026-08-12T20:49:20.247547Z","title":"arXiv:2510.02999","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.247547Z"},"links":{"cited_paper":"/paper/2510.02999","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:f2324cfcd1ef779b4ed9544d1aa843d55ca0eb79634c478737671dd6e2f2956f","observation_id":"f3717779-6bdb-480c-86bb-46559091b8f2","resolution":{"observed_at":"2026-08-12T20:49:20.247547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T23:10:58.386334Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2608.10621."}