{"as_of":"2026-08-02T03:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba8eb0c65df1d81ff338e16f1b0118fa65c12f881387d0103a8c8718af45ff34","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-01T06:32:01.292127+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:21:25.563051Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.01589","snapshot_observed_at":"2026-08-01T16:21:25.563051Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18056","last_updated":"2026-07-20T15:26:23Z","snapshot_observed_at":"2026-08-01T16:21:21.666484Z","submitted_at":"2026-07-20T15:26:23Z","title":"An Early Warning of Emerging Biosecurity Risks in Frontier LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T16:21:25.563051Z"},"links":{"cited_paper":"/paper/2603.01589","citing_paper":"/paper/2607.18056"},"observation_digest":"sha256:50516026e57ee75d2d57a9b3bb83afb13386b42fada967ea087ae8e698c17430","observation_id":"affd77b5-38e3-41fb-8a5b-5339ac7598ec","resolution":{"observed_at":"2026-08-01T16:21:25.563051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.01589","snapshot_observed_at":"2026-08-01T14:45:44.097098Z","title":"Safesci: Safety evaluation of large language models in science domains and beyond.arXiv preprint arXiv:2603.01589, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18665","last_updated":"2026-07-21T03:25:01Z","snapshot_observed_at":"2026-08-01T15:13:30.638692Z","submitted_at":"2026-07-21T03:25:01Z","title":"SciHazard: A Benchmark for Measuring Scientific Safety Risks with Decomposed Harm Scoring","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T14:45:44.097098Z"},"links":{"cited_paper":"/paper/2603.01589","citing_paper":"/paper/2607.18665"},"observation_digest":"sha256:3fa01f4c228940f8f23b1f562d05404eb9ef03878daad43197061368c5e2eb96","observation_id":"dfb99e88-fc71-4050-b015-9d7219c9c2a6","resolution":{"observed_at":"2026-08-01T14:45:44.097098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2603.01589/citation-record","integrity":"/paper/2603.01589/integrity","json":"/paper/2603.01589/citation-record.json","paper":"/paper/2603.01589"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ac6f18f9-9706-4072-a951-f525af90e8bd","year":2023},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:82497ae1e8154cb2ab8a6b6e1e0ff240a40d88ee0281d38f98eff4f8f26324df","observation_id":"69bccb58-f08e-485b-ba64-87e140781be5","resolution":{"observed_at":"2026-05-15T18:01:26.341189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We split all 125 tasks into two sets,Gated Public Access setand HighRisk Restricted Access set","venue":null,"work_id":"6cd2bb2b-39f4-4eb6-baea-4a6b585ac901","year":2085},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:139581b20f79358287aaad216ada45b75f853b31bccc0291ac3446f48f722c8e","observation_id":"a0463868-eace-4862-a74e-b46ceda5927a","resolution":{"observed_at":"2026-05-15T18:01:26.345078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.01144","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6a6deb78-1d29-470c-baca-b5904f1a62e2","year":null},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:50cf85787dfa239a72251f08821e5062750628a6dabfaebecb7e5f63f8f76edb","observation_id":"50943350-583d-436c-9543-29f2b5d3c95e","resolution":{"observed_at":"2026-05-15T18:01:25.541805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.15763","doi":"10.48550/arxiv.2508.15763","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Intern-s1: A scientific multimodal foundation model","venue":null,"work_id":"9aca1953-129b-4f29-9c6f-f3f066dcb5c3","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:642b06492cd23c4e68bb73b6446826c486a40079a42039191823ed91ba7fb96f","observation_id":"b2589ea2-7fa2-4c2d-92ff-72d21cafe9ad","resolution":{"observed_at":"2026-05-15T18:01:25.535498Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10683","last_updated":"2022-10-19T15:53:36Z","snapshot_observed_at":"2026-07-06T14:07:46.643941Z","submitted_at":"2022-10-19T15:53:36Z","title":"Why Should Adversarial Perturbations be Imperceptible? Rethink the Research Paradigm in Adversarial NLP","version":1},"cited_work":{"arxiv_id":"2210.10683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.10683","snapshot_observed_at":"2026-07-04T04:09:34.710341Z","title":"Why should adversarial perturbations be imperceptible? rethink the research paradigm in adversarial nlp,","venue":null,"work_id":"8cfc21f9-ad70-4867-a284-c47761f51655","year":2022},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2210.10683","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:3fab36832ddb0a26b433b25eb8cd9d1a3827809fb70e44edb2b103df2820782a","observation_id":"472464fd-c3a2-4519-919b-01ee2029bf4f","resolution":{"observed_at":"2026-05-15T18:01:25.528515Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14739","last_updated":"2025-03-28T15:21:44Z","snapshot_observed_at":"2026-07-29T21:41:16.650188Z","submitted_at":"2025-02-20T17:05:58Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","version":4},"cited_work":{"arxiv_id":"2502.14739","doi":"10.48550/arxiv.2502.14739","metadata_source":"pith","pith_arxiv_id":"2502.14739","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","venue":"cs.CL","work_id":"58a97b2d-494b-4c1a-bd65-13fa6bb7f8f6","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2502.14739","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:78b9834e543804c29cd38160e2274fd7d405d4c77632d321514e56e809c73833","observation_id":"0fe1c598-9fcc-4c8e-916e-a273ed8c76d0","resolution":{"observed_at":"2026-05-16T00:47:04.366365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:52:42.853111+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:52:42.853111+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:61819d94b46d682d627cc4e4b6bf241afae1d48677286ebb7fb3a946beea5757","observation_id":"7a1ead7c-9d98-424e-8806-31927ff8f8a4","resolution":{"observed_at":"2026-05-15T18:01:25.554485Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.09098","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:57:24.572789Z","title":"2024 , url =","venue":null,"work_id":"dfc56081-298f-47d0-8530-94c9d51f071c","year":2024},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:4001aded8a3d1e65c7e250df7fe9c396825070c0a90507a8bc1792b8fd0fbe72","observation_id":"a12b6004-4cd2-4988-88ac-fc6ef244fb63","resolution":{"observed_at":"2026-05-15T18:01:25.521960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f40e8bba-a1f9-414e-b9db-87008140f711","year":2026},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:9e0469776cef5d01fcff1267e0490cd373aca52eee0fe620059098abc2c0cb0e","observation_id":"36667f83-b39d-4a1a-bc61-5cc16d782a26","resolution":{"observed_at":"2026-05-15T18:01:26.336964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06632","last_updated":"2023-12-11T18:50:57Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-11T18:50:57Z","title":"Control Risk for Potential Misuse of Artificial Intelligence in Science","version":1},"cited_work":{"arxiv_id":"2312.06632","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06632","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"df0833fa-7535-4519-a71a-f3eaa8a73fd5","year":null},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2312.06632","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:644dfc20cd31a90c1426f8b5a9032cce0cd979edc423ca18144afdd46aee293f","observation_id":"678099fb-4732-426b-b9a1-8f0e79af9e86","resolution":{"observed_at":"2026-05-15T18:01:25.547934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"35ce2a43-9c1f-4c1b-b32d-f92974566f9d","year":2026},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:8eab3aa2725960d53577ea282026d1fa591a7d4af933cd849ddfef7d2ed5b618","observation_id":"905da372-f9b8-4398-9af3-2bda31f53ec4","resolution":{"observed_at":"2026-05-15T18:01:26.332750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21605","last_updated":"2026-04-05T01:29:06Z","snapshot_observed_at":"2026-07-06T21:31:40.171357Z","submitted_at":"2025-05-27T17:47:08Z","title":"SoSBench: Benchmarking Safety Alignment on Six Scientific Domains","version":3},"cited_work":{"arxiv_id":"2505.21605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21605","snapshot_observed_at":"2026-06-30T11:44:38.782098Z","title":"SoSBench: Benchmarking Safety Alignment on Six Scientific Domains","venue":"cs.LG","work_id":"64f46727-9b13-4c5d-8da7-84e2412729df","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2505.21605","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:6d716ae4b8f0020760c53f56be8fc6d002e9f2a86fbe11dde0a8035689910d6c","observation_id":"6716e6ff-3368-4e39-8e49-7a5bc2dbdcbe","resolution":{"observed_at":"2026-05-15T18:01:25.616943Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"20bf327c-0228-40cf-969b-70012995814c","year":2023},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:27dd031a1120e23331306f7887e4b3cb065606c227163eac49d5aaa75cba709a","observation_id":"3d135be1-68bf-4279-b346-7668da1352cb","resolution":{"observed_at":"2026-05-15T18:01:26.319892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa981cfa-88f6-4419-9835-acc5ccd8701c","year":2024},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:9f57543e1bc341e479056d6cdbc29a7e2585cc2f4f2281216faf30442c791b81","observation_id":"07eafd48-7b4a-4fcf-8c25-f10411897d8b","resolution":{"observed_at":"2026-05-15T18:01:26.315522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18576","last_updated":"2025-08-07T08:02:42Z","snapshot_observed_at":"2026-07-06T22:02:22.451485Z","submitted_at":"2025-07-24T16:49:19Z","title":"SafeWork-R1: Coevolving Safety and Intelligence under the AI-45$^{\\circ}$ Law","version":3},"cited_work":{"arxiv_id":"2507.18576","doi":"10.48550/arxiv.2507.18576","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18576","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Safework-r1: Coevolving safety and intelligence under the AI-45 ◦ law","venue":null,"work_id":"3ff560eb-4fbf-450e-a355-69b8c5a3425d","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2507.18576","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:40fee6f2edec187be76f1f1d2d028b941e1b389069a5f866be917cfc6e1b6d9d","observation_id":"4abfd7fe-5cb2-482c-9ca5-042db629d440","resolution":{"observed_at":"2026-05-15T18:01:25.610609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03218","last_updated":"2024-05-15T19:16:09Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:59:35Z","title":"The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning","version":7},"cited_work":{"arxiv_id":"2403.03218","doi":"10.48550/arxiv.2403.03218","metadata_source":"pith","pith_arxiv_id":"2403.03218","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning","venue":"cs.LG","work_id":"d05f8523-8089-4fdb-9c07-463952166528","year":2024},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2403.03218","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:7e0eaf3e3b4e8d00e2b9ec65934b953ad85a65c24f5ef858c8895ceb277a1c3c","observation_id":"c8b38e62-a389-450e-970f-bb5c12691c84","resolution":{"observed_at":"2026-05-15T19:55:50.014661Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:22.693969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:22.693969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":"2402.04249","doi":"10.48550/arxiv.2402.04249","metadata_source":"pith","pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-07-10T15:27:20.028353Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","venue":"cs.LG","work_id":"b0b0303f-2444-4789-a979-8153624312ff","year":2024},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:d837cb70262f6c432f69a0f837882452d87ed2032d5849661948d585838c7af0","observation_id":"7f150f46-66c7-400c-8f0d-d602b34f1a6e","resolution":{"observed_at":"2026-05-15T18:01:25.623098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01786","last_updated":"2025-07-09T08:46:58Z","snapshot_observed_at":"2026-07-06T21:51:10.033007Z","submitted_at":"2025-07-02T15:12:43Z","title":"Probing and Steering Evaluation Awareness of Language Models","version":2},"cited_work":{"arxiv_id":"2507.01786","doi":"10.48550/arxiv.2507.01786","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.01786","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Probing and","venue":null,"work_id":"d9b3faf6-46cb-4e37-aef5-c67c4687b4d8","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2507.01786","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:6a9957f2e9b42b27db327d3abb5ff011bae07df7d34069b060be12da33b58d34","observation_id":"7a9f240b-0e1a-4899-9896-482ff365bc62","resolution":{"observed_at":"2026-05-15T18:01:25.603359Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0c4c2a5d-2f74-4643-85de-089c94360689","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:78f71881ee90370ffa05b11a2a5a6f719aec9fe0bb0dff78c6c5bc2e57aa05b7","observation_id":"b6022c6a-5560-4088-9723-2352897489c3","resolution":{"observed_at":"2026-05-15T18:01:26.328132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5349a4fd-920b-4f97-afaf-f433f28e9d4c","year":2026},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:44809767a9da934db38b4f688c58f2b149cb72930961a754fde205e16b99babb","observation_id":"614640aa-d0a4-43d6-bf38-ab4e4f7d7006","resolution":{"observed_at":"2026-05-15T18:01:26.323679Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:1627ea746bbbfdc0f47b9e9782882eda5c2926ea0381d5f087dee65bef8ba099","observation_id":"6bb84f98-db4b-472d-beeb-68fab9f77420","resolution":{"observed_at":"2026-05-15T18:01:25.596110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accessed: 2026-01-29","venue":null,"work_id":"822dddeb-aab3-4a19-99c5-b5729a7ed16c","year":2026},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:3c40f49f21d262ca15e4b598405c8062e9e23e06b2e4cd255ca0facaed4a874e","observation_id":"cee15327-83a4-414a-b92b-f201f669c678","resolution":{"observed_at":"2026-05-15T18:01:26.310950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":"2506.05176","doi":"10.1016/j.displa.2025.103255","metadata_source":"pith","pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","venue":"cs.CL","work_id":"bab684a8-d933-426c-a19e-2c855a0d1f59","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:ccc744d0efe22909516cbe98318c58026ac05b6d4a1cf246d960cd8faaba6755","observation_id":"93886e3c-a0e1-4be5-8bce-e27eeb57d4ac","resolution":{"observed_at":"2026-05-15T18:01:25.243853Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15526","last_updated":"2025-08-21T13:00:53Z","snapshot_observed_at":"2026-07-06T22:16:10.264966Z","submitted_at":"2025-08-21T13:00:53Z","title":"SafetyFlow: An Agent-Flow System for Automated LLM Safety Benchmarking","version":1},"cited_work":{"arxiv_id":"2508.15526","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15526","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"69d0067a-f03a-42ed-9f09-9c9842d4d712","year":null},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2508.15526","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:c0d26cfc8efe23357f69663ceb2100c24158e9e9223f3022f13377d2e31ec445","observation_id":"dbee5bae-42ba-40d1-a12f-3e827a123fd9","resolution":{"observed_at":"2026-05-15T18:01:25.575015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2307.15043","doi":"10.48550/arxiv.2307.15043","metadata_source":"pith","pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-07-11T02:47:49.837877Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":"cs.CL","work_id":"3322fa86-1768-4677-8425-dd326b45e078","year":2023},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:8a8db7917dd4dfacba4187da81094e3e44c07c29c4bbf71c2f9153985fe6c719","observation_id":"f6f258be-97c4-4423-ad54-4beea4f501d0","resolution":{"observed_at":"2026-05-15T18:01:25.588604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.01055","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ans.” represent if the questions have corresponding answers. “Rep","venue":null,"work_id":"f8751815-3529-4c9c-9131-b84da9780ca6","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:84f93498e974ea92c258c87d69867c32eda60403004be78756938cd56def6d03","observation_id":"af3b1add-78f6-45e4-a25c-52dd2c13dea4","resolution":{"observed_at":"2026-05-15T18:01:25.581771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"80a425fb-8778-423e-9afa-280c50be26df","year":2009},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:3c807a8c3684f9ee9265157b53ccc04634164013b13bc0651c780ceb8cf992e6","observation_id":"0fe6894c-4ced-4bb3-82ff-d16ee20b6920","resolution":{"observed_at":"2026-05-15T18:01:26.349334Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":7,"verified_exact":16,"verified_fuzzy":2},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"thesis":"As of 2 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 2 inbound Pith citation observations for arXiv:2603.01589."}