{"as_of":"2026-08-08T21:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0742e3a1a104f64a64fc7470c540d94cc39e2bb4aa1fde00f2c9ca8e38ba9402","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:14:51.253269Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20476/citation-record","integrity":"/paper/2607.20476/integrity","json":"/paper/2607.20476/citation-record.json","paper":"/paper/2607.20476"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:49.900675Z","title":"TLVs and BEIs: Threshold Limit Values for Chemical Substances and Physical Agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:49.900675Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:5046605e38ac1c82b9bade3521ed40277fc82dba6f1be37928868fccc3d1c9f6","observation_id":"038fc250-5a5b-4c28-b068-d93bd22c1a37","resolution":{"observed_at":"2026-08-02T13:14:49.900675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:49.953140Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:49.953140Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:365c134e229bda702dd9b2514986523e7003c5ee1fb656285fb19cfc9e1681dd","observation_id":"2b583cfb-e766-403d-825c-3a4d49847ea5","resolution":{"observed_at":"2026-08-02T13:14:49.953140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:50.045042Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.045042Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:bb6b4ffd04e0b415f8f498967d5b063ffc81a8cf4cd66d57ef4cfcc392fa664b","observation_id":"683d7d27-0a58-4e61-988d-a4a971d86fc7","resolution":{"observed_at":"2026-08-02T13:14:50.045042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:50.109540Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.109540Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:005c9b791ac4b1e376c9ff70f4a3b3285976d890aaa0c55a9301aa715ebed386","observation_id":"f49e2470-1c7b-4f1a-b54e-242f5abda3d9","resolution":{"observed_at":"2026-08-02T13:14:50.109540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-02T13:14:50.186286Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.186286Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:6e1bae2f87547366cf92221c66f462efe6b11cb11204d9ec1de78f59f6907b81","observation_id":"499d64ff-c6b9-4ba1-800c-5f76b9d90bb4","resolution":{"observed_at":"2026-08-02T13:14:50.186286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:50.300148Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.300148Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:f89b2f18716cd900e6c926e58386ef339f90f9ceb479e176d357ae476f33e807","observation_id":"e7c544ee-2325-464b-8898-5499394f93fa","resolution":{"observed_at":"2026-08-02T13:14:50.300148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:50.394336Z","title":"SensorBench: Establishing the first systematic benchmark for LLM sensor processing capabilities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.394336Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:21a28f36fe270fa47f884000e2dc1647fcaf2245c9d5a4507450b7cb59a40832","observation_id":"440fc7ed-b402-4d94-8de0-fe481b07e941","resolution":{"observed_at":"2026-08-02T13:14:50.394336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:50.444613Z","title":"Immediately dangerous to life or health concentrations (IDLH)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.444613Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:e1d729688216330b65bf6dbb783e0062dd99e8953a2a3caa6b35b499c4527c62","observation_id":"b153188d-1951-47ef-b133-48af35bcbc07","resolution":{"observed_at":"2026-08-02T13:14:50.444613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:50.516665Z","title":"Air contaminants","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.516665Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:93bded93d64f880b1a1d05701e0835289a25a1d160ac3e06e5a8b7c0a14cead8","observation_id":"fc9e5bec-715b-4cc3-bcf8-88e616220955","resolution":{"observed_at":"2026-08-02T13:14:50.516665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-02T13:14:50.624052Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.624052Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:3fab9d3ac46a764dce3b46d082bdb825a7df996f66ae0a5627431a35a4725687","observation_id":"aaa155cb-f0ff-4115-ba41-8ac8f3b3f939","resolution":{"observed_at":"2026-08-02T13:14:50.624052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:50.738113Z","title":"WHO Global Air Quality Guidelines","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.738113Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:3fd564888fa60bd0048e013d6635ca3d965b317f868c61fa1eaff4dc120648f3","observation_id":"f5f5c605-6b3a-405a-a54c-2b006b98941e","resolution":{"observed_at":"2026-08-02T13:14:50.738113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:50.832006Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.832006Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:7587f4beff627de946c0932c3fd2441319b2c0337fec0c048efb938a4cfe71eb","observation_id":"9dc88eda-1346-4597-b0ab-f481e917b550","resolution":{"observed_at":"2026-08-02T13:14:50.832006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:50.900790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:50.900790Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:4a6eb576225d95f49de909186543a4da1ffbdc9e558731df7f4b6002dc41c57c","observation_id":"2c7d812e-b617-42c0-806f-1c92ba744863","resolution":{"observed_at":"2026-08-02T13:14:50.900790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:51.010819Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:51.010819Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:886d2c87f83f3d3b23d00acfda0a5b3f7cbf452b62de51497470d4fbf64c7f68","observation_id":"99314deb-92e7-431b-b7f0-a3d716053d9f","resolution":{"observed_at":"2026-08-02T13:14:51.010819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05093","last_updated":"2025-05-12T01:30:34Z","snapshot_observed_at":"2026-07-06T18:58:52.488614Z","submitted_at":"2024-08-09T14:34:32Z","title":"Order Matters in Hallucination: Reasoning Order as Benchmark and Reflexive Prompting for Large-Language-Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05093","snapshot_observed_at":"2026-08-02T13:14:51.099296Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:51.099296Z"},"links":{"cited_paper":"/paper/2408.05093","citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:3b1558c6c4947af6d88ee3f246528dcf7ce0128e3d4dcd6bdb8d7c72f7c6e87a","observation_id":"83542397-ec13-4bbd-b458-bffc8a9ff225","resolution":{"observed_at":"2026-08-02T13:14:51.099296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:14:51.253269Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T13:14:51.253269Z"},"links":{"citing_paper":"/paper/2607.20476"},"observation_digest":"sha256:d22e183dabaf4a197083e59b3b5acfd2389a77b0f8aaabd51601d3a1991df25b","observation_id":"69a72ace-a158-44c9-b90c-cc216f6537f6","resolution":{"observed_at":"2026-08-02T13:14:51.253269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20476","last_updated":"2026-05-25T05:43:37Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-02T13:14:49.178030Z","submitted_at":"2026-05-25T05:43:37Z","title":"Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2607.20476."}