{"as_of":"2026-08-23T14:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e47eb26d8bb1820f8f3c54657e52bbc938a21742c5e5706fe4e14de1f62f811","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:09:01.393974Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:21:11.287455Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T10:41:07.580051Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"cited_work":{"arxiv_id":"2505.19973","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19973","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A., et al","venue":null,"work_id":"862c8437-f0ca-4ca1-a10f-b51eb40f75cb","year":2025},"citing_paper":{"arxiv_id":"2604.12040","last_updated":"2026-04-13T20:32:03Z","snapshot_observed_at":"2026-08-20T05:50:53.327041Z","submitted_at":"2026-04-13T20:32:03Z","title":"SIR-Bench: Evaluating Investigation Depth in Security Incident Response Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T15:21:11.287455Z"},"links":{"cited_paper":"/paper/2505.19973","citing_paper":"/paper/2604.12040"},"observation_digest":"sha256:d90f71dfd0885f67b6d2463b252de7dd4010b4151248f11d37336ad26712bf26","observation_id":"3ee7520f-eeab-46dd-a785-7edb08ccdea1","resolution":{"observed_at":"2026-05-11T10:41:07.583631Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19973/citation-record","integrity":"/paper/2505.19973/integrity","json":"/paper/2505.19973/citation-record.json","paper":"/paper/2505.19973"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:09.387564Z","title":"In: Advances in Neural Information Processing Systems 37 (NeurIPS 2024), Datasets and Benchmarks Track (2024)","venue":null,"work_id":"98263213-3856-45fd-9b62-2b7aa1ffb7be","year":2024},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:21.853495Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:82aaaf2ef42b1b952dbb305036993c3f62e3c4f9f476a1cdd2e69c2e23328f52","observation_id":"8e7400f4-1739-431f-b46a-09b65903ab69","resolution":{"observed_at":"2026-08-07T14:09:09.459205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05366","last_updated":"2026-04-06T23:43:02Z","snapshot_observed_at":"2026-08-14T10:23:20.676290Z","submitted_at":"2024-08-09T22:29:43Z","title":"The DeepSpeak Dataset","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05366","snapshot_observed_at":"2026-08-07T14:08:21.909923Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:21.909923Z"},"links":{"cited_paper":"/paper/2408.05366","citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:899f67db517d839ff5225cda7abd36c46ace69b9f58ce7088b95f4e89dbeb76b","observation_id":"7c401da4-505c-4185-88f3-09e4dca02f06","resolution":{"observed_at":"2026-08-07T14:08:21.909923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:09.104923Z","title":"In: Proceedings of the 8th International Con- ference on Information Systems Security and Privacy","venue":null,"work_id":"a978bbf7-8664-45d1-942b-71984ce1e675","year":2022},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.005344Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:6f825cc7a85c085c6dd974f4acf6950df1c51b95a74faa50273a60909b56153d","observation_id":"ce3740db-48bf-4642-80df-11a6ad02864e","resolution":{"observed_at":"2026-08-07T14:09:09.244776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:08.744782Z","title":null,"venue":null,"work_id":"72ff389b-972c-4ddf-bb1d-173ca7aa06d4","year":2025},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.099945Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:8505c77941e01a5ae041cc3c207081955043165b02e597a20f86d7f06ee77423","observation_id":"42bfa150-170b-405d-be2d-e18e8abd04f9","resolution":{"observed_at":"2026-08-07T14:09:08.864757Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3168.27131","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:06.824745Z","title":null,"venue":null,"work_id":"56ba284a-1845-42e0-b88f-1cd9e1d55fd9","year":2015},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.173948Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:e65c22452e38cfd685be8f05bb07fa5ab4bb4b7b515085f12255d3bdbbd5efb0","observation_id":"56870997-740c-4c89-8fb4-37d16de7c9d1","resolution":{"observed_at":"2026-08-07T14:09:06.944745Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:22.268933Z","title":"In: Al-Onaizan, Y., Bansal, M., Chen, Y.N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.268933Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:1734db833d677e1866c1721c6454867cab664c32b8b29f319c9bbb335970e167","observation_id":"c8fbc282-17a1-4067-81e6-1c9bb0a5c761","resolution":{"observed_at":"2026-08-07T14:08:22.268933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:22.387683Z","title":"Internet of Things and Cyber-Physical Systems5, 1–46 (2025).https://doi.org/10.1016/j.iotcps.2025.01.001","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.387683Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:b9a9f18cce690dad47b0e13738fe1af9ee12ab809c302563558f57e5ba875c90","observation_id":"686507d1-4c77-4c22-a672-4981dd42c0e7","resolution":{"observed_at":"2026-08-07T14:08:22.387683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:22.483604Z","title":"IEEE Access12, 23733–23750 (2024).https://doi.org/10.1109/ACCESS","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.483604Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:9b753c8edd1ad1adde158fe59a8832934d2ffe0ba336e93307347ac6042cb76e","observation_id":"522d94ff-2cf8-4a0a-b126-814867508d6f","resolution":{"observed_at":"2026-08-07T14:08:22.483604Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04872","last_updated":"2025-12-23T02:23:47Z","snapshot_observed_at":"2026-08-13T13:45:44.430193Z","submitted_at":"2024-11-07T17:07:35Z","title":"FrontierMath: A Benchmark for Evaluating Advanced Mathematical Reasoning in AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04872","snapshot_observed_at":"2026-08-07T14:08:22.589495Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.589495Z"},"links":{"cited_paper":"/paper/2411.04872","citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:e0511d6efe73b894e9e1d932c93a8e751c22babcae4a5822a429156a1bb8b149","observation_id":"4857d67b-0746-4bc9-ad44-c737b17a1ac4","resolution":{"observed_at":"2026-08-07T14:08:22.589495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.30126","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:06.318216Z","title":"Forensic Science International: Digital Investigation38, 301264 (Sep 2021).https: //doi.org/10.1016/j.fsidi.2021.301264","venue":null,"work_id":"b8edc298-287e-4f73-947b-69e5ca3a6e49","year":2021},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.674613Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:98fd9c8ce10f7f74c1b72dbdc474c5e2fc4350c125a0b5923c6571e649f9084c","observation_id":"d5079905-c200-4c49-bdcf-a3a00b93d006","resolution":{"observed_at":"2026-08-07T14:09:06.382074Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:08.355286Z","title":"Packt Publishing, Birm- ingham, England, 2 edn","venue":null,"work_id":"3a023d34-b15e-4b65-a875-8f85c70cddf9","year":2020},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.783874Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:dd5f6251dca3dc30290cfdadd5d6b003c5c7600b8301e5faf70918540c699676","observation_id":"ac2167b3-5f91-457d-99b2-919a03ed2e68","resolution":{"observed_at":"2026-08-07T14:09:08.564416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:22.852771Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.852771Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:4bea1f42d616ebecd3cb2d77a42151d088d6e1c93ffd0725163a69cb7a05b575","observation_id":"e35c8751-ab69-4505-8fde-fc46e66d96df","resolution":{"observed_at":"2026-08-07T14:08:22.852771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:08.024035Z","title":null,"venue":null,"work_id":"a836f400-36ac-4cc3-88a2-f6c1dd5f50a5","year":2006},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:22.916291Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:4ec5243571dbac19ec3a8fb16191ab580001af8173fbaa87cf79c912d1bef74f","observation_id":"0c4b10b2-35ba-456a-a8fa-bc92a2cab5d7","resolution":{"observed_at":"2026-08-07T14:09:08.114762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.31855","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:05.968377Z","title":"IEEE Networking Letters4(3), 162–166 (Sep 2022).https://doi.org/10.1109/ LNET.2022.3185553 14 B","venue":null,"work_id":"f662ff66-e858-47e0-83bc-2bde0e7962a9","year":2022},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:23.036548Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:01afa2ca9fdc9a36fe12d33edd5e4ec62cdd1b7eabac6ada217b35ae17abe5a7","observation_id":"9e7c063d-4d7d-4325-bfa6-57f05b040eb7","resolution":{"observed_at":"2026-08-07T14:09:06.053146Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:23.148460Z","title":"In: GLOBECOM 2022 - 2022 IEEE Global Communications Conference","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:23.148460Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:78ba07b081ae095a7f1174e180c7d65d92e4209eff41c7f5d194710cb17414b0","observation_id":"72a33af0-4852-4e67-99d9-f8b2a6b444e6","resolution":{"observed_at":"2026-08-07T14:08:23.148460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/computers14020067","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Computers14(2), 67(Feb2025).https://doi.org/10.3390/computers14020067, number: 2 Publisher: Multidisciplinary Digital Publishing Institute","venue":"Computers","work_id":"1293e55e-4116-47eb-b20d-428c5942261a","year":null},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:23.254903Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:c12f25439ee9748bd0eab5a1b5ed39920f8689f691caf421cb37a68c39356c82","observation_id":"1a0a9d54-458c-4caf-b6ba-91cb97dc44b2","resolution":{"observed_at":"2026-08-07T14:09:02.304749Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.30168","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:05.293997Z","title":"Forensic Science International: Digital Investigation48, 301683 (Mar 2024)","venue":null,"work_id":"ed37e921-7e86-4924-8334-e425887f9830","year":2024},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:59.406401Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:5bd5a3b72732aaaa64f0ae9e1bafbf0e758ff0b1aca86c636d55f534e65981cb","observation_id":"22996b99-e82f-405c-810c-79745a1871aa","resolution":{"observed_at":"2026-08-07T14:09:05.635934Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:59.482147Z","title":"Ad Hoc Networks174, 103840 (Jul 2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:59.482147Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:aa941253693f59d816eb868a7a47dca8b29c85d2f7cfa0e3f59567a8de5b73d9","observation_id":"e6d8b77f-7fc2-4c84-bca1-87ff85087c27","resolution":{"observed_at":"2026-08-07T14:08:59.482147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.comnet.2023","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:02.029355Z","title":"Computer Networks227, 109688 (May 2023).https://doi.org/10.1016/j.comnet.2023","venue":null,"work_id":"6abb8ae3-eaf8-4b8a-b610-9d1fd98a579d","year":2023},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:59.575213Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:eb0072885dfe3ea1b3e00fb9904795ffabaab162fa9d927f8ca4ba37840ee53f","observation_id":"044247eb-f8c9-4e0d-8efa-6cdf17a71cdd","resolution":{"observed_at":"2026-08-07T14:09:02.097738Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:59.724751Z","title":"In: 2024 5th International Conference in Electronic Engineering, Information Technology & Education (EEITE)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:59.724751Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:4dffb05b16ff72915f00f285c60a7b59434cd5043b65fe2b8fb319eb63ef203c","observation_id":"e2e559d2-a13e-442e-b6e0-aaa4a46e923e","resolution":{"observed_at":"2026-08-07T14:08:59.724751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:59.798695Z","title":"IEEE Software40(3), 4–8 (2023).https: //doi.org/10.1109/MS.2023.3248401","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:59.798695Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:fee085b78375454cc8a3d48718feabea441d8bbd923f3ae8e4a5b82cb4cad2cb","observation_id":"3ac27fb3-1426-47d9-9540-d256df0ae217","resolution":{"observed_at":"2026-08-07T14:08:59.798695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:07.729235Z","title":"In: Proceedings of the 2016 Conference on Em- pirical Methods in Natural Language Processing","venue":null,"work_id":"64d69277-c36e-4a1e-babb-a9dc09b60b7b","year":2016},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:08:59.865085Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:835503897e23dfc3152754ee65c2317a2d4b792716f5bad42d3cecf7679d60a0","observation_id":"d3630059-5892-48b5-a009-7b699e10ae81","resolution":{"observed_at":"2026-08-07T14:09:07.830251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:00.014749Z","title":"Forensic Science International: Digital Investigation46, 301609 (Oct 2023).https://doi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:00.014749Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:11285115d127a3c3cf007e6f994a4ad8b8dce5b43ade921f442c7052e25456c8","observation_id":"a1959e6e-bbdc-4ade-a614-fe6958d5d6b9","resolution":{"observed_at":"2026-08-07T14:09:00.014749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:00.264750Z","title":"Forensic Science International: DFIR-Metric: A Benchmark Dataset for Evaluating LLMs in DFIR 15 Digital Investigation52, 301872 (Mar 2025).https://doi.org/10.1016/j.fsidi","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:00.264750Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:7ae433e33a236fb240b43c02f26ad3311b70e3548211185e28172bf70270bdb3","observation_id":"0c74d775-9016-4dce-a428-bfd8ed546358","resolution":{"observed_at":"2026-08-07T14:09:00.264750Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1186/s13635-017-0067-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"EURASIP Journal on Information Security 2017(1), 15 (Oct 2017).https://doi.org/10.1186/s13635-017-0067-2","venue":"EURASIP Journal on Information Security","work_id":"883a82d8-982b-4a07-820b-9315ade8b825","year":2017},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:00.354748Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:33c9a11894c74e498c3b621c22de6b9ffdddb35d59abc5cf5fabc72d9747a4f6","observation_id":"85a067d4-6cd1-4b97-82c1-89b6252237ea","resolution":{"observed_at":"2026-08-07T14:09:01.953142Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.11030","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:04.085385Z","title":"Computers and Electrical Engineering124, 110307 (2025).https://doi","venue":null,"work_id":"e3be46e1-5e6a-4868-b251-7cdff655feb0","year":2025},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:00.444855Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:7e80e12e35377d24a3de693b519fb1e9cb558514c4f240680d68e1def2a97697","observation_id":"f040064d-e91f-473a-a599-44e0a74bf403","resolution":{"observed_at":"2026-08-07T14:09:04.234750Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2505.03100","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"https://doi.org/10.48550/arXiv.2505.03100","venue":"ArXiv.org","work_id":"3811d51e-6c88-48b6-a7fd-75ba767190cf","year":null},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:00.528611Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:220b8136aca3f30f40dae5e7a473aba392bb3a2016fa6bae294d698fed151820","observation_id":"0247944f-51a0-41c1-bd3e-770c7270a65d","resolution":{"observed_at":"2026-08-07T14:09:01.800745Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:00.598209Z","title":"In: 2024 IEEE Interna- tional Conference on Big Data (BigData)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:00.598209Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:cf8d28d75ac6fb61f95e3fcb009c2bc8b36a3d4758518d5f6a6c4eb1680a6d86","observation_id":"7d854e0d-28d3-41c4-81fc-89bda38cd9f1","resolution":{"observed_at":"2026-08-07T14:09:00.598209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:00.641388Z","title":"In: 2024 IEEE International Conference on Cyber Security and Resilience (CSR)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:00.641388Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:28bb9315933c705fda543b6ab0618a3d33d7603e12bb101ff2fb270657c671fa","observation_id":"3ec31bb7-ac50-4844-8102-82982d5a4821","resolution":{"observed_at":"2026-08-07T14:09:00.641388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:07.473848Z","title":"In: Ideas That Cre- ated the Future, pp","venue":null,"work_id":"519e4640-122b-4f8c-acfc-31d9887b2944","year":1950},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:00.811978Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:52002bb2a3a45fef1c940fbe902bbf8036d9d6279b8827fd537e2247964a3ee1","observation_id":"1b4fafc2-d381-4dc3-a0d5-33a84d82a272","resolution":{"observed_at":"2026-08-07T14:09:07.574818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:00.925258Z","title":"In: Proceedings of the 31st International Conference on Neural Information Processing Systems","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:00.925258Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:fa664139ef5d6b81c615dd95b73fc69a04d08ee541f6bd8d40425cc113bf9bd8","observation_id":"35d555da-003d-4796-af14-32b1c69a8536","resolution":{"observed_at":"2026-08-07T14:09:00.925258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:00.994772Z","title":"In: Linzen, T., Chrupała, G., Alishahi, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:00.994772Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:0f2459c00c71bc46460c47e0c843a40f34d846a02ac5cbc911218cd7def30089","observation_id":"9d499b04-88be-4839-bfbb-c7e9997de976","resolution":{"observed_at":"2026-08-07T14:09:00.994772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:07.124768Z","title":"In: Proceedings of the 31st Inter- national Conference on Computational Linguistics","venue":null,"work_id":"ed96eb41-3342-4756-97a6-26bea94d273d","year":2025},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:01.065223Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:69b44a0c422f9894ed29ee6b063319860c7e5a8eff7c8e86fddb0fa5a34c1988","observation_id":"19180516-dd0c-4787-8f96-833fe3e02d5a","resolution":{"observed_at":"2026-08-07T14:09:07.253729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2716.37127","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:03.135704Z","title":"In: Proceedings of the Digital Forensics Doctoral Sym- posium","venue":null,"work_id":"403fabe6-c108-4e8a-b00f-23cbc39f8d1d","year":2025},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:01.209874Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:5d93ab1ffdc7fa66355f5d4c0ea5695aaa019ccb90ac22d7911d95b47fbb6efb","observation_id":"4c631ead-22b0-454f-bfe9-5ca53e402b26","resolution":{"observed_at":"2026-08-07T14:09:03.280184Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:01.314815Z","title":"In: 2024 12th International Sympo- sium on Digital Forensics and Security (ISDFS)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:01.314815Z"},"links":{"citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:ae8fc347677041a03bd3aebb83f59b8e2d55508fd02220f011fd452961212a23","observation_id":"1497f6d1-788d-4d2c-90cb-1fd6a276aad2","resolution":{"observed_at":"2026-08-07T14:09:01.314815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02963","last_updated":"2025-04-03T18:32:15Z","snapshot_observed_at":"2026-08-19T14:53:05.289333Z","submitted_at":"2025-04-03T18:32:15Z","title":"Digital Forensics in the Age of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02963","snapshot_observed_at":"2026-08-07T14:09:01.393974Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:01.393974Z"},"links":{"cited_paper":"/paper/2504.02963","citing_paper":"/paper/2505.19973"},"observation_digest":"sha256:9bb06d85ebccb0bfdbb353b1862ec235a70158e13b70ebbce50f770020c80528","observation_id":"4eaaa9b9-46bd-4c3d-98e5-f2b8a6a11824","resolution":{"observed_at":"2026-08-07T14:09:01.393974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19973","last_updated":"2025-05-26T13:35:37Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-17T22:18:11.517678Z","submitted_at":"2025-05-26T13:35:37Z","title":"DFIR-Metric: A Benchmark Dataset for Evaluating Large Language Models in Digital Forensics and Incident Response"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":3,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":18,"verified_exact":4,"verified_fuzzy":6},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2505.19973."}