{"as_of":"2026-08-19T02:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2c94fbeab90ab6ecfb00115a057a3fdf1e03c113238d9574b96833821c26fc1d","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:54:08.252099Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03591/citation-record","integrity":"/paper/2608.03591/integrity","json":"/paper/2608.03591/citation-record.json","paper":"/paper/2608.03591"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.650696Z","title":null,"venue":null,"work_id":"aea4b497-4c3c-4294-89cd-ad32552fbb9c","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.169282Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:ce9dfccbfdaf0620b09311bf6d1d56522d84677be8627bb1832d77837ca31a9f","observation_id":"87e75dc2-9b72-4839-ab0a-a18f41029bd5","resolution":{"observed_at":"2026-08-15T14:54:08.654912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.638175Z","title":null,"venue":null,"work_id":"a48f91a3-a40e-4da7-bbad-0113aade4e55","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.173852Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:2bbe15e27f74820d1980a28eea51f135d7183e85d8c7c743d94009665ced50b2","observation_id":"633f6a6b-a555-405e-9f5c-67df59f5d1ee","resolution":{"observed_at":"2026-08-15T14:54:08.642327Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.625587Z","title":null,"venue":null,"work_id":"96b23e19-5a52-48ec-b295-09b146d8b1d2","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.178705Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:0e7b9a5170829b70fde2154fcb861690e58cc7f3107a09efeb94169bc1d5ef13","observation_id":"30926833-1bd5-4b37-960e-8299c08be0aa","resolution":{"observed_at":"2026-08-15T14:54:08.629665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.612108Z","title":null,"venue":null,"work_id":"66b619d3-8f9b-40d1-a09e-e0c79eeb79cf","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.182899Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:e9d52cd56c8019dabb52f68589cd7fe843ab00e88b5eb61d63a8572335f3382f","observation_id":"ca9be4d1-b181-47cd-b323-dd5dcd699a6c","resolution":{"observed_at":"2026-08-15T14:54:08.616128Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.599508Z","title":"and then","venue":null,"work_id":"67506bd7-50f6-4024-a697-04b7bb557588","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.187080Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:92572535d1d3883f67b6fdb443869eae6b1e6f78d5575365e3b46674e6bcda7c","observation_id":"63e805af-f0f8-44d6-99bc-d3b635b65b59","resolution":{"observed_at":"2026-08-15T14:54:08.603540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.523549Z","title":"alert-node","venue":null,"work_id":"13fc1669-1103-41b6-b302-0f958aa34d45","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.212372Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:25e84f5af5b4dbccb3edab812fa2da614f4f8f1200b83dc2e86a619a346f7311","observation_id":"4489e6b7-6b51-40f4-a917-c0ba7cd2fdab","resolution":{"observed_at":"2026-08-15T14:54:08.527652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.430015Z","title":null,"venue":null,"work_id":"8eb46185-f929-4345-b19f-30440090a494","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.240477Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:789ddbf2d4881a9032890d960b52356a7ed2d33a036301d9f104a2797d104e87","observation_id":"1907de1b-0d90-42b3-aede-1b2e9dfc552e","resolution":{"observed_at":"2026-08-15T14:54:08.434100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.417118Z","title":null,"venue":null,"work_id":"44d6a058-730a-4c85-8756-c1a14a3c7c3c","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.244414Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:975b15729d2032395e5483bee6c01692fbbd1228a04b11b2ba9a3cd382eb72a1","observation_id":"fd5703cf-d83e-4b61-91ef-c6a26c07d537","resolution":{"observed_at":"2026-08-15T14:54:08.421096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.403190Z","title":"If a step would need many evidence IDs because it covers different actions or targets, split it","venue":null,"work_id":"2e917123-9559-4596-b19c-185171f86853","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.248334Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:eebed5758d1e8ce06a3f754dd872734f83a5400eae38adc5c431607c41fc02a0","observation_id":"3abf50fd-39c7-444d-b4a1-7ab01021dfd8","resolution":{"observed_at":"2026-08-15T14:54:08.407541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.586887Z","title":null,"venue":null,"work_id":"cbd2e119-fe66-4055-9301-5cb8387e5123","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.191465Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:c27c5ac5d3742a59d190fd7cecc2a95674568e399edfcaf0945e126598fd35c4","observation_id":"7c692986-840c-442e-97ad-8a0d4041c9cd","resolution":{"observed_at":"2026-08-15T14:54:08.590915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.573898Z","title":null,"venue":null,"work_id":"506ec1da-bd02-435d-8722-c138af1290f3","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.196474Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:187ca1c0163c015069bc18d0a0368fdadfee5d22fae5b2f263e6f7ea30bb0439","observation_id":"34d941aa-f659-49d1-9273-da554ca2d61a","resolution":{"observed_at":"2026-08-15T14:54:08.578035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.561279Z","title":null,"venue":null,"work_id":"a6d2e009-e7c7-4f98-8cd2-61e78eba1be1","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.200750Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:820fc1633fb67a758315e0a5c89c3d7d8e68750c1154ff83fc9b3dbdc560d302","observation_id":"4f86637d-65d5-4af4-a83b-d051e5f17ba8","resolution":{"observed_at":"2026-08-15T14:54:08.565301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.548682Z","title":null,"venue":null,"work_id":"7e94c29c-fec7-4235-863c-7890eee2261a","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.204575Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:21fcd891c39a1d7c59b43fa5824f2b05691fe4bc3feb0d66b15cd5cb67bf4920","observation_id":"72f7ef37-68aa-4348-bac7-1b56f690bd77","resolution":{"observed_at":"2026-08-15T14:54:08.552859Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.536139Z","title":null,"venue":null,"work_id":"e2994dd2-b32b-409a-a188-5a6b4c459dbf","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.208553Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:9d1a0c36e259cad6ad085bd4618bacd2a4cd6cf33e1a6f6037c8269ed920c7e7","observation_id":"3cbf02b1-fa80-420e-8380-f97a1bb5673c","resolution":{"observed_at":"2026-08-15T14:54:08.540294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.510417Z","title":null,"venue":null,"work_id":"c455b36e-8d20-455a-b45e-996f5b555a0a","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.216563Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:ac88db78e245952eab857230d930e40c8ef6834aec7694a15fa676441c33734d","observation_id":"3c740f6f-79eb-40c7-82a2-6023b8f70197","resolution":{"observed_at":"2026-08-15T14:54:08.514646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.496803Z","title":null,"venue":null,"work_id":"56504acb-4c87-4ec8-9750-76c9658fa5cb","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.220502Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:44a6e1418b9ac56910a42cac2b2a9e1ca8e7451d0baeab63e00bc00eb98139f0","observation_id":"74fdfbd2-ddc5-4cb9-a3d3-bee95735943a","resolution":{"observed_at":"2026-08-15T14:54:08.500860Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.483892Z","title":null,"venue":null,"work_id":"aa25afe2-cb17-4434-a5e7-6e79fe09292d","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.224422Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:2f88fd1a2f270cadf65ad8499bddf81881521084421510aadc8988689e172751","observation_id":"dacca999-d338-4574-96a6-0adb23df970d","resolution":{"observed_at":"2026-08-15T14:54:08.488051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.471021Z","title":null,"venue":null,"work_id":"8afd4671-696c-46fd-96da-03a7ef477d8d","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.228437Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:221ed9dab50466eece3c7dd7ac68b043687996642deb76e22c0c5f2a73e87e38","observation_id":"9019e760-c019-4649-9fbc-80c7898f688b","resolution":{"observed_at":"2026-08-15T14:54:08.474961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.457632Z","title":"Do not split repeated observations merely because they happened at different times","venue":null,"work_id":"808fff01-82b5-497c-abb8-5786a3ef8cd3","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.232492Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:3039aa55de8f92dbea57d13a73e19476240ac4592707db8637fda0a608240d7f","observation_id":"bf6cfc6b-0b79-4e15-bb61-b46075e6f203","resolution":{"observed_at":"2026-08-15T14:54:08.462404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.443105Z","title":"Figure 12: Visible-anchor decomposition prompt (part 1 of 2): cross-source step-unit calibration and split/merge protocol","venue":null,"work_id":"fcbd2f26-ffae-4ada-9534-be5134c923b6","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.236479Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:457bff12008c031557bda10cb4f53455c95c6430e0e3b906a7abf891e0dde001","observation_id":"d569216e-76db-4def-bbc7-277fab4bd613","resolution":{"observed_at":"2026-08-15T14:54:08.447836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.390299Z","title":"thought\":","venue":null,"work_id":"fe25c851-538c-4f50-99d2-9902c49e5537","year":null},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.252099Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:67cd55a996962a037d357874d291dd45af098ee9c13abef4957042cf5e2da3cc","observation_id":"c8dab3b4-3119-4590-810d-f84b4e54e09b","resolution":{"observed_at":"2026-08-15T14:54:08.394526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21773","last_updated":"2026-05-20T22:07:12Z","snapshot_observed_at":"2026-08-13T11:20:32.916586Z","submitted_at":"2026-05-20T22:07:12Z","title":"HIDBench: Benchmarking Large Language Models for Host-Based Intrusion Detection","version":1},"cited_work":{"arxiv_id":"2605.21773","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.21773","snapshot_observed_at":"2026-08-15T14:54:08.285782Z","title":"HIDBench: Benchmarking Large Language Models for Host-Based Intrusion Detection","venue":"cs.CR","work_id":"826a08a4-e296-45d3-b0b7-e20e85126a4a","year":2026},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":566,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.056230Z"},"links":{"cited_paper":"/paper/2605.21773","citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:4e8ebd3a8920c8cd6c75eea43fd2898a1c24f064dc3bed4e77a3055c9b69295b","observation_id":"df527344-2821-45d0-a59d-2e5efb2fd7a8","resolution":{"observed_at":"2026-08-15T14:54:08.292624Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.663529Z","title":"In33rd USENIX Security Symposium (USENIX Security 24), 5197–5214","venue":null,"work_id":"65883c96-3205-4f34-a7af-a75494f8d673","year":2025},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.048011Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:5b9049213ea1bda28c9d3adf546454da64becc2cc126d4210eac643d2b97731b","observation_id":"c7f7d773-0a2b-46a2-ad63-4363617037f0","resolution":{"observed_at":"2026-08-15T14:54:08.668094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.10281","last_updated":"2026-06-09T01:09:04Z","snapshot_observed_at":"2026-08-06T12:03:43.734759Z","submitted_at":"2026-06-09T01:09:04Z","title":"Benchmarking and Exploring the Capabilities of LLMs for Attack Investigations","version":1},"cited_work":{"arxiv_id":"2606.10281","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.10281","snapshot_observed_at":"2026-08-15T14:54:08.376104Z","title":"Benchmarking and Exploring the Capabilities of LLMs for Attack Investigations","venue":"cs.CR","work_id":"c7eae00a-351e-4fd2-a592-bc10adf5b671","year":2026},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":3022,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.042509Z"},"links":{"cited_paper":"/paper/2606.10281","citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:36fd37c4d2f72cdcf58836cdd6bfa4f18d2f4775bc2bd22bf0f4a4f90c5c9d59","observation_id":"1a569732-e2aa-43b2-a7bf-ca193d8adf38","resolution":{"observed_at":"2026-08-15T14:54:08.381091Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:08.052246Z","title":"Ma, H.; Yong, J.; Ma, Y.; Chen, K.; Yusof, A.; Liang, Z.; andChang,E.-C.2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction","version":1},"reference_index":9474,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:08.052246Z"},"links":{"citing_paper":"/paper/2608.03591"},"observation_digest":"sha256:1c2e8b506ae8518494a9e1e02479fceda2e71776544733d00cb8e99636ae39fe","observation_id":"f3c146f4-9914-4773-aeb0-328cd0d275a8","resolution":{"observed_at":"2026-08-15T14:54:08.052246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03591","last_updated":"2026-08-04T12:43:47Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-18T21:21:18.659751Z","submitted_at":"2026-08-04T12:43:47Z","title":"DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2608.03591."}