{"as_of":"2026-08-16T10:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f382868418bc6f597f8ad436eacc590ad28105926a8966ec917053843931756e","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:48:57.501747Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07899/citation-record","integrity":"/paper/2608.07899/integrity","json":"/paper/2608.07899/citation-record.json","paper":"/paper/2608.07899"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.05285","last_updated":"2024-11-30T02:55:48Z","snapshot_observed_at":"2026-08-12T22:05:07.597643Z","submitted_at":"2024-11-08T02:31:03Z","title":"AgentOps: Enabling Observability of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05285","snapshot_observed_at":"2026-08-12T00:48:57.411093Z","title":"AgentOps: Enabling observability of LLM agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.411093Z"},"links":{"cited_paper":"/paper/2411.05285","citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:8a602732cdf4a037bbcddef00ba5caf615f3fe09d69a37faf15f28f7244a942a","observation_id":"1987d79c-48b4-4bce-8171-e798c0ee76e9","resolution":{"observed_at":"2026-08-12T00:48:57.411093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.939752Z","title":"Which agent causes task failures and when? on automated failure attribution of LLM multi-agent systems,","venue":null,"work_id":"dd879de8-5169-4cba-a1e0-9971c3dd0e12","year":2025},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.416897Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:4e5f5115762b9e66672810054d573fca4a3364c51c3cf511142a708ad4d4b534","observation_id":"2a6b86ac-8312-47cc-afe9-e0627672e8bf","resolution":{"observed_at":"2026-08-12T00:48:57.945412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.923924Z","title":"Seeing the whole elephant: A benchmark for failure attribution in LLM-based multi-agent systems,","venue":null,"work_id":"c9a3b46c-ad26-488e-b8d4-e54ffdcf444a","year":2026},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.422301Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:eb3d13fc422d44603d65572f2928b5b0b4ff77bb6e2a0741a20b0c0b4edb48dc","observation_id":"cad0cff7-147f-48ee-9b20-849f850eacc9","resolution":{"observed_at":"2026-08-12T00:48:57.929325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.907664Z","title":"AgentRx: Diagnosing AI agent failures from execution trajectories,","venue":null,"work_id":"fa9c0921-1039-4b3b-9bfc-a29cf41eb0de","year":null},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.427867Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:f7e4b0c1e8965a73002ba3975031b5015d4ba350d5785404b1ef8a9dac735f30","observation_id":"5d75ebf4-b5c8-4904-a8fd-c1640e91c5b9","resolution":{"observed_at":"2026-08-12T00:48:57.913173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.891872Z","title":"RCAEval: A benchmark for root cause analysis of microservice systems with teleme- try data,","venue":null,"work_id":"fdca38cf-55c0-4ce2-8a43-261e02a5d864","year":null},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.438462Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:f41e77bd59d5d5fafa07002094755f37c64fa47f04fa9b1a0a8820f71f7b9af5","observation_id":"846813eb-c8b5-4a5b-b8d2-13eb7e099f71","resolution":{"observed_at":"2026-08-12T00:48:57.897137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.858854Z","title":"Causal inference-based root cause analysis for online service systems with intervention recognition,","venue":null,"work_id":"b85122ba-87b3-45c4-b892-ef922ce1069f","year":2022},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.448799Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:9785b9fd4e105691d67cfa2327428d1678b871eba59d581ffd778981d797c3b3","observation_id":"ae5bad96-56b3-4454-861f-7c2d97ca5e42","resolution":{"observed_at":"2026-08-12T00:48:57.864610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.842905Z","title":"What is OpenTelemetry?","venue":null,"work_id":"8e37f469-f952-4335-8d4e-a2f2d15a23ba","year":2026},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.454324Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:5ea89f30d67d961cb657714e0cfaf5b5abe8d368225413081a2ab833835dafe3","observation_id":"212cce5f-3714-4924-8fca-1b9c1660890f","resolution":{"observed_at":"2026-08-12T00:48:57.848398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.826015Z","title":"OpenInference: OpenTelemetry instru- mentation for AI observability,","venue":null,"work_id":"b66e98c4-fcc0-4791-95ee-b4d01c5bc3a4","year":2026},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.459939Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:77658d0c08d03ac6b12a9d3504b0fdae22898f8083a900d3a4f43965af84c7e7","observation_id":"72c078aa-884e-47f2-99d3-795041cfc21d","resolution":{"observed_at":"2026-08-12T00:48:57.832071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.808987Z","title":"Selective classification for deep neural networks,","venue":null,"work_id":"bacf5bcc-0036-47de-9524-962dccdd47ff","year":2017},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.464976Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:63b2414f9bd3b1aec730dd41059bf121e65fc0556398c89f1d73ea51be521a25","observation_id":"5fdf104c-1682-4ede-91b0-47313b54e21f","resolution":{"observed_at":"2026-08-12T00:48:57.814666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.791628Z","title":"Know what you don’t know: Unanswerable questions for SQuAD,","venue":null,"work_id":"7b4dac69-e181-4eec-b5d0-0f47738c7f27","year":2018},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.470000Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:c98bd8b2203bd2ef6069b7c4d5299cd074e1cb7f310fc2f6a61ce0d38f8a8f3d","observation_id":"4fdf8975-ecb2-4a35-8607-9b5b18fa5a8f","resolution":{"observed_at":"2026-08-12T00:48:57.797007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.774310Z","title":"Do LLMs know when to NOT answer? investigating abstention abilities of large language models,","venue":null,"work_id":"66936915-b790-4494-9f37-8728746bb19a","year":2025},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.474815Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:d03e2474011dddae61bfd507f9c26a298cc9ac23877bc6159f79190d65213ab7","observation_id":"3adec452-8ad5-4908-bddc-d721052e4e5e","resolution":{"observed_at":"2026-08-12T00:48:57.780103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.756487Z","title":"AgenTracer: Who is inducing failure in the LLM agentic systems?","venue":null,"work_id":"58928625-4320-41c9-b2a3-07e1750f496f","year":null},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.480091Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:b931c1af5684fefff3cafdc6d69586d0ddc95d2300617edac971860fc3988f8a","observation_id":"8c09bb2a-87e8-41db-9a23-f9744f10c0ba","resolution":{"observed_at":"2026-08-12T00:48:57.762331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09071","last_updated":"2026-06-08T06:11:57Z","snapshot_observed_at":"2026-08-13T10:07:09.322459Z","submitted_at":"2026-06-08T06:11:57Z","title":"REFLECT: Intervention-Supported Error Attribution for Silent Failures in LLM Agent Traces","version":1},"cited_work":{"arxiv_id":"2606.09071","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.09071","snapshot_observed_at":"2026-08-12T00:48:57.539558Z","title":"REFLECT: Intervention-Supported Error Attribution for Silent Failures in LLM Agent Traces","venue":"cs.AI","work_id":"8bef409a-080d-40f0-9ed3-ebd4f9c6fc73","year":2026},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.491121Z"},"links":{"cited_paper":"/paper/2606.09071","citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:8b5203925b6f584214e4b8d3283806904a7268f7a190220be8cfc5cbb3b21cd5","observation_id":"586471cc-b8f0-4336-8a1a-ba48207b6203","resolution":{"observed_at":"2026-08-12T00:48:57.547794Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.739718Z","title":"Abstention- Bench: Reasoning LLMs fail on unanswerable questions,","venue":null,"work_id":"8acbae5e-5e53-4571-b915-5efba03d8fa8","year":2025},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.496481Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:c4be0ab514cddf656b9e1d6510c56a1162c3d93f27ad22a5dd2579768e2fe3f9","observation_id":"29bedae3-609a-4e9a-9df4-f2535188f4ba","resolution":{"observed_at":"2026-08-12T00:48:57.745306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03312","last_updated":"2025-09-04T17:49:20Z","snapshot_observed_at":"2026-08-15T10:10:27.283963Z","submitted_at":"2025-09-03T13:42:14Z","title":"AgenTracer: Who Is Inducing Failure in the LLM Agentic Systems?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03312","snapshot_observed_at":"2026-08-12T00:48:57.485759Z","title":"Available: https://arxiv.org/abs/2509.03312","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.485759Z"},"links":{"cited_paper":"/paper/2509.03312","citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:1f0eb3bddcd09ebe051e4e69be959cb32b13bf81d3aa46d081d3d9403e1f9410","observation_id":"78bb322d-3633-46c6-8578-8a5fc8db69e1","resolution":{"observed_at":"2026-08-12T00:48:57.485759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.721195Z","title":"AgentTelemetry: OpenTelemetry-based observability for AI agent systems,","venue":null,"work_id":"0b824d95-629d-4a0d-8908-0c65b9a41011","year":2025},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.501747Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:52bfc821ae8e6b59e077a49e1710b89a4dbbce920ec16089d457505c9fd98420","observation_id":"9ea38a76-279d-4b3f-b328-a4faf4da3dc1","resolution":{"observed_at":"2026-08-12T00:48:57.727006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.875779Z","title":null,"venue":null,"work_id":"d611d1d2-7664-48dd-8782-d0a1aa83d4a7","year":2025},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.443629Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:2a96dcd16c4136bd24ea001b3941986e45f393af9a5439723351bb221f4719e0","observation_id":"59dc231c-70a1-4017-8e42-4120a3dd0d0b","resolution":{"observed_at":"2026-08-12T00:48:57.880958Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:48:57.433112Z","title":"Available: https://arxiv.org/abs/2602.02475","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-12T00:48:57.433112Z"},"links":{"citing_paper":"/paper/2608.07899"},"observation_digest":"sha256:06f0ad58ad9c8d00e96da273b452d8f75020ce621c010d2609deea0b395ba213","observation_id":"8b0ecf95-6963-4e5d-b7c8-f274eceac7aa","resolution":{"observed_at":"2026-08-12T00:48:57.433112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07899","last_updated":"2026-08-08T03:54:22Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T10:37:02.371830Z","submitted_at":"2026-08-08T03:54:22Z","title":"TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":3,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2608.07899."}