{"as_of":"2026-08-22T17:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:afcdf574d63271c9a2a9921bd7e60bad654faee01e3cc485a7303c0a5a338e9f","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T22:37:14.882936Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.15684/citation-record","integrity":"/paper/2607.15684/integrity","json":"/paper/2607.15684/citation-record.json","paper":"/paper/2607.15684"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:07.409518Z","title":"Swe-bench: Can language models resolve real- world github issues?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:07.409518Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:d57425ddd63e671f378235cbe2c447b2da65ce13c09f187da92e964847606994","observation_id":"157727a2-c9e2-44db-8b8f-353bde38f3b9","resolution":{"observed_at":"2026-08-01T22:37:07.409518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:07.533194Z","title":"Swe-agent: Agent-computer interfaces enable automated software engineering,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:07.533194Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:c8762ed9292d85a746531cdd4a83bdefb9ae69a58735a56251a92252a50e0f8f","observation_id":"2e4bcffa-7ca9-45e7-968c-2b9a45126cb1","resolution":{"observed_at":"2026-08-01T22:37:07.533194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:07.743072Z","title":"Webarena: A realistic web environment for building autonomous agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:07.743072Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:c8dfa7ab6063a00f3241cddbfac9ad91b062b4b7a54bd87e2ccb9743e36fc0ea","observation_id":"948d0f37-91a6-45ad-b317-2695d58b050e","resolution":{"observed_at":"2026-08-01T22:37:07.743072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-17T20:31:29.818313Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-01T22:37:07.902241Z","title":"τ-bench: A benchmark for tool-agent-user interaction in real-world domains,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:07.902241Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:90d44ef96d43c3828cf61890195208650b614de0b0bf531d264cce35d318615d","observation_id":"2b65eb52-bf8a-4242-b9a9-f3f08e6a6256","resolution":{"observed_at":"2026-08-01T22:37:07.902241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:08.046492Z","title":"An empirical study of the non-determinism of chatgpt in code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:08.046492Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:19a07111997f1e98de9d335a384aaa298a98a039341eba765fddfb212b9d09a1","observation_id":"e642f4e3-b179-4f6f-8d58-ee96ec154443","resolution":{"observed_at":"2026-08-01T22:37:08.046492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15232","last_updated":"2026-08-19T14:55:53Z","snapshot_observed_at":"2026-08-22T17:11:09.282458Z","submitted_at":"2026-01-21T18:13:10Z","title":"When Agents Fail: A Comprehensive Study of Bugs in LLM Agents with Automated Labeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.15232","snapshot_observed_at":"2026-08-01T22:37:08.139550Z","title":"When agents fail: A comprehensive study of bugs in LLM agents with automated labeling,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:08.139550Z"},"links":{"cited_paper":"/paper/2601.15232","citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:dc7872df05dbdf92ba013335c9b0b3215842be51022d65003cb747f7b822aef7","observation_id":"33df7dd2-78c9-4bd2-ab86-5fa02c342a60","resolution":{"observed_at":"2026-08-01T22:37:08.139550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:08.227962Z","title":"An empirical study of bugs in modern LLM agent frameworks,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:08.227962Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:8afb5ecf7901b57e8dd450854a26f9c94a534f6d4032dba96f1867bb4c4f9202","observation_id":"d461ce43-0bd6-4f77-8a84-a9ac1eb98674","resolution":{"observed_at":"2026-08-01T22:37:08.227962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.06847","last_updated":"2026-05-07T16:46:46Z","snapshot_observed_at":"2026-08-12T19:29:28.939078Z","submitted_at":"2026-03-06T20:12:29Z","title":"Characterizing Faults in Agentic AI: A Taxonomy of Types, Symptoms, and Root Causes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.06847","snapshot_observed_at":"2026-08-01T22:37:08.387501Z","title":"Charac- terizing faults in agentic AI: A taxonomy of types, symptoms, and root causes,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:08.387501Z"},"links":{"cited_paper":"/paper/2603.06847","citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:5f31a1e1740f38b38fcfd5fca842bc4d481c7024c602bfcd692b74a167a812ee","observation_id":"487ed9f4-8ce4-43db-a77d-274625e69094","resolution":{"observed_at":"2026-08-01T22:37:08.387501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08906","last_updated":"2026-07-28T21:23:41Z","snapshot_observed_at":"2026-08-14T02:25:15.962595Z","submitted_at":"2026-04-10T03:13:24Z","title":"Understanding Bugs in Modern Agentic Frameworks: A Study of Symptoms, Root Causes, and Triggering Conditions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08906","snapshot_observed_at":"2026-08-01T22:37:08.543963Z","title":"Dissecting bug triggers and failure modes in modern agentic frameworks: An empirical study,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:08.543963Z"},"links":{"cited_paper":"/paper/2604.08906","citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:410e254d50588c07c4709e1b7dab4a7ac2567fec2d50091c9b9b4aeb771af8a6","observation_id":"15829759-1b1f-460a-b28d-6c4b27212b5f","resolution":{"observed_at":"2026-08-01T22:37:08.543963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:08.654909Z","title":"Agentbench: Evaluating llms as agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:08.654909Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:83b98f883457308a2cdbf797ad1cd57b5eb7698678163ac69aac11f224b2770b","observation_id":"1df71d26-aebc-444b-8ef5-dda0bde73c8c","resolution":{"observed_at":"2026-08-01T22:37:08.654909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:08.743647Z","title":"GAIA: a benchmark for general AI assistants,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:08.743647Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:aea6f34cd58fe0cba7c8af1f3f63d380861b3ceabfd280bc8b7ec2fc45decab3","observation_id":"bc6b3e0d-7538-43ee-9e8f-1084290964e2","resolution":{"observed_at":"2026-08-01T22:37:08.743647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:08.818564Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:08.818564Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:1c0d650b54b8eedd0151d0d40e6d55dfe76220810151075e7991900b31896799","observation_id":"f05f689d-99d1-4580-ada1-9bbd5ecc9c89","resolution":{"observed_at":"2026-08-01T22:37:08.818564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13547","last_updated":"2025-06-26T01:05:54Z","snapshot_observed_at":"2026-08-19T23:11:14.083941Z","submitted_at":"2024-11-20T18:56:22Z","title":"ToolScan: A Benchmark for Characterizing Errors in Tool-Use LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13547","snapshot_observed_at":"2026-08-01T22:37:08.943173Z","title":"Spectool: A benchmark for characterizing errors in tool-use llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:08.943173Z"},"links":{"cited_paper":"/paper/2411.13547","citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:a5a472518f5d451333a91d5c31967d6309dfd19d35e4d1d611c32b411638164a","observation_id":"cd1bfc5d-4294-4d93-b5c4-ebde78e0a1e8","resolution":{"observed_at":"2026-08-01T22:37:08.943173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.037688Z","title":"Toolllm: Facilitating large language models to master 16000+ real-world apis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.037688Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:876084f6625238324ba052a4ba1e29a9f062c24686d40fc793e3880c1b7dba09","observation_id":"bca41cff-8f3b-4a4b-86ea-62ae4105ad93","resolution":{"observed_at":"2026-08-01T22:37:09.037688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.176291Z","title":"Reducing tool hallucination via reliability alignment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.176291Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:9954ade5b3115c0bc82bac079cb3724a7397ec466f3672e14d739f96a4969196","observation_id":"70ebd087-ebd6-4622-a40b-2d7ba38709a6","resolution":{"observed_at":"2026-08-01T22:37:09.176291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-01T22:37:09.234124Z","title":"Instruction-following evaluation for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.234124Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:1108f030a8b35ea5b7dca67861a292942e1582f5f63fa09ac2cc4ac5a2103059","observation_id":"58b8345d-f518-49dc-a132-99762ef410ad","resolution":{"observed_at":"2026-08-01T22:37:09.234124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.294403Z","title":"Instruction-following evaluation in function calling for large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.294403Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:a9569afa46bdeec4d44db577b0023b544bfc4b87764e67ab8b672b0ba146cd4b","observation_id":"efd77046-22f8-4948-aa4e-666e8613d0d0","resolution":{"observed_at":"2026-08-01T22:37:09.294403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.362452Z","title":"Lost in the middle: How language models use long contexts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.362452Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:e5300cdb87b323e4d18b50ba23d708da261b0769637a6c560411cf1466b765fe","observation_id":"7ea5c1b7-9746-40fa-9ba3-85aa5560dd75","resolution":{"observed_at":"2026-08-01T22:37:09.362452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.436920Z","title":"The oracle problem in software testing: A survey,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.436920Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:917512d526b5ae8e4396f71b76b5d4c8036f17c9a996e5508f5b3fee7b6e9297","observation_id":"77dde61e-8b33-4136-ad66-f96f9dc76004","resolution":{"observed_at":"2026-08-01T22:37:09.436920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.493883Z","title":"Silent bugs in deep learning frameworks: an empirical study of keras and tensorflow,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.493883Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:76296088e6bb9b595e687341a50142410eb466e3a4264f060cc6e4e190b918f2","observation_id":"d60e5812-8167-4072-bdcf-aece4683dac4","resolution":{"observed_at":"2026-08-01T22:37:09.493883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.547695Z","title":"An empirical analysis of flaky tests,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.547695Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:898483a1b0fad6e1671f0941f3e63413fce29d1bcbeef5e65ffcad623c1381ae","observation_id":"1a820dcf-a11a-463c-97f9-47bf0eaf3050","resolution":{"observed_at":"2026-08-01T22:37:09.547695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.629629Z","title":"Large language models for software engineer- ing: A systematic literature review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.629629Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:058b4089422cd8fe19a9ecabaa60bcb5f2666c3f37aedf7b44ad6c67f74e4e0d","observation_id":"4d64afe5-edd0-461b-bf59-ad5bf99f4460","resolution":{"observed_at":"2026-08-01T22:37:09.629629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-01T22:37:09.681597Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.681597Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:5c1384dafdf2a002cbcbced9ff6ae512afdb64f2cfde475c92984a0f6e944976","observation_id":"f8dcba7f-a529-404c-be0a-f19bcbb4cc8a","resolution":{"observed_at":"2026-08-01T22:37:09.681597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15231","last_updated":"2025-03-19T14:08:47Z","snapshot_observed_at":"2026-08-19T23:42:11.137582Z","submitted_at":"2025-03-19T14:08:47Z","title":"When LLMs Meet API Documentation: Can Retrieval Augmentation Aid Code Generation Just as It Helps Developers?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15231","snapshot_observed_at":"2026-08-01T22:37:09.773568Z","title":"When llms meet API documentation: Can retrieval augmentation aid code generation just as it helps developers?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.773568Z"},"links":{"cited_paper":"/paper/2503.15231","citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:e17c0dfc60af0e2ac7251f41d69747afe22e50da4ae388c1192e590b52aa2e88","observation_id":"9a7b84dc-ab34-48ff-988a-073db2078c86","resolution":{"observed_at":"2026-08-01T22:37:09.773568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.829980Z","title":"Can emulating semantic translation help llms with code translation? A study based on pseudocode,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.829980Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:4163fa555b40a733046b084a7441974f23772d037d88cc070cad0a1e67dd9702","observation_id":"642604fd-ba46-4ba4-9578-388b6bccd02f","resolution":{"observed_at":"2026-08-01T22:37:09.829980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.903858Z","title":"An empirical evaluation of using large language models for automated unit test generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.903858Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:62da407514a6d72ff7189888347de1be98240e84a6114aae7ab98d4ea59de3ef","observation_id":"f767b2bf-41e5-44b3-9b11-1ab122859df6","resolution":{"observed_at":"2026-08-01T22:37:09.903858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.980422Z","title":"The rise and potential of large language model based agents: a survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.980422Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:193df2a6b04254fe92e19f845aee3bd0b37ca69e49d144607577357b76f9ef9f","observation_id":"a12ab1a6-eda6-49f0-8a7d-87b2dd4401b4","resolution":{"observed_at":"2026-08-01T22:37:09.980422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.062749Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.062749Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:6a09a17747111f501c5935a7b15a881f588ccaf134212ee5d7e4b921e9cffae2","observation_id":"1908a876-275e-49a0-aa22-57221a9b25cb","resolution":{"observed_at":"2026-08-01T22:37:10.062749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.143278Z","title":"Agent harness for large language model agents: A survey,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.143278Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:3a5c0c0155810c2bfbc265462234cefaf2feb309c151a7c3a440da8c9d73d4dd","observation_id":"4ad80ae4-c439-4dc1-9d86-6070ea86c60c","resolution":{"observed_at":"2026-08-01T22:37:10.143278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.222410Z","title":"OpenAI Codex, issue #5957,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.222410Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:fa49fde521e3ecafea2d0e637b0af341f30eb4d73f25b6d41def4a79953a2a71","observation_id":"258c8a0e-95d2-43c2-88f8-bbe9bf3df129","resolution":{"observed_at":"2026-08-01T22:37:10.222410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.299859Z","title":"OpenAI Codex, issue #6562,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.299859Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:b28dd49a8167be90a5dac40d1cb2af9688c17162d338029645144b37400af635","observation_id":"b73a7be5-9a93-4e56-8891-ad6c3bb139c7","resolution":{"observed_at":"2026-08-01T22:37:10.299859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.378752Z","title":"LangChain, issue #1358,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.378752Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:f39fbf4a7e161dbb4039bc6f6cc5645d18a0d8c2c3cbeb66e8efd7cee584d157","observation_id":"d7184974-b201-4ac5-9084-f28e3f76114a","resolution":{"observed_at":"2026-08-01T22:37:10.378752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.442628Z","title":"Gemini CLI, issue #13292,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.442628Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:2ce44df8cdeed566296cfb67e6480f416ba3c30184795d7f82ab8563d5bab690","observation_id":"460660b0-d82c-4bbf-b934-ed703d1c73c9","resolution":{"observed_at":"2026-08-01T22:37:10.442628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.445394Z","title":"CrewAI, issue #668,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.445394Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:1a3572135dc23f16d6aebaa5660b58d6eadf9079c9e61a2c9c04d0a7183591dc","observation_id":"8d712cd5-a0e6-4067-8197-12a641510b33","resolution":{"observed_at":"2026-08-01T22:37:10.445394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.461541Z","title":"Gemini CLI, issue #5629,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.461541Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:0da3bc2f7172121bc3d8e3e0104a1928b358c88149dff831f45fb8ee2d84e9b8","observation_id":"3220243c-b6e8-4cf1-bd92-e0966ed8a787","resolution":{"observed_at":"2026-08-01T22:37:10.461541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.594992Z","title":"OpenAI Codex, issue #4337,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.594992Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:0a9b81c183c4c1193f1c3b440593c7f2381e3ecc39c8847f4849c57a722d23e3","observation_id":"244d5ed3-4433-4317-b284-8a260b302b7e","resolution":{"observed_at":"2026-08-01T22:37:10.594992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.694688Z","title":"OpenAI Codex, issue #13491,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.694688Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:0655d6b4e5773212496502c785dd11431d36d7e77b0a456d7271ada888c6d955","observation_id":"289db03a-21e1-4669-890c-1dfe042f0fe9","resolution":{"observed_at":"2026-08-01T22:37:10.694688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:10.860111Z","title":"Gemini CLI, issue #3037,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:10.860111Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:81beafd5ddf102330a30fabd0a4a0a0dac5c7ed30ad0b3679f3921001bde4dbb","observation_id":"eb507fde-026a-4078-affb-a3e4951f54fe","resolution":{"observed_at":"2026-08-01T22:37:10.860111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:11.029197Z","title":"CrewAI, issue #3154,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:11.029197Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:b4ed57679d6201654eb89966fad4e1b15d4d93f39855772e050070a58ee869ee","observation_id":"2c5b2405-5366-4062-8bfb-7f7fe5170d8f","resolution":{"observed_at":"2026-08-01T22:37:11.029197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:11.135277Z","title":"Gemini CLI, issue #7223,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:11.135277Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:fe4ce111bd638a8f317e983e0c052749b550a8f242baed8dd90be643020adf65","observation_id":"d95dabd7-2372-4899-bf4a-8deeb447b0bd","resolution":{"observed_at":"2026-08-01T22:37:11.135277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:11.226840Z","title":"CrewAI, issue #3843,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:11.226840Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:114b2bae345994428c5a092ddabbeb7146a109b949662d2231cea45382aa4272","observation_id":"7c7b894a-d17a-462f-a5af-d2c5d0f75a59","resolution":{"observed_at":"2026-08-01T22:37:11.226840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:11.312161Z","title":"OpenAI Codex, issue #5807,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:11.312161Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:cc2e65d6634b7c90d2ba4fa3774533beb49b1251f7086a9663412988d0d3eb44","observation_id":"ff26ed74-bd70-48a1-9a6f-791727f41fba","resolution":{"observed_at":"2026-08-01T22:37:11.312161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:11.472831Z","title":"OpenAI Codex, issue #10828,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:11.472831Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:bb93580830fc171ae3d206dc410e1e4b076fd7e78a431bd345148729e8509b5d","observation_id":"e3901996-7c21-456a-9d21-b2588e22945d","resolution":{"observed_at":"2026-08-01T22:37:11.472831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:11.637984Z","title":"Gemini CLI, issue #533,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:11.637984Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:6825e0c9a0669eb8e4c88d018de1a01b664f2c8e87f59ff9807e52b4feaba212","observation_id":"783475dc-09cc-4a09-9d24-fbb3b2b42142","resolution":{"observed_at":"2026-08-01T22:37:11.637984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:11.739378Z","title":"LangChain, issue #12077,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:11.739378Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:5927a28d30aee83368fb155292e9d8cd54d485e4bb49f17bd75a04d40ceea275","observation_id":"c42597bb-e372-40bc-9105-579236505f5e","resolution":{"observed_at":"2026-08-01T22:37:11.739378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:11.851656Z","title":"LangChain, issue #5163,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:11.851656Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:cb7d3106cfb7456c39691a88b39b3dee9155b539e67327a62750c0a6d1eddab4","observation_id":"c60e6932-edcb-4a37-8018-4fe155878654","resolution":{"observed_at":"2026-08-01T22:37:11.851656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:11.954925Z","title":"LangChain, issue #11408,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:11.954925Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:d79815b884b94f7d64eb6a3f23eea45ca495b57b23cf403bd80a6a6db6dd4b1b","observation_id":"af4ef494-e4ac-40fe-be74-ea8432b1be61","resolution":{"observed_at":"2026-08-01T22:37:11.954925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:12.133968Z","title":"Gemini CLI, issue #1484,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:12.133968Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:11ccb7298b923b20a7a1329d5d00577d9adbf02adb9ddbc51fb6ad7596cd34ce","observation_id":"d8f34c4e-10bb-499c-a371-0b96f5389286","resolution":{"observed_at":"2026-08-01T22:37:12.133968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:12.241500Z","title":"LangChain, issue #34910,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:12.241500Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:10fa4ec840f6803d0bd71a08192d3eaf30aa9cbd3cc3454ad3cd5d4346275774","observation_id":"b440e43c-515e-4fef-b2c5-aae7726c3b75","resolution":{"observed_at":"2026-08-01T22:37:12.241500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:12.329196Z","title":"Automated structural testing of llm-based agents: Methods, framework, and case studies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:12.329196Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:ee7f12ee9f7a315a77d17fbf8d7809ff80f6c5f9569cab1e5daf4b116d5ccff2","observation_id":"d49fbe32-1ba4-4bfa-bbc1-32154f1e6cf9","resolution":{"observed_at":"2026-08-01T22:37:12.329196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:12.376377Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:12.376377Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:b318c08aa80c3eb42ca68e3c3d95f6d321b85fe9eee3dc396f348b0b1b18011c","observation_id":"347c0d57-dae7-4b3e-be53-f1b1685bfc7a","resolution":{"observed_at":"2026-08-01T22:37:12.376377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:12.443945Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:12.443945Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:af2530ad638aec2fbaabb57416bf4f705f8743838f06d5cbc07a8a5c7b40d44a","observation_id":"49b64a78-06c8-45c2-9048-a22ad3ed109c","resolution":{"observed_at":"2026-08-01T22:37:12.443945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:12.587669Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:12.587669Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:4bef50f1e7667cb1a950053050526af6e6df8cebf7628aa9b46bbc8ee22566c1","observation_id":"21b2c6f6-6b21-4d92-9721-6780710678ee","resolution":{"observed_at":"2026-08-01T22:37:12.587669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-08-08T22:28:26.004138Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-01T22:37:12.789084Z","title":"Autogen: Enabling next-gen LLM applications via multi-agent conversation framework,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:12.789084Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:9d5f2492dd7ebbcebfd5606c926b6a0578f380c0b547408f33283fcbb830497b","observation_id":"32155a4c-888e-4db9-b9cc-27e4d0e558f2","resolution":{"observed_at":"2026-08-01T22:37:12.789084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:12.883489Z","title":"Metagpt: Meta programming for A multi-agent collaborative framework,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:12.883489Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:2cd1ae1b5ea630bcd3cc70b7763e67773e088ae0887f9005c8bde723023f50f3","observation_id":"1d3a576b-e1d9-4ec8-b739-3eca952b7bf4","resolution":{"observed_at":"2026-08-01T22:37:12.883489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:13.020211Z","title":"Chatdev: Communicative agents for software development,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:13.020211Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:f047cfea524037cf9927afbbd053ceb3a4d74d1085eb4c81ab91f975f9daa91c","observation_id":"e53f88b2-4c08-44f8-9a6f-48a08553dc29","resolution":{"observed_at":"2026-08-01T22:37:13.020211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:13.163339Z","title":"Hidden technical debt in machine learning systems,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:13.163339Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:668f91ad6b21bcc52e8c36552a0865ef96078e10622f4afde63d5a1dae34ad9f","observation_id":"84f47ea3-ae31-47e5-9a97-417a79bbc691","resolution":{"observed_at":"2026-08-01T22:37:13.163339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:13.369041Z","title":"Software engineering for machine learning: a case study,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:13.369041Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:08e896f11ee86a8dea121bfa85032a184d1ee88a9f22945f50863d9f47bca35b","observation_id":"9dd8d2c5-2b8a-4c30-b4dd-787a62feeda7","resolution":{"observed_at":"2026-08-01T22:37:13.369041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:13.521859Z","title":"A comprehensive study on deep learning bug characteristics,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:13.521859Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:d399f8932a4470718aa32d5a410a021e14a89b9efb5b3f689423c11cd238d7d4","observation_id":"d0a47fa4-d32f-4cde-bfd6-166cabc8b631","resolution":{"observed_at":"2026-08-01T22:37:13.521859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:13.659284Z","title":"Taxonomy of real faults in deep learning systems,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:13.659284Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:ce77e200c87e4dd803e9c65f62d842cf460f156c45899ace3b458b9e8b665988","observation_id":"9c30a309-27ec-47f3-a9a3-8d173e318665","resolution":{"observed_at":"2026-08-01T22:37:13.659284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:13.794091Z","title":"Deepxplore: Automated whitebox testing of deep learning systems,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:13.794091Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:068fbf72bc535eb73e086a146ea80b6a2c8c6a919bc4684e829ae51e624f51e3","observation_id":"f9fa580c-44d7-414f-a823-8f686b3817d0","resolution":{"observed_at":"2026-08-01T22:37:13.794091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:13.941385Z","title":"CRADLE: cross-backend validation to detect and localize bugs in deep learning libraries,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:13.941385Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:181dce9e08a5025082fe655c11b5b4a2c1d980c23fcbf00e7bb45cf441acdc33","observation_id":"149a0792-a783-434d-a9f8-6c48b0660d31","resolution":{"observed_at":"2026-08-01T22:37:13.941385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:14.015087Z","title":"Beyond accuracy: Behavioral testing of NLP models with checklist,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:14.015087Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:dac99a73f354838b1fad65332f57cb0787209208a48f3e7fd7088958db7db77b","observation_id":"eaed2a15-1947-4ffe-ae3a-5f9601e3881b","resolution":{"observed_at":"2026-08-01T22:37:14.015087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:14.088100Z","title":"Truthfulqa: Measuring how models mimic human falsehoods,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:14.088100Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:a1524d3e1e174e5140f241b0aac4a7cd4e83a1610a66b709878d2c1b5a1207f0","observation_id":"6d99dd7b-d4fd-414c-ad06-d0d11097bd13","resolution":{"observed_at":"2026-08-01T22:37:14.088100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:14.251905Z","title":"Factscore: Fine-grained atomic eval- uation of factual precision in long form text generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:14.251905Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:77d0c97c6267e076e8ccc097b23f530fe2e2087cfea60ab66e0d7bdbba64233e","observation_id":"47684022-3225-41c7-8b68-d9600deb0ab0","resolution":{"observed_at":"2026-08-01T22:37:14.251905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:14.353129Z","title":"Selfcheckgpt: Zero-resource black-box hallucination detection for generative large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:14.353129Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:2ef61b0d65368d035a1c4ab0c95516e5b24beffdffd77292a9dc4bbefcf1d9cc","observation_id":"66f26dbc-e122-4a46-9cc8-873fc18c84f2","resolution":{"observed_at":"2026-08-01T22:37:14.353129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:14.453693Z","title":"Halueval: A large- scale hallucination evaluation benchmark for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:14.453693Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:6053bab947efb7b68afafcc2c7643b6473f68edefdf95c653bf260fd48daf7b7","observation_id":"83fc9d09-1e98-4ea1-ae36-183f0234b97e","resolution":{"observed_at":"2026-08-01T22:37:14.453693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:14.546280Z","title":"On faithfulness and factuality in abstractive summarization,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:14.546280Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:50ca24e30738add98434b28c906dd084f858a9b82e02dd4736a7c7e6e5debcbc","observation_id":"04b65dcb-04dd-47d5-bb67-100e88d3820d","resolution":{"observed_at":"2026-08-01T22:37:14.546280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:14.662118Z","title":"What makes a good bug report?","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:14.662118Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:edafd40663d60fd0635697279c0b6029c9b158eb7a5c96d0369ec9467d5d1f6e","observation_id":"51c25f90-9b1b-45f7-a561-fffd34b5c9c5","resolution":{"observed_at":"2026-08-01T22:37:14.662118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:14.774960Z","title":"Who should fix this bug?","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:14.774960Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:33a873400900d92f3b948b32b481d8648d6e09033bfe21ff0868a348b411121c","observation_id":"2e44392d-6dcc-48d0-a4a4-979b9e1fa655","resolution":{"observed_at":"2026-08-01T22:37:14.774960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:14.882936Z","title":"It’s not a bug, it’s a feature: how misclassification impacts bug prediction,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:14.882936Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:b12244de0f7e3182562b581f30c3a34e05bed33eec1e485a95e7c11042caf328","observation_id":"221e4a5a-5263-4897-99e1-9111a9d77d6d","resolution":{"observed_at":"2026-08-01T22:37:14.882936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:37:09.106620Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T22:37:09.106620Z"},"links":{"citing_paper":"/paper/2607.15684"},"observation_digest":"sha256:bb27ab43db3040462f8ff24d8a6bedbda832d898a14acbcefdb8a424d5c6e7ed","observation_id":"3600bc5b-c534-4398-9843-101d8d8fdc09","resolution":{"observed_at":"2026-08-01T22:37:09.106620Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.15684","last_updated":"2026-07-17T06:53:31Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-10T10:31:40.280724Z","submitted_at":"2026-07-17T06:53:31Z","title":"Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":71,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2607.15684."}