{"as_of":"2026-08-09T15:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:16b9c3abea6af8c6c705b6965525faaa690597a19c17232d9f400d79e0f027ef","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:45:13.584381Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03743/citation-record","integrity":"/paper/2608.03743/integrity","json":"/paper/2608.03743/citation-record.json","paper":"/paper/2608.03743"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.15503","last_updated":"2026-05-21T21:46:55Z","snapshot_observed_at":"2026-07-06T22:16:05.197728Z","submitted_at":"2025-08-21T12:30:30Z","title":"Guidelines for Empirical Studies in Software Engineering involving Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15503","snapshot_observed_at":"2026-08-05T13:45:11.847345Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:11.847345Z"},"links":{"cited_paper":"/paper/2508.15503","citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:a1c5ee6758d342aeb9fdf070739581104e3267b1183f143d455739e876c72f33","observation_id":"14850c7b-570f-48a1-8695-42e69584df9e","resolution":{"observed_at":"2026-08-05T13:45:11.847345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:11.935917Z","title":"On the reliability of coverage- based fuzzer benchmarking","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:11.935917Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:3970c44bc77289ae267a6d56f32c7f70089b13058d326c9a47f78ddab88e8696","observation_id":"d4db2121-af52-4c27-b56e-3c627052eef3","resolution":{"observed_at":"2026-08-05T13:45:11.935917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:15.843499Z","title":"Bubble tea: A powerful little TUI framework","venue":null,"work_id":"7d45a9e8-cf07-4ff4-9b99-7d534251402a","year":2024},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.002146Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:68af4cc9a718d98d9aacbf79668e2a40b65e9f8705864504516a84279ee20d3e","observation_id":"a0c9bc5f-474a-45ce-b2bc-92be7c991398","resolution":{"observed_at":"2026-08-05T13:45:15.936928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:12.071049Z","title":"Automated test input generation for Android: Are we there yet? InProceedings of the 30th IEEE/ACM International Conference on Automated Software Engineering (ASE), pages 429–440","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.071049Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:2dbe295511e4b46a5e2973945bdea02dbf77da9ccd9c3aa2a19982474a0568b3","observation_id":"5f0a9fc3-37d2-4bbc-965a-70dedf3ae200","resolution":{"observed_at":"2026-08-05T13:45:12.071049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:15.611960Z","title":"Ink: React for interactive command-line apps","venue":null,"work_id":"c11c63c4-d0af-4b6f-a66a-f914907259fa","year":2024},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.160122Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:5731ccd80d80761792607db9d7f9090b5453148c72e514bc4cfbd966439e2dc9","observation_id":"1814a1f5-da02-473c-a523-21bbdc7db07c","resolution":{"observed_at":"2026-08-05T13:45:15.695943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:12.258574Z","title":"Large language models are zero-shot fuzzers: Fuzzing deep-learning libraries via large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.258574Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:ce0e726345426fd802f591210a3d0d4c15e2d9b65358de33819bb5eda22f6a92","observation_id":"732af297-c555-4c99-ae4b-ee48282911fb","resolution":{"observed_at":"2026-08-05T13:45:12.258574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:12.323878Z","title":"Coverage is not strongly correlated with test suite effectiveness","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.323878Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:d07158810b84b19ce2e60f6a9e1eda4a7432db9b3a4c10ec6f1906e10ad0a47e","observation_id":"ff4d96db-b9d0-4f9a-824b-d9f4f82ce7d1","resolution":{"observed_at":"2026-08-05T13:45:12.323878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:12.447124Z","title":"Testing the limits: Unusual text inputs generation for mobile app crash detection with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.447124Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:b7519d3a7d2358f1ae9eaa903b04c9e1e209e9417e81b01af1ed419ce45bd677","observation_id":"78463118-4fd8-4497-8e71-552943f5ce16","resolution":{"observed_at":"2026-08-05T13:45:12.447124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:15.417871Z","title":"An empirical study of automated unit test generation for Python.Empirical Software Engineering, 28(2), 2023","venue":null,"work_id":"7d7e3c1b-c884-4c41-bf47-64cc75b49fe2","year":2023},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.498585Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:1eae6d984c11a18402eb0a92615e8857cd685f079aea04d5a7953a5df47a6746","observation_id":"aa08d615-0663-456b-b35f-9d33d5aa772f","resolution":{"observed_at":"2026-08-05T13:45:15.493688Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1411.24914","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:14.305641Z","title":"Dynodroid: An input generation system for Android apps","venue":null,"work_id":"83c05c22-b462-4860-bab9-6b1c34903a6f","year":2013},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.605286Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:262a84c07d627a9b876b4ce3f0f7fd04947aa80cbfaff4efb19dd70b883c88ab","observation_id":"3aa74238-ed38-4567-9d94-910383917f96","resolution":{"observed_at":"2026-08-05T13:45:14.384229Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:12.688567Z","title":"Sapienz: Multi-objective automated testing for Android applications","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.688567Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:e310e607d8bcb8a0ecc00c34a8b80cf4eb62285deaf945046e84cdcc342e751b","observation_id":"9b3e22fe-ac61-4ee1-ac26-118c14ee334e","resolution":{"observed_at":"2026-08-05T13:45:12.688567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:15.157761Z","title":"TUI Test: End-to-end terminal testing framework","venue":null,"work_id":"2643769d-8b03-45d3-815e-ced4ec496678","year":2024},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.765084Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:9ea2deb16556804bad34755b5ff0cecb1d40301e823229ac9a0c152c4828020e","observation_id":"fcf93fdf-2ebc-4a15-927c-6d107ccf7a72","resolution":{"observed_at":"2026-08-05T13:45:15.260774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:12.840941Z","title":"Are mutation scores correlated with real fault detection? a large scale empirical study on the relationship between mutants and real faults","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.840941Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:0eb5a77da5c1b31e196bee029ff109158c652e5e4ca6df25cfe29e6b404869a5","observation_id":"b7ef1adb-caca-4b49-b2fb-4f7512789c5d","resolution":{"observed_at":"2026-08-05T13:45:12.840941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:14.983638Z","title":"Ratatui: A Rust library to build rich terminal user interfaces","venue":null,"work_id":"cf36640b-9fe6-4e1a-9303-04448d5fdd7b","year":2024},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.940032Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:0b56d79831a03c9dadcaf4e733c29d10fca18851f57aa436049d35371498794e","observation_id":"43841181-2433-4395-95ce-b1be2dc5802f","resolution":{"observed_at":"2026-08-05T13:45:15.057173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:12.997533Z","title":"Deep reinforcement learning for black-box testing of Android apps.ACM Transactions on Software Engineering and Methodology, 31(4):1–29, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:12.997533Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:3104c8235d39cc46c3709310008610191d91a2c11bf6be281e7eacb3e4c00541","observation_id":"3a4e4a83-842c-497a-9e47-f38eff38c6f3","resolution":{"observed_at":"2026-08-05T13:45:12.997533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:13.095297Z","title":"An empirical evaluation of using large language models for automated unit test generation.IEEE Transactions on Software Engineering, 50(1):85–105, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:13.095297Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:509dd80dc5366397772aba67a7d095e7fb1d1a5aa3a614de75b5d0bd8a0a2334","observation_id":"eec36d24-7c4a-4cc8-b616-a6691c160890","resolution":{"observed_at":"2026-08-05T13:45:13.095297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12513","last_updated":"2023-03-16T15:52:03Z","snapshot_observed_at":"2026-08-04T15:27:19.628544Z","submitted_at":"2021-11-24T14:19:09Z","title":"FLACOCO: Fault Localization for Java based on Industry-grade Coverage","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.12513","snapshot_observed_at":"2026-08-05T13:45:13.142336Z","title":"FLACOCO: Fault localization for Java based on industry-grade coverage.arXiv preprint arXiv:2111.12513, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:13.142336Z"},"links":{"cited_paper":"/paper/2111.12513","citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:262ae66fb6b0c6f7bde916f51a80ff8fbdae22ba34310d3ac1b14c388e651dab","observation_id":"d8ff440c-0a77-44ee-9699-1a78c33e5ad2","resolution":{"observed_at":"2026-08-05T13:45:13.142336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/icst.2008.26","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:13.675585Z","title":"Relationships between test suites, faults, and fault detection in GUI testing","venue":null,"work_id":"7e62b1a5-5d34-48ef-aa75-b009ec3262f5","year":2008},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:13.250929Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:10323cba077c0e8c91693d391515082734072a9c2ad71baf62a7ac5d533d6245","observation_id":"a0553947-4b2c-4a61-93bd-6bdbb45d9438","resolution":{"observed_at":"2026-08-05T13:45:13.742595Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:13.334241Z","title":"Guided, stochastic model-based GUI testing of Android apps","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:13.334241Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:0fa394a1decafcfb83299dfc502599420f1f6c25e86951b3f728b692b7dcf2da","observation_id":"4adbbc5c-5597-4c65-9b75-21dfaccdedac","resolution":{"observed_at":"2026-08-05T13:45:13.334241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:14.800398Z","title":"Textual: A Rapid Application Development framework for Python","venue":null,"work_id":"619e7df0-067d-49e9-9ef5-d10fb50e0cbe","year":2024},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:13.414304Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:aa0a1f08942bc1dfdde7a67a0f3f0798391b64edb0d0cc3e415c963597f53296","observation_id":"62bedda9-01e6-4ecd-a1b7-ceb5a5f00a24","resolution":{"observed_at":"2026-08-05T13:45:14.882578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11938","last_updated":"2023-08-31T09:02:16Z","snapshot_observed_at":"2026-07-06T15:19:13.162460Z","submitted_at":"2023-04-24T09:20:13Z","title":"Is ChatGPT the Ultimate Programming Assistant -- How far is it?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11938","snapshot_observed_at":"2026-08-05T13:45:13.517466Z","title":"Bissyandé","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:13.517466Z"},"links":{"cited_paper":"/paper/2304.11938","citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:e5d2a06b4712f70bf22dc1c489a2edf73d45047ce3a0a26831c5b2c23564ec4c","observation_id":"b91798b6-6fde-41dd-ba4b-643d05268ae2","resolution":{"observed_at":"2026-08-05T13:45:13.517466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:13.584381Z","title":"Cohen, and Atif M","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:13.584381Z"},"links":{"citing_paper":"/paper/2608.03743"},"observation_digest":"sha256:56fe9b7a089d1d23d1b179d68f5858954a7f910e1f0188af9886bc97a4432a6d","observation_id":"2839da55-884a-4a60-af67-7fb408a3dd12","resolution":{"observed_at":"2026-08-05T13:45:13.584381Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03743","last_updated":"2026-08-04T14:36:44Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-09T06:17:56.673628Z","submitted_at":"2026-08-04T14:36:44Z","title":"Can LLMs Test Terminal User Interfaces?"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2608.03743."}