{"as_of":"2026-08-09T03:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:067ed366a2b1d09537d150c2026f34a0926a506301ac8af56d7f89682879f365","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:42:26.107547Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T11:07:15.220856Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","snapshot_observed_at":"2026-07-06T19:22:32.667859Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17561","snapshot_observed_at":"2026-08-07T23:42:26.107547Z","title":"Testbench: Evaluating class-level test case generation capability of large language models, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08806","last_updated":"2025-02-12T21:42:56Z","snapshot_observed_at":"2026-08-07T23:35:10.429545Z","submitted_at":"2025-02-12T21:42:56Z","title":"CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T23:42:26.107547Z"},"links":{"cited_paper":"/paper/2409.17561","citing_paper":"/paper/2502.08806"},"observation_digest":"sha256:2e8c11244313a5659d393d345e869c19f1610eb42399cde070d424e971918d3a","observation_id":"8be7cd65-24b6-47a7-ae15-563f1939239d","resolution":{"observed_at":"2026-08-07T23:42:26.107547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","snapshot_observed_at":"2026-07-06T19:22:32.667859Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17561","snapshot_observed_at":"2026-08-07T12:39:58.370843Z","title":"Yaowei Zheng, Richong Zhang, Junhao Zhang, Yanhan Ye, Zheyan Luo, Zhangchi Feng, and Yongqiang Ma","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24098","last_updated":"2025-05-30T01:00:34Z","snapshot_observed_at":"2026-08-08T22:31:37.525251Z","submitted_at":"2025-05-30T01:00:34Z","title":"HardTests: Synthesizing High-Quality Test Cases for LLM Coding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:58.370843Z"},"links":{"cited_paper":"/paper/2409.17561","citing_paper":"/paper/2505.24098"},"observation_digest":"sha256:6ee73357bfefa230955b21fd2a4202324d0925203e6c5bd214e01b3a1d9923ce","observation_id":"05460c55-7a88-42d1-a9f5-469868613ccd","resolution":{"observed_at":"2026-08-07T12:39:58.370843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","snapshot_observed_at":"2026-07-06T19:22:32.667859Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":"2409.17561","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17561","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Testbench: Evaluating class-level test case generation capability of large language models","venue":null,"work_id":"0bf06a46-a541-483f-aaa0-4517e12583e4","year":2024},"citing_paper":{"arxiv_id":"2506.02954","last_updated":"2026-04-15T23:50:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-03T14:47:22Z","title":"Mutation-Guided Unit Test Generation with a Large Language Model","version":8},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-19T11:05:15.898419Z"},"links":{"cited_paper":"/paper/2409.17561","citing_paper":"/paper/2506.02954"},"observation_digest":"sha256:8ed849fd0fe7a8e66aae6f5a7c0db88bf40481c1f43dc49ed6a8b12833815d6d","observation_id":"df8f2f9d-b5fb-4c36-93a6-44936b199a5e","resolution":{"observed_at":"2026-05-19T11:07:15.222383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","snapshot_observed_at":"2026-07-06T19:22:32.667859Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17561","snapshot_observed_at":"2026-08-07T11:00:46.160055Z","title":"Testbench: Evaluating class-level test case generation capability of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11081","last_updated":"2025-06-04T08:44:25Z","snapshot_observed_at":"2026-08-07T10:54:29.102647Z","submitted_at":"2025-06-04T08:44:25Z","title":"SAGE:Specification-Aware Grammar Extraction for Automated Test Case Generation with LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:00:46.160055Z"},"links":{"cited_paper":"/paper/2409.17561","citing_paper":"/paper/2506.11081"},"observation_digest":"sha256:3978049060802b5b3d728297ce7ab65d6b1498c8c38e143c235d96710700bf16","observation_id":"232477cf-05a4-4641-ad9a-aeb4b312fac2","resolution":{"observed_at":"2026-08-07T11:00:46.160055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","snapshot_observed_at":"2026-07-06T19:22:32.667859Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17561","snapshot_observed_at":"2026-08-06T20:47:44.819046Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01827","last_updated":"2026-07-06T16:39:03Z","snapshot_observed_at":"2026-08-06T20:39:33.116082Z","submitted_at":"2025-07-02T15:44:12Z","title":"PSearch: Search-based Patch Generation in the Era of LLM-based Automated Program Repair","version":5},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T20:47:44.819046Z"},"links":{"cited_paper":"/paper/2409.17561","citing_paper":"/paper/2507.01827"},"observation_digest":"sha256:2188418fb9ee0f1281b95990b3459124e3b5a2f7ae4a673f39893a30f1eb4a1c","observation_id":"8bc6679c-be36-4654-8ab4-9c2bbf5c259b","resolution":{"observed_at":"2026-08-06T20:47:44.819046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","snapshot_observed_at":"2026-07-06T19:22:32.667859Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17561","snapshot_observed_at":"2026-08-06T10:15:37.245997Z","title":"Testbench: Evaluating class-level test case generation capability of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.00408","last_updated":"2025-08-01T08:08:26Z","snapshot_observed_at":"2026-08-07T07:41:28.090408Z","submitted_at":"2025-08-01T08:08:26Z","title":"Benchmarking LLMs for Unit Test Generation from Real-World Functions","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T10:15:37.245997Z"},"links":{"cited_paper":"/paper/2409.17561","citing_paper":"/paper/2508.00408"},"observation_digest":"sha256:9711f54c827b617bc8fd91a23e81280b2d6bc1054b433f5875f0cc7ad2e8df96","observation_id":"cf2f71a3-4925-48f5-82d3-fce2de10f34b","resolution":{"observed_at":"2026-08-06T10:15:37.245997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","snapshot_observed_at":"2026-07-06T19:22:32.667859Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":"2409.17561","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17561","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Testbench: Evaluating class-level test case generation capability of large language models","venue":null,"work_id":"0bf06a46-a541-483f-aaa0-4517e12583e4","year":2024},"citing_paper":{"arxiv_id":"2604.22046","last_updated":"2026-04-23T20:03:18Z","snapshot_observed_at":"2026-07-29T18:38:45.260265Z","submitted_at":"2026-04-23T20:03:18Z","title":"Call-Chain-Aware LLM-Based Test Generation for Java Projects","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-09T20:56:02.634264Z"},"links":{"cited_paper":"/paper/2409.17561","citing_paper":"/paper/2604.22046"},"observation_digest":"sha256:5cd55d85d22d43eb5ef4af9b875a6014783cd6f26fd3df7e53dbea97c1260014","observation_id":"4f82533b-509b-4629-81db-f10e666e8a85","resolution":{"observed_at":"2026-05-11T14:51:10.180283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","snapshot_observed_at":"2026-07-06T19:22:32.667859Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":"2409.17561","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17561","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Testbench: Evaluating class-level test case generation capability of large language models","venue":null,"work_id":"0bf06a46-a541-483f-aaa0-4517e12583e4","year":2024},"citing_paper":{"arxiv_id":"2605.00942","last_updated":"2026-05-01T06:19:51Z","snapshot_observed_at":"2026-07-06T23:14:15.780028Z","submitted_at":"2026-05-01T06:19:51Z","title":"PPO guided Agentic Pipeline for Adaptive Prompt Selection and Test Case Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-09T19:17:56.164183Z"},"links":{"cited_paper":"/paper/2409.17561","citing_paper":"/paper/2605.00942"},"observation_digest":"sha256:979a7afe7c7b408745711ef223a88710570ce5605db06f30dc68830b2883a396","observation_id":"dfc5257c-2e6a-4d11-be43-ef2c55e8144c","resolution":{"observed_at":"2026-05-11T15:46:40.093414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","snapshot_observed_at":"2026-07-06T19:22:32.667859Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":"2409.17561","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17561","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Testbench: Evaluating class-level test case generation capability of large language models","venue":null,"work_id":"0bf06a46-a541-483f-aaa0-4517e12583e4","year":2024},"citing_paper":{"arxiv_id":"2605.01264","last_updated":"2026-05-02T05:43:29Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T05:43:29Z","title":"FeedbackLLM: Metadata driven Multi-Agentic Language Agnostic Test Case Generator with Evolving prompt and Coverage Feedback","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-09T15:04:59.096221Z"},"links":{"cited_paper":"/paper/2409.17561","citing_paper":"/paper/2605.01264"},"observation_digest":"sha256:d11a8d0148bf0a54e52defb6065ceacc379bb74e33bbdbfc500ad66067669c18","observation_id":"3ce5ed74-816e-4630-ba96-dce6a3070db8","resolution":{"observed_at":"2026-05-11T16:46:07.945625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2409.17561/citation-record","integrity":"/paper/2409.17561/integrity","json":"/paper/2409.17561/citation-record.json","paper":"/paper/2409.17561"},"outbound":[],"paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-07-06T19:22:32.667859Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2409.17561."}