{"as_of":"2026-08-16T21:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e12bd5c0b4bb7c8c10621b10f0f2cf5d3ae1952ea25a147648bca5aeb614ddb7","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:31:40.420891Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.22880/citation-record","integrity":"/paper/2607.22880/integrity","json":"/paper/2607.22880/citation-record.json","paper":"/paper/2607.22880"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.266680Z","title":"CodeCover","venue":null,"work_id":"1654a769-863e-4e61-9015-68c494eae6a8","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.188190Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:8bacea623b270386b1b6110ddb39df110f2319349e9a2a64f03c5d88c4d917f0","observation_id":"e3774c7c-71e8-45ba-9a28-b4c7fe6ece04","resolution":{"observed_at":"2026-08-15T15:31:42.270010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10200","last_updated":"2025-01-17T13:48:32Z","snapshot_observed_at":"2026-08-16T12:58:49.301242Z","submitted_at":"2025-01-17T13:48:32Z","title":"Test Wars: A Comparative Study of SBST, Symbolic Execution, and LLM-Based Approaches to Unit Test Generation","version":1},"cited_work":{"arxiv_id":"2501.10200","doi":"10.48550/arxiv.2501.10200","metadata_source":"pith","pith_arxiv_id":"2501.10200","snapshot_observed_at":"2026-08-15T18:16:14.067578Z","title":"Test Wars: A Comparative Study of SBST, Symbolic Execution, and LLM-Based Approaches to Unit Test Generation","venue":"cs.SE","work_id":"a9e29319-49b0-40e8-a7eb-d6df59c539e3","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.194158Z"},"links":{"cited_paper":"/paper/2501.10200","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:ad8951633968945629184795098866be076e7d1894783893e5065b7df7572f91","observation_id":"5d627e40-f342-4aa5-a08f-4d6a30c2a19e","resolution":{"observed_at":"2026-08-15T15:31:40.649139Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.198700Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.198700Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:bb80445fcb6be9682a3e565fb2d9095caa4f1d97f4438db81781c00977b7b7a6","observation_id":"60aa58b9-0628-40b3-b56c-baf830e4446a","resolution":{"observed_at":"2026-08-15T15:31:40.198700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.202462Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.202462Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:b35395d8ae86713a287f6294e7182e4dd667cde1d5df882f163171e077965bf8","observation_id":"3416ec97-8745-4ad3-ab9b-ce25c669cb32","resolution":{"observed_at":"2026-08-15T15:31:40.202462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.256130Z","title":null,"venue":null,"work_id":"473da5de-fc66-4919-9ff0-c3bc1f8d90c9","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.206364Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:88d8fb14a9c3a6f8995b7465cb525dd9aae1eabaa1c4d6b6c282d53b0af25076","observation_id":"30a8b575-9fdb-45f2-b7b8-a31abd07f37d","resolution":{"observed_at":"2026-08-15T15:31:42.259960Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-15T15:31:40.210311Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.210311Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:d7b66024c5aa081e45e2744cdcb95c4f307e138e47cf1ab266e595ba5fc71bb5","observation_id":"6bd6f1e9-8ca7-4f45-a5b9-9cc0622bddee","resolution":{"observed_at":"2026-08-15T15:31:40.210311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.214997Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.214997Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:48970c9873571e0077d14e4959fde0972859d719a98001ea75973ff339ef4da6","observation_id":"31c39ec5-0c90-492a-bc16-9c4e394d049e","resolution":{"observed_at":"2026-08-15T15:31:40.214997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.218667Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.218667Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:f5cf63b4ca087d5fa10e15a34f79960b0c7f8c2711c0ad7ed64bbd7834588159","observation_id":"f86d9a17-3878-427f-a804-9f23d6c5ca70","resolution":{"observed_at":"2026-08-15T15:31:40.218667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.222429Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.222429Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:15a8330fe1779cf61910ee7913bd37dc034c2e94f62ed4222a8f95a724bac345","observation_id":"e11f3c8e-a258-4456-b289-0f1e6be0423e","resolution":{"observed_at":"2026-08-15T15:31:40.222429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10664-013-9290-8","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.614212Z","title":"Carver, Natalia Juristo, Maria Teresa Baldassarre, and Sira Vegas","venue":null,"work_id":"3ab1c062-3e7d-41c8-bfd0-268b28fa0f9c","year":2014},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.226187Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:bba31d4af2568828b0b2da0d0d8e045f5d1bacfedbe4a147c0799ccb70dfaf3a","observation_id":"75471c7a-e072-40bd-9bba-582112b6fbba","resolution":{"observed_at":"2026-08-15T15:31:40.617851Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-15T15:31:40.230316Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.230316Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:c3e19940ec440b9f8ad09d31f6c170c6c86ab7992714972501faed2fa8e5f049","observation_id":"b52cc9d6-143b-414e-af13-16f3466c2c48","resolution":{"observed_at":"2026-08-15T15:31:40.230316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.234593Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.234593Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:7d2aed94e441aee38645dad1bcfa9d571ff86498487d94be957dbefb645531f2","observation_id":"e86f442a-eb10-46ec-aef7-2213f9b1fb82","resolution":{"observed_at":"2026-08-15T15:31:40.234593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.238451Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.238451Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:c8b406bf3770c7d41a36b04ebba047c9accb86dfa667bdaab8bb6ca1fbc6efa1","observation_id":"349bd481-b50b-42f1-84da-da9d08aeae25","resolution":{"observed_at":"2026-08-15T15:31:40.238451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.242024Z","title":"Desmarais","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.242024Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:f7b628138d4224d655781f26cd3de658c6e0591af786af1ef3d4f0b45acf6dd5","observation_id":"bae9b54e-c611-40d9-945b-d969506b3dca","resolution":{"observed_at":"2026-08-15T15:31:40.242024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T15:31:40.245712Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.245712Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:483c28660614e52f2734e7af1c1dcf073db80478c388123f6852324b1f4b243b","observation_id":"87146827-eab1-44d6-a92c-dc60bf32144b","resolution":{"observed_at":"2026-08-15T15:31:40.245712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T15:31:40.250644Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.250644Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:d4f8d882058f574c75a40069e02c5bfec8d67ba70d31b9ed8620b550212a9d18","observation_id":"0bfcb766-fffa-4c6b-bc04-cd4cbdef0f2e","resolution":{"observed_at":"2026-08-15T15:31:40.250644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8195.28829","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:41.700132Z","title":"Frankl and Oleg Iakounenko","venue":null,"work_id":"d25caba7-6e48-4075-9d74-6e566559fcd6","year":1998},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.254778Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:e8420215c4a144e0df5e985ceeff0f141808fcb272d9605dd067d20351796d36","observation_id":"ba8ca553-b5cc-4838-839b-9d3aa4aa4adf","resolution":{"observed_at":"2026-08-15T15:31:41.705831Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.258988Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.258988Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:5de5f1b6a03ed182133d8b6c760b37cf754e33b4cb60d83528b8e5f19f5380f5","observation_id":"c6e166cb-33c1-45f0-85c3-a6b6f6cd8651","resolution":{"observed_at":"2026-08-15T15:31:40.258988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.267797Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.267797Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:8cf0837e1ef7e6aa4a9975ba4e63364b76e3a3524734a191c561ff3da8621f49","observation_id":"7c61e1c6-ea79-4b31-9d85-617d1bdc3636","resolution":{"observed_at":"2026-08-15T15:31:40.267797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.244214Z","title":null,"venue":null,"work_id":"e0ebcb34-a5f2-4603-a3a3-0616558325f9","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.271300Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:c638967f52b09a4deb3a0cff30bee8d7af75d0cb9e806f52ecac2bc5d586ad2b","observation_id":"4eef368e-0f03-4622-adf9-5f4bd24069c3","resolution":{"observed_at":"2026-08-15T15:31:42.248854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.233918Z","title":null,"venue":null,"work_id":"e7312d42-8b2b-45f1-9951-376904d9484c","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.274605Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:702e2f99386ec2914782885c6973bfa7b1e7ef32811ee8b4ece607c54e39f4af","observation_id":"49b62195-0ae5-4041-b267-e7a6e0670344","resolution":{"observed_at":"2026-08-15T15:31:42.237418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.222094Z","title":"Guilford","venue":null,"work_id":"8afe8b14-bc06-4cef-a164-cc6b5e007bcb","year":1956},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.278190Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:f1074ef04f48f1b26f30dc319c660b519b0562cfddeed91d30247036785984aa","observation_id":"ffa0e27f-4020-4746-b094-82544a2428c1","resolution":{"observed_at":"2026-08-15T15:31:42.226430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.282011Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.282011Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:b780dc1337ba6f444fd701704c5857ef574697153e242d6bc0a86f61a8bad3e8","observation_id":"4cd30ce4-60a6-4f1a-97a6-e29f75e9329c","resolution":{"observed_at":"2026-08-15T15:31:40.282011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/dasc.2001","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.566492Z","title":"Hayhurst and Dan S","venue":null,"work_id":"c55ee9ed-0d5f-4479-af4f-56b078f76c1f","year":2001},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.285419Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:fe2b5f7452a17bcfba7adce0b564d59ec94e54ba76ef24c9db164264ef07a1ed","observation_id":"c40b0cb7-31ab-43cb-994b-a1ad62c70501","resolution":{"observed_at":"2026-08-15T15:31:40.570295Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.09938","last_updated":"2021-11-08T21:16:44Z","snapshot_observed_at":"2026-08-14T15:19:05.440904Z","submitted_at":"2021-05-20T17:58:42Z","title":"Measuring Coding Challenge Competence With APPS","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.09938","snapshot_observed_at":"2026-08-15T15:31:40.289786Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.289786Z"},"links":{"cited_paper":"/paper/2105.09938","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:f8b7f6c43d4cee7fb9d27e71930b0b2df674844dfcd265b7b694046ef72e8f0d","observation_id":"83579d4c-9be5-47d9-8cec-0338766905da","resolution":{"observed_at":"2026-08-15T15:31:40.289786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.294426Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.294426Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:0b317279490a0040f5ec3b71b0686221bad8d8fe0e138df1a0d3272fe656fa48","observation_id":"e3b004b7-bcea-4710-a1e9-b2f23d186d5e","resolution":{"observed_at":"2026-08-15T15:31:40.294426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09464","last_updated":"2025-03-28T03:00:37Z","snapshot_observed_at":"2026-08-16T13:18:33.228471Z","submitted_at":"2024-09-14T15:17:34Z","title":"Measuring the Influence of Incorrect Code on Test Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09464","snapshot_observed_at":"2026-08-15T15:31:40.301819Z","title":"Zhang, Mark Harman, Mingzhe Du, and Heming Cui","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.301819Z"},"links":{"cited_paper":"/paper/2409.09464","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:fc6f21a9e28806157bf33b77ca842ff2f15df374c2bec3ee69aa0609b3cf5f56","observation_id":"a86b1350-7e76-46b2-a36e-a5bedd802d79","resolution":{"observed_at":"2026-08-15T15:31:40.301819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.305628Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.305628Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:ccafbcbed1a257ae781a264ed46a83d4e4a0cc52bd3b48827fc594f97c366ea9","observation_id":"b08abd26-15d9-4da4-9627-da16364f2ba5","resolution":{"observed_at":"2026-08-15T15:31:40.305628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00752","last_updated":"2025-03-18T19:50:04Z","snapshot_observed_at":"2026-08-16T13:13:42.452851Z","submitted_at":"2024-10-01T14:47:05Z","title":"TestGenEval: A Real World Unit Test Generation and Test Completion Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00752","snapshot_observed_at":"2026-08-15T15:31:40.309481Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.309481Z"},"links":{"cited_paper":"/paper/2410.00752","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:7ffae1b387a4ec3c44315e0098f89ab1fded23565e8033761384c9b7183c5f16","observation_id":"1398bc8e-2c83-4efc-864b-398212dfb026","resolution":{"observed_at":"2026-08-15T15:31:40.309481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-12T14:56:35.025839Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-15T15:31:40.313403Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.313403Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:1748b2b11a37fc17cd6295f001e7e45fbcae5b558045ad70509662d694696f5f","observation_id":"09584bc2-32a1-4a25-ad9a-02c66f9f4085","resolution":{"observed_at":"2026-08-15T15:31:40.313403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.211435Z","title":"Jorgensen","venue":null,"work_id":"8d26e664-ff7b-43d2-8788-3f1e9b28d375","year":2013},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.317166Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:111bc59c2a89a6233845124e9cce6dde75ec82695d02e38374f3f425443f4558","observation_id":"f5eb747f-2596-4cba-bfd4-a67e67964015","resolution":{"observed_at":"2026-08-15T15:31:42.214977Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.320682Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.320682Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:a159a152f0798212a1292c2a2db761cea6c71276c652610caca68f3acfab9da8","observation_id":"3b7cc701-b281-48af-91de-b0d4928adbc9","resolution":{"observed_at":"2026-08-15T15:31:40.320682Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.324490Z","title":"Ernst, Reid Holmes, and Gordon Fraser","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.324490Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:25aefcdd5c016ada1e363a7d750fe7e3d87d00e6b0528f8a7be7cb2f08f1dc1f","observation_id":"67a24f38-90ac-4b1c-b7dd-f143f25bb92c","resolution":{"observed_at":"2026-08-15T15:31:40.324490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.328421Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.328421Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:23ba7e1e08b41782dd6037c31a600987841c3ec79ab29f6f436c923c48bdbca7","observation_id":"889c739d-f1c2-41d8-a9c1-0380bff3e45e","resolution":{"observed_at":"2026-08-15T15:31:40.328421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.199822Z","title":null,"venue":null,"work_id":"e9d84ebf-01d5-4d66-ab01-76a238db2586","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.332147Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:a837488e740fabe2d9aae4130c25fa2a34ec1d9e0eb49c8ba6f66f6beb87da7e","observation_id":"c8e3f6c8-8c88-49a4-b108-0b9ad9bce4b4","resolution":{"observed_at":"2026-08-15T15:31:42.203836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.187158Z","title":null,"venue":null,"work_id":"10924d2e-eacf-47ec-acd1-b4300323fef3","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.335791Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:634f24e7e9151929acfa89d188e9fbdb81b92b66527d6fc8186e10383e4f2e9d","observation_id":"0f33adba-3a99-4be1-8e9a-6653ff8d7417","resolution":{"observed_at":"2026-08-15T15:31:42.191132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.339367Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.339367Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:050c0e68537ea2fea73a4b55749cf5ac6ea61a8b0c8035053c8601d8aef5cac2","observation_id":"37eaa4e5-3cc7-470d-ba2d-1adda0894593","resolution":{"observed_at":"2026-08-15T15:31:40.339367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.342936Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.342936Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:d3e2b23ec6188bd045ed96a7f6b5448f980637754d7c8b4a4b260c28e7a37f28","observation_id":"10e343c7-f1c8-49f7-888f-f68259340f2d","resolution":{"observed_at":"2026-08-15T15:31:40.342936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.176258Z","title":null,"venue":null,"work_id":"a4e60f34-a907-483f-8b30-8517d4b68745","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.346729Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:586b8da6b272fa52e947e1cfeb316c2e2a2cfae02145308fe886a318a0302d19","observation_id":"4836b645-3322-4ecf-8843-00a7f54eaa44","resolution":{"observed_at":"2026-08-15T15:31:42.180005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.165001Z","title":null,"venue":null,"work_id":"05b9206c-f283-428d-aaa8-52cdd662ab4a","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.350464Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:78a47b1d8fa167f32c96ac439d0e81cb0a805ca993bb2cac90a19f282b08a36d","observation_id":"18911a73-966a-44ef-8117-6aa87c7a2f93","resolution":{"observed_at":"2026-08-15T15:31:42.168991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.354273Z","title":"Hellendoorn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.354273Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:9fe8280716eef1b881c3a72f3738b828cf900e4b38440fc5c6d4cbee6aa7141d","observation_id":"11d529b3-3cea-4ebe-ae44-1aa5148fc5d5","resolution":{"observed_at":"2026-08-15T15:31:40.354273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.357918Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.357918Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:6c52f7b6c38495d20fbe0377e4043a0029af14b61a02b8e0d6e9fff0487c721e","observation_id":"24c53e41-ba62-469e-bbe9-b7a8f5cbac0a","resolution":{"observed_at":"2026-08-15T15:31:40.357918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.361611Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.361611Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:4f7e3e575a3fd7d1178f3f691129c4e51bf7890e98bb79dcf2c6b05027f69696","observation_id":"fe62bec9-888c-48bd-87c6-262cf7f131ed","resolution":{"observed_at":"2026-08-15T15:31:40.361611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.364941Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.364941Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:b8c683f1482fd2a2a6329cdae03f9501ec8da8ad29e6d4f0d3013a634753463a","observation_id":"a4ca250f-ce72-483d-8839-23b0122380b0","resolution":{"observed_at":"2026-08-15T15:31:40.364941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.368641Z","title":"Shull, Jeffrey C","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.368641Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:94d2b645e334c2f90271268d342551eae5c8bd3297b689b00a371565fd22cc6a","observation_id":"320ad5a2-1cf5-40da-9c5f-db1dafa04451","resolution":{"observed_at":"2026-08-15T15:31:40.368641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.372338Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.372338Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:1c9cbf311cb63111298ac365f84978e75fdd0afecc65db3d4887320ffd92468e","observation_id":"56d978a9-e54b-46b0-ae02-0111446bc519","resolution":{"observed_at":"2026-08-15T15:31:40.372338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.375982Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.375982Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:33bd3b96004224b851842c5c3266d24a29d7003ba8896ecb2cd2c70ae7c5376d","observation_id":"18dd2327-0cba-42ab-99cd-0f5d33c0d911","resolution":{"observed_at":"2026-08-15T15:31:40.375982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.379410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.379410Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:45c35174489700760a2e101b294975bfbc2449e3960e3ea88e7524b2ad153fdc","observation_id":"baf4841c-a3d0-4458-ba5f-adbe49534091","resolution":{"observed_at":"2026-08-15T15:31:40.379410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.05617","last_updated":"2021-05-20T23:11:01Z","snapshot_observed_at":"2026-08-16T20:50:56.360501Z","submitted_at":"2020-09-11T18:57:36Z","title":"Unit Test Case Generation with Transformers and Focal Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.05617","snapshot_observed_at":"2026-08-15T15:31:40.383193Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.383193Z"},"links":{"cited_paper":"/paper/2009.05617","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:7efe0f1e089414057c567134eb121bf499044b5833653800da63107047257a11","observation_id":"f2f4ae8f-cadd-4194-a745-3f4420ef8f00","resolution":{"observed_at":"2026-08-15T15:31:40.383193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.388012Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.388012Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:47a14f322dab527352f51eba8329e843ae86b470acc4a7a89fcc432a0d72cfe8","observation_id":"492cdeb6-b952-44bd-96c3-7a742c04168c","resolution":{"observed_at":"2026-08-15T15:31:40.388012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.392025Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.392025Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:6c5f28ffa08fc02a4ef0df4c0c7c0837b41348a5d6ebba334f31795547201d6c","observation_id":"2826801e-e1f3-42c7-8fc0-3377e1100de7","resolution":{"observed_at":"2026-08-15T15:31:40.392025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.395427Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.395427Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:a83103301b850046fa2ee2bd715a8455ae9fe4155c9176c076118320ccec86f6","observation_id":"3efb693e-cdb9-43e6-bacb-4652e83b429e","resolution":{"observed_at":"2026-08-15T15:31:40.395427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.154499Z","title":null,"venue":null,"work_id":"96ae655b-d115-4850-a1c3-e9dd970e9208","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.398883Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:920c73531e61b9c3422c4afb35b891cf4f42bbbc712059726e34539ce281f47c","observation_id":"2e268e1c-06e3-464d-9a9c-8c34c50de5cc","resolution":{"observed_at":"2026-08-15T15:31:42.158309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:42.142552Z","title":null,"venue":null,"work_id":"8a5a1e73-102d-4f7f-83cd-b9d4f8f0ddb9","year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.402294Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:094eccd0ff283c328d73fba19a059d9411e827d97d75df87bd753ccfd1d015db","observation_id":"cc3c0120-0f92-4191-82ba-7fd1fa739aeb","resolution":{"observed_at":"2026-08-15T15:31:42.146716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.405907Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.405907Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:bc27267edc550485072ab3399960cad5d0fb1b10797734fced01c2c8b4f9d8ab","observation_id":"e781eb0d-a9b5-4ff2-bf7a-89b63bcb7f7c","resolution":{"observed_at":"2026-08-15T15:31:40.405907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.409490Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.409490Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:26d2b8cf06be13d35a7f6f28fa8f480dadd6e4917b30fda83c391ea39add0ffa","observation_id":"8daea706-003f-42fc-ace1-19e702f0f906","resolution":{"observed_at":"2026-08-15T15:31:40.409490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15227","last_updated":"2025-06-18T08:11:10Z","snapshot_observed_at":"2026-08-16T09:14:27.248409Z","submitted_at":"2025-06-18T08:11:10Z","title":"Large Language Models for Unit Testing: A Systematic Literature Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15227","snapshot_observed_at":"2026-08-15T15:31:40.413422Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.413422Z"},"links":{"cited_paper":"/paper/2506.15227","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:cee235f18a2ec3b105a98eeef28e3664a529889fdcbe81605768d949fe285af1","observation_id":"5b341ce7-8c67-47f8-aac0-b974336d1cc2","resolution":{"observed_at":"2026-08-15T15:31:40.413422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17561","last_updated":"2024-09-26T06:18:06Z","snapshot_observed_at":"2026-08-16T13:15:15.522415Z","submitted_at":"2024-09-26T06:18:06Z","title":"TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17561","snapshot_observed_at":"2026-08-15T15:31:40.417126Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.417126Z"},"links":{"cited_paper":"/paper/2409.17561","citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:cb0cef5cd260df8d0f805be6089ef6682e364f6ee0d060796819e64814a108ff","observation_id":"f8335f12-4e0a-4900-b0a6-95a4163b995b","resolution":{"observed_at":"2026-08-15T15:31:40.417126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.21437945","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:31:40.448971Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate With Their Effectiveness? (Replicability Study)","venue":null,"work_id":"8ec383f0-9cc9-4139-bdba-adc70f8f7062","year":2026},"citing_paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T15:31:40.420891Z"},"links":{"citing_paper":"/paper/2607.22880"},"observation_digest":"sha256:6a61a9c4fccfa237e4063a79767fcd2d976738e38529f5d674eb342dee177c8a","observation_id":"c7fc8f5e-182d-4582-ab79-75c1b459b783","resolution":{"observed_at":"2026-08-15T15:31:40.454779Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.22880","last_updated":"2026-07-24T19:46:30Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-16T18:45:11.601582Z","submitted_at":"2026-07-24T19:46:30Z","title":"Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":50,"verified_exact":4,"verified_fuzzy":2},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2607.22880."}