Pith. sign in

Paper Citation Record · LEDGER

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification

As of 8 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 2 inbound Pith citation observations for arXiv:2502.08806.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.08806 v1

Coverage vector

measured 45 of 45 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T23:42:26.129442Z

measured 47 of 47 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:15:51.646014Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-19T11:07:15.212042Z

Reference resolution

45 of 45 outbound references displayed

  • verified exact0
  • verified fuzzy18
  • unresolved26
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 72508f8d-9e5d-48d8-a654-45ef9a705f8d · outbound

This paper cites write newline.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification write newline

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.911052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.911052Z digest=sha256:7bbe1e80fdf5f35a21d56319a6980d20d643da5b188a8c5cf9b0cb2fa9903bdc

Observation 59a9ffb5-0749-407a-ad4a-cc560e5de77f · outbound

This paper cites Meet yi-coder: A small but mighty llm for code, September 2024.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Meet yi-coder: A small but mighty llm for code, September 2024

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.884315Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.916747Z digest=sha256:be13961f607322d648f7baa806966a5fdb36c9c312d8b82cf7aff3a7d4b7d078

Observation 6e2c432d-aec1-443f-b814-def1994e424a · outbound

This paper cites Automated unit test improvement using large language models at meta.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Automated unit test improvement using large language models at meta

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.865696Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.922104Z digest=sha256:53285becc9e66e41dc91f0296282387602374b515c5b1a9662ab151fc0360689

Observation 5ac23173-e0fc-479c-8440-c21d548a7c5c · outbound

This paper cites Program Synthesis with Large Language Models.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Program Synthesis with Large Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.932738Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.932738Z digest=sha256:cd8432f7c4b3435d24c7400207b56286bee6fbe9d1182f4a724b9e8d51dc84e8

Observation a1117347-4f56-4fae-a840-11073f52d909 · outbound

This paper cites SUPER: Evaluating Agents on Setting Up and Executing Tasks from Research Repositories.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification SUPER: Evaluating Agents on Setting Up and Executing Tasks from Research Repositories

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.937607Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.937607Z digest=sha256:33eed57703ab863e90779bf316e729a76c627c02423287a5ece912f0968ef973

Observation c727c863-dc46-4ced-8d4b-0a7601781bb1 · outbound

This paper cites Evaluating Large Language Models Trained on Code.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Evaluating Large Language Models Trained on Code

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.943684Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.943684Z digest=sha256:865d019bf72c9c5f109564f60f6fb2ee54cf5d7264ca38a7c2e9d09be0c4d78d

Observation 11bf096e-82e7-4a34-82db-eeb1e0729128 · outbound

This paper cites Chatunitest: A framework for llm-based test generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Chatunitest: A framework for llm-based test generation

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.847564Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.950223Z digest=sha256:4a79cfa0f1b928a2b4fb70af8dcb17f326c4a785c92063447c480184634833b3

Observation 0c3a9b8a-0fdf-49f5-ab12-dc7e5a6c356a · outbound

This paper cites The Llama 3 Herd of Models.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification The Llama 3 Herd of Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.955275Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.955275Z digest=sha256:232ad038b5fa8a19b12ac3eaf573abdc44da779590392f6c919745f15e8ea076

Observation f00f1729-beac-4e59-aa60-f4ca89391bea · outbound

This paper cites J., Solar-Lezama, A., Synnaeve, G., and Wang, S.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification J., Solar-Lezama, A., Synnaeve, G., and Wang, S

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.829220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.961583Z digest=sha256:d413939add93f6e3b1193b07c497150508a926d97bf3cec5554a56a85e792ba0

Observation 5a0071db-f569-4db8-a768-54b587d05402 · outbound

This paper cites RULER: What's the Real Context Size of Your Long-Context Language Models?.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification RULER: What's the Real Context Size of Your Long-Context Language Models?

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.967351Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.967351Z digest=sha256:b4ac24e6b5e36d7b4eb9877d85447ae5732ca164db40c5d5e3261d2c517b4c97

Observation 76019898-5ee3-4a2f-aef5-5a40cd48e651 · outbound

This paper cites Qwen2.5-Coder Technical Report.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Qwen2.5-Coder Technical Report

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.973919Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.973919Z digest=sha256:27b22706aa1d08a65a87c7d00257b7b4dcfdc02b1d2278ecc7c5a5773bcd4037

Observation 8a0d8b4d-4b60-4060-812c-68bf083baa74 · outbound

This paper cites TestGenEval: A Real World Unit Test Generation and Test Completion Benchmark.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification TestGenEval: A Real World Unit Test Generation and Test Completion Benchmark

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.979207Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.979207Z digest=sha256:f7894bfd35b0a14b324d654aa5ed7ee4c2cd8ad9a776200d3d9f3c3c50d7c62a

Observation 39280e94-d9e8-4317-8c25-95325e37cd88 · outbound

This paper cites R2e: Turning any github repository into a programming agent environment.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification R2e: Turning any github repository into a programming agent environment

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.812790Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.983973Z digest=sha256:046c73bf0b1cef4f1e495911ddd7ea35b371e13343a988dec7f23088c874048f

Observation 3c52b8d0-6faf-4328-8305-9786ea340128 · outbound

This paper cites Mistral 7B.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Mistral 7B

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.989171Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.989171Z digest=sha256:69fd769482aa7b8af8bf8ff309b88f50d6d5a4cfb15471afa1e0555d751ead38

Observation dab75f0b-a11f-4a61-bcd0-f85002560361 · outbound

This paper cites E., Yang, J., Wettig, A., Yao, S., Pei, K., Press, O., and Narasimhan, K.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification E., Yang, J., Wettig, A., Yao, S., Pei, K., Press, O., and Narasimhan, K

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.993554Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.993554Z digest=sha256:9c06ab14a4dfb53239a1eb989da65a4481ccb08eedcedf7cb1b13084125bc8f6

Observation 353b2418-6069-463d-94b7-ad2b24a93276 · outbound

This paper cites H., Gonzalez, J.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification H., Gonzalez, J

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.997783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.997783Z digest=sha256:6165e1590cf208d7a20e3e6a565bb28415dd714b1367d6c530917f3cb9931d6f

Observation 70e2a6cb-7983-4afc-848a-dce358d2c171 · outbound

This paper cites DS-1000: A Natural and Reliable Benchmark for Data Science Code Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification DS-1000: A Natural and Reliable Benchmark for Data Science Code Generation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.002175Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.002175Z digest=sha256:8d5bb644d607357adf9894c069ecff9a156966a7087d7ecccde23335116c7f36

Observation afbbbc1c-2504-4bd4-a9d0-115285ec925d · outbound

This paper cites Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case Study.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case Study

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.007060Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.007060Z digest=sha256:b155a4348d85fc8d4bb07fa97c6e272a370e2d16d6971d9e3585ee607cccd958

Observation 88ed5d32-ead0-458c-bc06-0a49df667072 · outbound

This paper cites LLM-Powered Test Case Generation for Detecting Bugs in Plausible Programs.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification LLM-Powered Test Case Generation for Detecting Bugs in Plausible Programs

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.011395Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.011395Z digest=sha256:3ccba2db5307575d0b82132aebd17b3409271ea2ed7d045bb28a352aa349facf

Observation 17bfe064-fb3a-4c6e-8e8b-5772ea6976b9 · outbound

This paper cites Repobench: Benchmarking repository-level code auto-completion systems.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Repobench: Benchmarking repository-level code auto-completion systems

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.773987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.015960Z digest=sha256:7bca56121737938f71a68592604f88e4e0e9b0083d52d6380d93769848ceadbd

Observation c14a6623-d78a-41c4-a5c3-1caf8e0dfdfd · outbound

This paper cites StarCoder 2 and The Stack v2: The Next Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification StarCoder 2 and The Stack v2: The Next Generation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.019897Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.019897Z digest=sha256:a12203489d2f44e333a8b4b4abcda0c75ec44db823c41cf213b267179015ef78

Observation 844921b1-14d3-49ed-8aba-144221a67fca · outbound

This paper cites Repoagent: An llm-powered open-source framework for repository-level code documentation generation, 2024.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Repoagent: An llm-powered open-source framework for repository-level code documentation generation, 2024

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.759143Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.024262Z digest=sha256:26e7d2e174eda6d9afbde3155701ae0d65a1bfae9acf8cbc9a008dd5098bad52

Observation bd4afb88-4031-41d6-9c6a-e9013809a955 · outbound

This paper cites Test-Driven Development for Code Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Test-Driven Development for Code Generation

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.028985Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.028985Z digest=sha256:218dbd6aed69a3764b256a3184e119aabab79f270f5f1c125ddef54d56595d67

Observation 33dee1b0-7eec-4ef4-9ec5-702ca5051ece · outbound

This paper cites SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.034044Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.034044Z digest=sha256:1119e90c08bbb8a747896fc6ec5dedd5cd9187e7aff4e7dacb641b726f9dfce5

Observation dbdf3b35-4b00-4e88-85b2-685875201fdb · outbound

This paper cites J., Mooney, R.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification J., Mooney, R

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.742372Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.039523Z digest=sha256:85a9acd8ab6da90b56d5bc8de9ac412beb29ddbc921e62c57fe22a2612ffd342

Observation 882590d2-6cf7-40ca-bafd-c35a0fc441bd · outbound

This paper cites Codegen: An open large language model for code with multi-turn program synthesis.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Codegen: An open large language model for code with multi-turn program synthesis

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.724156Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.044961Z digest=sha256:33c5a54d81e04bca9ac39e9197632fc697a4b622f8c55e80af751d94c9e9bc83

Observation 2855f320-9c19-4666-899b-9579be09bdb7 · outbound

This paper cites Code Llama: Open Foundation Models for Code.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Code Llama: Open Foundation Models for Code

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.050031Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.050031Z digest=sha256:fc989e37667b11c135c0e6c48619999764c15375761a31cc290f5742ccd87f3a

Observation 3afee8b9-c755-4011-a584-e938b40a1248 · outbound

This paper cites K., and Ray, B.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification K., and Ray, B

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.707580Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.054881Z digest=sha256:aee256791e46a3966dd9441ae1ca8935c357da472b33016b6073cec92391acaa

Observation e6370a87-6d6d-4315-8da3-7b759ed4a708 · outbound

This paper cites Chatgpt vs sbst: A comparative assessment of unit test suite generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Chatgpt vs sbst: A comparative assessment of unit test suite generation

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.692563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.059574Z digest=sha256:829b7cc72022c90614ce24826157b17599232450de8556030155b80d0a464b05

Observation 6c7198a6-20a1-4406-87a8-71f4ebb5d688 · outbound

This paper cites CodeGemma: Open Code Models Based on Gemma.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification CodeGemma: Open Code Models Based on Gemma

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.063958Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.063958Z digest=sha256:3c7a0e8ca61e2bdb495c6a31059f47efacede005a8e13cc59511b13c383f9ba2

Observation ebb79ddf-1a70-418f-9f57-6128893ddb9f · outbound

This paper cites Unit Test Case Generation with Transformers and Focal Context.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Unit Test Case Generation with Transformers and Focal Context

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.068366Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.068366Z digest=sha256:cc24f17e64e6da4d86a9f001358f3663448186d715492f1c3656f1cbc51dcd4f

Observation 22702a80-367a-4b74-b60f-c6a8486d71e1 · outbound

This paper cites Software testing with large language models: Survey, landscape, and vision.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Software testing with large language models: Survey, landscape, and vision

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.676989Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.073028Z digest=sha256:ed6437848b40885f85819497627074667460b7dcb963b6f7a2394d3ce6ed73ba

Observation a243c40a-07ad-4554-8a41-896446ed20d4 · outbound

This paper cites TESTEVAL: Benchmarking Large Language Models for Test Case Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification TESTEVAL: Benchmarking Large Language Models for Test Case Generation

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.077466Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.077466Z digest=sha256:0a151d205346a8f16ace2302e43ff6c42703eda41ecdf334299c3a87f399b3c6

Observation fd712e2f-d0d7-419b-aa5f-e44a6811fb86 · outbound

This paper cites OpenHands: An Open Platform for AI Software Developers as Generalist Agents.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification OpenHands: An Open Platform for AI Software Developers as Generalist Agents

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.082368Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.082368Z digest=sha256:9bff32cc9629fb2d5135a317556c00bacef2e1261e0a18d260bd1feee4350ab8

Observation 291a2922-1a84-4014-aa9b-5c207b23db5a · outbound

This paper cites Magicoder: Empowering code generation with OSS -instruct.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Magicoder: Empowering code generation with OSS -instruct

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.659141Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.086937Z digest=sha256:f475577e04295158349a87082fcbc09b0726e287cd926e0d73961b37c6d67567

Observation f5a13ddf-4d83-4ce3-ae3d-4f07f7413dfb · outbound

This paper cites Qwen2.5 Technical Report.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Qwen2.5 Technical Report

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.091037Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.091037Z digest=sha256:bfb4a27c3fe892ace0ecf1a722d713530614a6025521d28b1a1854d561200f96

Observation cb309eb7-bd23-453e-81f5-4cad2b614138 · outbound

This paper cites and Liang, P.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification and Liang, P

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.639126Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.095510Z digest=sha256:7e9cfc22b3b8ffde63e1a22805d66b6cc79dc1f7d841084da6a0998a006a9434

Observation 8ba92b89-6781-4cb0-b05b-f5aedd330860 · outbound

This paper cites and Harman, M.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification and Harman, M

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.621538Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.099608Z digest=sha256:5f59ca0c036ecaf7e0b44a85b904a28222f35e096ed1c135aba012ab65746cd3

Observation 28b3986c-117e-4fb5-abf9-4b6ac14657d1 · outbound

This paper cites Evaluating and improving chatgpt for unit test generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Evaluating and improving chatgpt for unit test generation

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.603549Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.103527Z digest=sha256:8165cf262cbe23b88292562743bebfa9cde40ab68c5fe85609da87f4757fcc24

Observation 8be7cd65-24b6-47a7-ae15-563f1939239d · outbound

This paper cites TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.107547Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.107547Z digest=sha256:2e8c11244313a5659d393d345e869c19f1610eb42399cde070d424e971918d3a

Observation dd257b3b-4bc3-4ffc-a66b-1c549c8f179a · outbound

This paper cites B ench: Extending long context evaluation beyond 100 K tokens.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification B ench: Extending long context evaluation beyond 100 K tokens

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.587274Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.111985Z digest=sha256:63ffcc10ba423583805e370d16eb5a30cb05a8ae226d8878b3e4035c47555a49

Observation 8e74ffd1-4237-4dca-98df-9a1838e9e116 · outbound

This paper cites Y., Vu, M.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Y., Vu, M

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.567859Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.116342Z digest=sha256:8b157cbbbdc35cc06d2c761b8b5d9189e7f7bcf7179f8cea9ef08d766bf2b78e

Observation bb4fa065-3de2-4d8d-a73b-422b961060e2 · outbound

This paper cites @esa (Ref.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification @esa (Ref

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.120518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.120518Z digest=sha256:af2ea064776f5f7df0cc60e14386890ab4ff619784a69ffed8b41e8db8e2e6ec

Observation 980300f9-2a1c-41c7-a2b8-410545e523b8 · outbound

This paper cites an unresolved cited work.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Unresolved cited work

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.125205Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.125205Z digest=sha256:4ae33747d041808a7323c74392aacc879b36f1d97a0fc7d02ea30030139c767a

Observation 829199ae-e796-4229-a703-89a0d9b1c398 · outbound

This paper cites a") == "a.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification a") == "a

Reference 46

Resolution
malformed identifier
raw_fallback, observed 2026-08-07T23:42:26.529291Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.129442Z digest=sha256:48215017db37242c4b1f6f1c19c1517620576cf35479725d69bc36101cff02e2

Pith citing papers

Observation b0f194d3-517d-42d2-b2ed-3996b777a5ec · inbound

Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI cites this paper.

Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification

Reference 209

Resolution
unresolved
no resolver link, observed 2026-08-07T14:15:51.646014Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:15:51.646014Z digest=sha256:c84c29874de733924921ad793d220fd48bdbc973e1f5d28e753674c2955d2892

Observation 49ea228e-2a51-4dcc-b708-6a6263debd60 · inbound

Mutation-Guided Unit Test Generation with a Large Language Model cites this paper.

Mutation-Guided Unit Test Generation with a Large Language Model CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification

Reference 71

Resolution
verified exact
arxiv_id, observed 2026-05-19T11:07:15.213581Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-19T11:05:15.898419Z digest=sha256:7a47cd6c255f2f625e484bec32368694ac7f3bcf6de086c987ade95d5e346693