Pith. sign in

Paper Citation Record · LEDGER

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification

As of 12 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 2 inbound Pith citation observations for arXiv:2502.08806.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.08806 v1

Coverage vector

measured 45 of 45 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T23:42:26.129442Z

measured 47 of 47 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:15:51.646014Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-19T11:07:15.212042Z

Reference resolution

45 of 45 outbound references displayed

  • verified exact0
  • verified fuzzy18
  • unresolved26
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 72508f8d-9e5d-48d8-a654-45ef9a705f8d · outbound

This paper cites write newline.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification write newline

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.911052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.911052Z digest=sha256:b6085ed7abc1ec07df3d369ebaba48b9cb737ef8c77025518b3386ec46275e9a

Observation 59a9ffb5-0749-407a-ad4a-cc560e5de77f · outbound

This paper cites Meet yi-coder: A small but mighty llm for code, September 2024.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Meet yi-coder: A small but mighty llm for code, September 2024

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.884315Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.916747Z digest=sha256:13de512fc0dcb04baa527b47230b6a26d8a403a4b56158d25e29d3f4240ce9ea

Observation 6e2c432d-aec1-443f-b814-def1994e424a · outbound

This paper cites Automated unit test improvement using large language models at meta.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Automated unit test improvement using large language models at meta

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.865696Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.922104Z digest=sha256:667377bed9a40c9b107813b91aef648107dec0d4c0e700fb4e4a1e973b1d1f22

Observation 5ac23173-e0fc-479c-8440-c21d548a7c5c · outbound

This paper cites Program Synthesis with Large Language Models.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Program Synthesis with Large Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.932738Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.932738Z digest=sha256:b7db56d67275453b0bc810e2966b4cf1e13f497a78edd1334167523ce09b4ff9

Observation a1117347-4f56-4fae-a840-11073f52d909 · outbound

This paper cites SUPER: Evaluating Agents on Setting Up and Executing Tasks from Research Repositories.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification SUPER: Evaluating Agents on Setting Up and Executing Tasks from Research Repositories

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.937607Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.937607Z digest=sha256:8fd93e83eb7140d20923e0d08f24d9b62d7ba19fce987fcc51af6ce0d391dbe1

Observation c727c863-dc46-4ced-8d4b-0a7601781bb1 · outbound

This paper cites Evaluating Large Language Models Trained on Code.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Evaluating Large Language Models Trained on Code

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.943684Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.943684Z digest=sha256:a5f860f6ce5748496b06a36fa421c7d087340f3ae15da57c05f22a480b9db60b

Observation 11bf096e-82e7-4a34-82db-eeb1e0729128 · outbound

This paper cites Chatunitest: A framework for llm-based test generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Chatunitest: A framework for llm-based test generation

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.847564Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.950223Z digest=sha256:8cdfc1853ef684c468dcf8f2514f0f149ad68f546150f74349ff183dcc8534bd

Observation 0c3a9b8a-0fdf-49f5-ab12-dc7e5a6c356a · outbound

This paper cites The Llama 3 Herd of Models.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification The Llama 3 Herd of Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.955275Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.955275Z digest=sha256:16ba09200d85a7f7bedb75903321414925ff9370acf16096399d6fc184a0ec97

Observation f00f1729-beac-4e59-aa60-f4ca89391bea · outbound

This paper cites J., Solar-Lezama, A., Synnaeve, G., and Wang, S.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification J., Solar-Lezama, A., Synnaeve, G., and Wang, S

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.829220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.961583Z digest=sha256:d6ccc1516b8e33787fd11ad0b6c70aad9814122192f5c79057775f2fe876c7ed

Observation 5a0071db-f569-4db8-a768-54b587d05402 · outbound

This paper cites RULER: What's the Real Context Size of Your Long-Context Language Models?.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification RULER: What's the Real Context Size of Your Long-Context Language Models?

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.967351Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.967351Z digest=sha256:9065ed797a77e8f6c9fae146031683b9aff242b4f22fc5f124dc476d61a744fd

Observation 76019898-5ee3-4a2f-aef5-5a40cd48e651 · outbound

This paper cites Qwen2.5-Coder Technical Report.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Qwen2.5-Coder Technical Report

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.973919Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.973919Z digest=sha256:0943c1259c167eb49c7818ac9513444d80f0cec9a5c3db0bb861d6a80d81268c

Observation 8a0d8b4d-4b60-4060-812c-68bf083baa74 · outbound

This paper cites TestGenEval: A Real World Unit Test Generation and Test Completion Benchmark.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification TestGenEval: A Real World Unit Test Generation and Test Completion Benchmark

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.979207Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.979207Z digest=sha256:f7429e922536692025d48067bfaa5e701c5e58d6f287a6a7f0f39ba803d2f65d

Observation 39280e94-d9e8-4317-8c25-95325e37cd88 · outbound

This paper cites R2e: Turning any github repository into a programming agent environment.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification R2e: Turning any github repository into a programming agent environment

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.812790Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.983973Z digest=sha256:7f9834f0392caeb743f7ef1623043a73e1781f2dd96571a533aaf2f2f0646590

Observation 3c52b8d0-6faf-4328-8305-9786ea340128 · outbound

This paper cites Mistral 7B.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Mistral 7B

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.989171Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.989171Z digest=sha256:6c658688ce76190cfd3eca9ada801f2dc483b325e4ff8cb050cdca622f0ee032

Observation dab75f0b-a11f-4a61-bcd0-f85002560361 · outbound

This paper cites E., Yang, J., Wettig, A., Yao, S., Pei, K., Press, O., and Narasimhan, K.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification E., Yang, J., Wettig, A., Yao, S., Pei, K., Press, O., and Narasimhan, K

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.993554Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.993554Z digest=sha256:c749c9d106d3d405f717d99233fcef6beb5a6d8f7d5455dced5d0ad9140d8ccb

Observation 353b2418-6069-463d-94b7-ad2b24a93276 · outbound

This paper cites H., Gonzalez, J.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification H., Gonzalez, J

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.997783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.997783Z digest=sha256:0e2b8ea53cc031cfc953d96cf54d29061a726d51bdd7d8f6ede52a2f197e76d1

Observation 70e2a6cb-7983-4afc-848a-dce358d2c171 · outbound

This paper cites DS-1000: A Natural and Reliable Benchmark for Data Science Code Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification DS-1000: A Natural and Reliable Benchmark for Data Science Code Generation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.002175Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.002175Z digest=sha256:5f999866a29426c0412ad6bf974682b256355bf5cb241fd3d8efc6afa996259a

Observation afbbbc1c-2504-4bd4-a9d0-115285ec925d · outbound

This paper cites Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case Study.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case Study

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.007060Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.007060Z digest=sha256:e35f90adc83f055ec8b5cbb62ea511be6302b2024d87441607a2bd425cf4022e

Observation 88ed5d32-ead0-458c-bc06-0a49df667072 · outbound

This paper cites LLM-Powered Test Case Generation for Detecting Bugs in Plausible Programs.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification LLM-Powered Test Case Generation for Detecting Bugs in Plausible Programs

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.011395Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.011395Z digest=sha256:df628f8da4c0836182e1e0d1e5f66199f90e8a2ec806389a4d703b02c9f228c0

Observation 17bfe064-fb3a-4c6e-8e8b-5772ea6976b9 · outbound

This paper cites Repobench: Benchmarking repository-level code auto-completion systems.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Repobench: Benchmarking repository-level code auto-completion systems

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.773987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.015960Z digest=sha256:6678150e5fba1dca67a6ec94cc094d3fd9de9ef521d11b6d32c7216a44a44700

Observation c14a6623-d78a-41c4-a5c3-1caf8e0dfdfd · outbound

This paper cites StarCoder 2 and The Stack v2: The Next Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification StarCoder 2 and The Stack v2: The Next Generation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.019897Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.019897Z digest=sha256:3c124a33dd354badf19680c38b88fd773ed0212b0427819d23ce264ad6bed95b

Observation 844921b1-14d3-49ed-8aba-144221a67fca · outbound

This paper cites Repoagent: An llm-powered open-source framework for repository-level code documentation generation, 2024.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Repoagent: An llm-powered open-source framework for repository-level code documentation generation, 2024

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.759143Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.024262Z digest=sha256:5b46ad44b7ea7554dd91335ee1cb098c4a14c75a2dcf672895a9eb7d38f1ff1d

Observation bd4afb88-4031-41d6-9c6a-e9013809a955 · outbound

This paper cites Test-Driven Development for Code Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Test-Driven Development for Code Generation

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.028985Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.028985Z digest=sha256:21da5b7c8ae39235b1700b663d827e904990a5327f37d4aa52ce443d5f12565f

Observation 33dee1b0-7eec-4ef4-9ec5-702ca5051ece · outbound

This paper cites SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.034044Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.034044Z digest=sha256:7d367830f5afc7aff8ed097fc2b20ffaec086e64eafec24690bbec8bd51c7e93

Observation dbdf3b35-4b00-4e88-85b2-685875201fdb · outbound

This paper cites J., Mooney, R.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification J., Mooney, R

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.742372Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.039523Z digest=sha256:a3a9420dd4d2ccc67f9e9f85330058846448ece35b72c2d06052d12a9a5aa875

Observation 882590d2-6cf7-40ca-bafd-c35a0fc441bd · outbound

This paper cites Codegen: An open large language model for code with multi-turn program synthesis.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Codegen: An open large language model for code with multi-turn program synthesis

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.724156Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.044961Z digest=sha256:37d5d7b1a563a859969f22895f153cc81ff6c749ce6740a5f88b6ff71975b2eb

Observation 2855f320-9c19-4666-899b-9579be09bdb7 · outbound

This paper cites Code Llama: Open Foundation Models for Code.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Code Llama: Open Foundation Models for Code

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.050031Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.050031Z digest=sha256:454f840044fb406a470915fcddb1d235d5b14e86cbc79570907fb5bc32140447

Observation 3afee8b9-c755-4011-a584-e938b40a1248 · outbound

This paper cites K., and Ray, B.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification K., and Ray, B

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.707580Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.054881Z digest=sha256:a00ba3f0fa134704ede0917f297bc3be92913e8ed89783bff8b775bcc86a82cd

Observation e6370a87-6d6d-4315-8da3-7b759ed4a708 · outbound

This paper cites Chatgpt vs sbst: A comparative assessment of unit test suite generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Chatgpt vs sbst: A comparative assessment of unit test suite generation

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.692563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.059574Z digest=sha256:18d8c30177ef030e2b796103fcc264b7e654e027f42da80d4f9473d8287280ff

Observation 6c7198a6-20a1-4406-87a8-71f4ebb5d688 · outbound

This paper cites CodeGemma: Open Code Models Based on Gemma.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification CodeGemma: Open Code Models Based on Gemma

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.063958Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.063958Z digest=sha256:37197c677a252fa7ef61883e8d9c7c088cc229f540862489945879e3df49e2c3

Observation ebb79ddf-1a70-418f-9f57-6128893ddb9f · outbound

This paper cites Unit Test Case Generation with Transformers and Focal Context.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Unit Test Case Generation with Transformers and Focal Context

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.068366Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.068366Z digest=sha256:b1f1ae0e987dca2d92e9b3ca81e3543d045335bd1aa3dab203c8839ae70dfc3d

Observation 22702a80-367a-4b74-b60f-c6a8486d71e1 · outbound

This paper cites Software testing with large language models: Survey, landscape, and vision.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Software testing with large language models: Survey, landscape, and vision

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.676989Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.073028Z digest=sha256:9f68091e0d94f225399f1d73f3c2d2eba4cef88328d4db7e3af46f6347a8f8b0

Observation a243c40a-07ad-4554-8a41-896446ed20d4 · outbound

This paper cites TESTEVAL: Benchmarking Large Language Models for Test Case Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification TESTEVAL: Benchmarking Large Language Models for Test Case Generation

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.077466Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.077466Z digest=sha256:8df70f7b8d04c6ee7a8613e3feacbb19e7f178fd9f57a5ab259ede9ea4ee23f9

Observation fd712e2f-d0d7-419b-aa5f-e44a6811fb86 · outbound

This paper cites OpenHands: An Open Platform for AI Software Developers as Generalist Agents.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification OpenHands: An Open Platform for AI Software Developers as Generalist Agents

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.082368Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.082368Z digest=sha256:1b748af23f34cf3ca0fe5d70739a2f2ff79da10dfd0feb0701bf10e4f9ae8049

Observation 291a2922-1a84-4014-aa9b-5c207b23db5a · outbound

This paper cites Magicoder: Empowering code generation with OSS -instruct.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Magicoder: Empowering code generation with OSS -instruct

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.659141Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.086937Z digest=sha256:fbbc52535641d2041901d5270d5db7feb622f57ad269f83603ef35ce55b9f8f9

Observation f5a13ddf-4d83-4ce3-ae3d-4f07f7413dfb · outbound

This paper cites Qwen2.5 Technical Report.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Qwen2.5 Technical Report

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.091037Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.091037Z digest=sha256:345ecdc56d7095086b6f6772b04ac602b673c7a12bbebc47dd62f95a5ec17521

Observation cb309eb7-bd23-453e-81f5-4cad2b614138 · outbound

This paper cites and Liang, P.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification and Liang, P

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.639126Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.095510Z digest=sha256:a8dc0586daf7a56ffa47ce161b09395d34d61467886543209b1138edfefb57ab

Observation 8ba92b89-6781-4cb0-b05b-f5aedd330860 · outbound

This paper cites and Harman, M.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification and Harman, M

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.621538Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.099608Z digest=sha256:5ec7124009c304d8f0f6a220ddf9be3126a3667590e1497993616070a95f729d

Observation 28b3986c-117e-4fb5-abf9-4b6ac14657d1 · outbound

This paper cites Evaluating and improving chatgpt for unit test generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Evaluating and improving chatgpt for unit test generation

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.603549Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.103527Z digest=sha256:30da3b4acac35c2c3ecc21fbab9c2d3fcb0bd7b67c5c39e57559041ce7085433

Observation 8be7cd65-24b6-47a7-ae15-563f1939239d · outbound

This paper cites TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.107547Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.107547Z digest=sha256:c99339acca328ff58dca0b3cffaaf14df2431df57ad1e783fece442680919ec5

Observation dd257b3b-4bc3-4ffc-a66b-1c549c8f179a · outbound

This paper cites B ench: Extending long context evaluation beyond 100 K tokens.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification B ench: Extending long context evaluation beyond 100 K tokens

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.587274Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.111985Z digest=sha256:633b034432d690b7bde0435827c263acf397498b0c17a5f9a63faef163ce37dc

Observation 8e74ffd1-4237-4dca-98df-9a1838e9e116 · outbound

This paper cites Y., Vu, M.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Y., Vu, M

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.567859Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.116342Z digest=sha256:3e395a2fc2e7a657d163358daf8bfb800dea257f38d071e7bf97293da1ae7357

Observation bb4fa065-3de2-4d8d-a73b-422b961060e2 · outbound

This paper cites @esa (Ref.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification @esa (Ref

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.120518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.120518Z digest=sha256:62f0b9b278b60943b6366d0a1227b822d6027390f64d8f344de3bb3d289c3773

Observation 980300f9-2a1c-41c7-a2b8-410545e523b8 · outbound

This paper cites an unresolved cited work.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Unresolved cited work

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.125205Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.125205Z digest=sha256:1a6ae357fab0e6e3f7676603d1478c4f64483439314746a2260d371ec7442061

Observation 829199ae-e796-4229-a703-89a0d9b1c398 · outbound

This paper cites a") == "a.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification a") == "a

Reference 46

Resolution
malformed identifier
raw_fallback, observed 2026-08-07T23:42:26.529291Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.129442Z digest=sha256:ebea8f2cbac4b6a1065b286ffb87484cbcf93aef5708d706afc72d4d4422f6a5

Pith citing papers

Observation b0f194d3-517d-42d2-b2ed-3996b777a5ec · inbound

Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI cites this paper.

Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification

Reference 209

Resolution
unresolved
no resolver link, observed 2026-08-07T14:15:51.646014Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:15:51.646014Z digest=sha256:7e9ee0a36c79531dd3e0a113acfa367fe8975c4d5938b832625c40b4c7a0218f

Observation 49ea228e-2a51-4dcc-b708-6a6263debd60 · inbound

Mutation-Guided Unit Test Generation with a Large Language Model cites this paper.

Mutation-Guided Unit Test Generation with a Large Language Model CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification

Reference 71

Resolution
verified exact
arxiv_id, observed 2026-05-19T11:07:15.213581Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-19T11:05:15.898419Z digest=sha256:15e2bf975fb74a024b2825753cf3c94cd8cabe43711a65fd55a3e53884a75703