Pith. sign in

Paper Citation Record · LEDGER

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification

As of 19 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 2 inbound Pith citation observations for arXiv:2502.08806.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.08806 v1

Coverage vector

measured 45 of 45 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T23:42:26.129442Z

measured 47 of 47 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:15:51.646014Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-19T11:07:15.212042Z

Reference resolution

45 of 45 outbound references displayed

  • verified exact0
  • verified fuzzy18
  • unresolved26
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 72508f8d-9e5d-48d8-a654-45ef9a705f8d · outbound

This paper cites write newline.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification write newline

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.911052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.911052Z digest=sha256:67de262d0a9e845ee4a3809fc74ee317f119109a312b57f4cf53aa21f9a18d87

Observation 59a9ffb5-0749-407a-ad4a-cc560e5de77f · outbound

This paper cites Meet yi-coder: A small but mighty llm for code, September 2024.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Meet yi-coder: A small but mighty llm for code, September 2024

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.884315Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.916747Z digest=sha256:074263337851334849d204fe932f1b982d8b27e34f420cfce2bba2ea21e11a67

Observation 6e2c432d-aec1-443f-b814-def1994e424a · outbound

This paper cites Automated unit test improvement using large language models at meta.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Automated unit test improvement using large language models at meta

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.865696Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.922104Z digest=sha256:a1b17c42b8b029c84e0e56f4279e788add4175d6dee966932aeb298a917073e4

Observation 5ac23173-e0fc-479c-8440-c21d548a7c5c · outbound

This paper cites Program Synthesis with Large Language Models.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Program Synthesis with Large Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.932738Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.932738Z digest=sha256:b7fea2ab9d1bb7b7a3433668c33ffddac1dd93b2a30701043af56d7c7a146402

Observation a1117347-4f56-4fae-a840-11073f52d909 · outbound

This paper cites SUPER: Evaluating Agents on Setting Up and Executing Tasks from Research Repositories.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification SUPER: Evaluating Agents on Setting Up and Executing Tasks from Research Repositories

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.937607Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.937607Z digest=sha256:5da5063bde84174d881cab0c566d3eb60ae3cc932ddc78c515a7a459ec7c8cb7

Observation c727c863-dc46-4ced-8d4b-0a7601781bb1 · outbound

This paper cites Evaluating Large Language Models Trained on Code.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Evaluating Large Language Models Trained on Code

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.943684Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.943684Z digest=sha256:1b050b36be8d7483d27e77f6e597c4186aa058a62ae731a3be45b374b35437a7

Observation 11bf096e-82e7-4a34-82db-eeb1e0729128 · outbound

This paper cites Chatunitest: A framework for llm-based test generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Chatunitest: A framework for llm-based test generation

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.847564Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.950223Z digest=sha256:429c1a43f88e62f197cbca2653536f080b5ba236555f64a9a17e80a737dbaf4d

Observation 0c3a9b8a-0fdf-49f5-ab12-dc7e5a6c356a · outbound

This paper cites The Llama 3 Herd of Models.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification The Llama 3 Herd of Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.955275Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.955275Z digest=sha256:a5689998dc5fd396fac0622363fbc0162b927cfab22f0dd52ae2ec2c38ce0a18

Observation f00f1729-beac-4e59-aa60-f4ca89391bea · outbound

This paper cites J., Solar-Lezama, A., Synnaeve, G., and Wang, S.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification J., Solar-Lezama, A., Synnaeve, G., and Wang, S

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.829220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.961583Z digest=sha256:1322b1265e64a0b3e663af5a842b7af966f17e5f57fb93a5d239c48ed71f6e25

Observation 5a0071db-f569-4db8-a768-54b587d05402 · outbound

This paper cites RULER: What's the Real Context Size of Your Long-Context Language Models?.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification RULER: What's the Real Context Size of Your Long-Context Language Models?

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.967351Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.967351Z digest=sha256:ef87e5bbaf9ab92e1e2ae5d4e180d5ea5a322428d46519e9826c83d128db80ea

Observation 76019898-5ee3-4a2f-aef5-5a40cd48e651 · outbound

This paper cites Qwen2.5-Coder Technical Report.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Qwen2.5-Coder Technical Report

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.973919Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.973919Z digest=sha256:1535e0b5d007bba3a781e272c066646963bc073a12d4acd0ac8a59176e842845

Observation 8a0d8b4d-4b60-4060-812c-68bf083baa74 · outbound

This paper cites TestGenEval: A Real World Unit Test Generation and Test Completion Benchmark.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification TestGenEval: A Real World Unit Test Generation and Test Completion Benchmark

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.979207Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.979207Z digest=sha256:e8d60dfb993febd4633d23eefcc661e79654260f75271421d89dc7e88a1171b3

Observation 39280e94-d9e8-4317-8c25-95325e37cd88 · outbound

This paper cites R2e: Turning any github repository into a programming agent environment.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification R2e: Turning any github repository into a programming agent environment

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.812790Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:25.983973Z digest=sha256:6dce801973dddc7400e89e166a6d15c63c30ef92b4c58efc38b37999f8cfb872

Observation 3c52b8d0-6faf-4328-8305-9786ea340128 · outbound

This paper cites Mistral 7B.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Mistral 7B

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.989171Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.989171Z digest=sha256:4510f134a8f8bda0c5952f987597b1d7b18dd447aa2ee1ad4ea110be0e17e7f8

Observation dab75f0b-a11f-4a61-bcd0-f85002560361 · outbound

This paper cites E., Yang, J., Wettig, A., Yao, S., Pei, K., Press, O., and Narasimhan, K.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification E., Yang, J., Wettig, A., Yao, S., Pei, K., Press, O., and Narasimhan, K

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.993554Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.993554Z digest=sha256:685e6bc679ef3900567f12bae59f09bac4c7bc315dcabc1b07871e270b5ecb49

Observation 353b2418-6069-463d-94b7-ad2b24a93276 · outbound

This paper cites H., Gonzalez, J.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification H., Gonzalez, J

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:25.997783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:25.997783Z digest=sha256:ba748cfa36c4dfa9da4b49565c64064d37ba64e47fac93db64a339b6519304c7

Observation 70e2a6cb-7983-4afc-848a-dce358d2c171 · outbound

This paper cites DS-1000: A Natural and Reliable Benchmark for Data Science Code Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification DS-1000: A Natural and Reliable Benchmark for Data Science Code Generation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.002175Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.002175Z digest=sha256:aab1de061fe95e52153e2e89c1de81f2de6c03c8a688f3c7be771ad1e9f50f9a

Observation afbbbc1c-2504-4bd4-a9d0-115285ec925d · outbound

This paper cites Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case Study.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case Study

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.007060Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.007060Z digest=sha256:15604fecf218334904d920629d2ef985552d818acb5531d1352b2d338035422f

Observation 88ed5d32-ead0-458c-bc06-0a49df667072 · outbound

This paper cites LLM-Powered Test Case Generation for Detecting Bugs in Plausible Programs.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification LLM-Powered Test Case Generation for Detecting Bugs in Plausible Programs

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.011395Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.011395Z digest=sha256:315d11acdcdbff41aa613a6e9c7c937487b34231575beac6ac0d5bf4b55b8523

Observation 17bfe064-fb3a-4c6e-8e8b-5772ea6976b9 · outbound

This paper cites Repobench: Benchmarking repository-level code auto-completion systems.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Repobench: Benchmarking repository-level code auto-completion systems

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.773987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.015960Z digest=sha256:a1e5dcbf2179505e3e25e26c0f67e625029bdc22926d0b35af7a519384a13c7c

Observation c14a6623-d78a-41c4-a5c3-1caf8e0dfdfd · outbound

This paper cites StarCoder 2 and The Stack v2: The Next Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification StarCoder 2 and The Stack v2: The Next Generation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.019897Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.019897Z digest=sha256:5491019eb49881e52544907a19cd79e6fe4d2dd8fa28b503ddcce3141ef1faa9

Observation 844921b1-14d3-49ed-8aba-144221a67fca · outbound

This paper cites Repoagent: An llm-powered open-source framework for repository-level code documentation generation, 2024.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Repoagent: An llm-powered open-source framework for repository-level code documentation generation, 2024

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.759143Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.024262Z digest=sha256:cfebae03d583b8273e85a836c2541cf564f2fe7a9b1dc3c29c5773f9af97103c

Observation bd4afb88-4031-41d6-9c6a-e9013809a955 · outbound

This paper cites Test-Driven Development for Code Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Test-Driven Development for Code Generation

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.028985Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.028985Z digest=sha256:0c8f420c0cbcc55e8a300602341f20545bc267d45773725aa54b8e6dffb57b3f

Observation 33dee1b0-7eec-4ef4-9ec5-702ca5051ece · outbound

This paper cites SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.034044Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.034044Z digest=sha256:4538b7970abc37fd11f0a663417e1638cdac9402ff9c4bacef4c737e14912748

Observation dbdf3b35-4b00-4e88-85b2-685875201fdb · outbound

This paper cites J., Mooney, R.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification J., Mooney, R

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.742372Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.039523Z digest=sha256:d364022520c2ee2aa6c3e95a43bd1529e0517efac6323ebfaf4c298a14f01982

Observation 882590d2-6cf7-40ca-bafd-c35a0fc441bd · outbound

This paper cites Codegen: An open large language model for code with multi-turn program synthesis.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Codegen: An open large language model for code with multi-turn program synthesis

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.724156Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.044961Z digest=sha256:e20fc8ea7ecf76ef7062780e334460d5cb78cdbff9b7dc12d14b8dd1fe9ddd81

Observation 2855f320-9c19-4666-899b-9579be09bdb7 · outbound

This paper cites Code Llama: Open Foundation Models for Code.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Code Llama: Open Foundation Models for Code

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.050031Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.050031Z digest=sha256:fb7b975f13f9e1964a7a66dfffcb0a3f06349ac002bcc675ed6aafa4ed46853b

Observation 3afee8b9-c755-4011-a584-e938b40a1248 · outbound

This paper cites K., and Ray, B.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification K., and Ray, B

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.707580Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.054881Z digest=sha256:438c0595c44f62dd02c463c190776ce36cbdbbb74b2c5642a5c85da1fb701763

Observation e6370a87-6d6d-4315-8da3-7b759ed4a708 · outbound

This paper cites Chatgpt vs sbst: A comparative assessment of unit test suite generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Chatgpt vs sbst: A comparative assessment of unit test suite generation

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.692563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.059574Z digest=sha256:1f543c92a331c86f978e1731b17a24a4cde403c08f111f6cfd7c1dac50872466

Observation 6c7198a6-20a1-4406-87a8-71f4ebb5d688 · outbound

This paper cites CodeGemma: Open Code Models Based on Gemma.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification CodeGemma: Open Code Models Based on Gemma

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.063958Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.063958Z digest=sha256:41513fb12bb28ced9e1a108b7eef8c3852f8f1714b6ad033341861f433109905

Observation ebb79ddf-1a70-418f-9f57-6128893ddb9f · outbound

This paper cites Unit Test Case Generation with Transformers and Focal Context.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Unit Test Case Generation with Transformers and Focal Context

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.068366Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.068366Z digest=sha256:12b9c714058e60ac82e4f7829f28178915b7866a42a34972045adef0c181afc0

Observation 22702a80-367a-4b74-b60f-c6a8486d71e1 · outbound

This paper cites Software testing with large language models: Survey, landscape, and vision.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Software testing with large language models: Survey, landscape, and vision

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.676989Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.073028Z digest=sha256:08bc1a369870a48abc34188630bd9c9e665edaaeccf1cbe0ea7b371cdd41b58f

Observation a243c40a-07ad-4554-8a41-896446ed20d4 · outbound

This paper cites TESTEVAL: Benchmarking Large Language Models for Test Case Generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification TESTEVAL: Benchmarking Large Language Models for Test Case Generation

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.077466Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.077466Z digest=sha256:247e1d9419c279ac80a2c5ecf84193b5dc6e3801f34139d2370469e1658f7afd

Observation fd712e2f-d0d7-419b-aa5f-e44a6811fb86 · outbound

This paper cites OpenHands: An Open Platform for AI Software Developers as Generalist Agents.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification OpenHands: An Open Platform for AI Software Developers as Generalist Agents

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.082368Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.082368Z digest=sha256:037d8a8eb21a229a48ca8aefd6b2637b6c02ef862a2c541c925c32a1a21353a2

Observation 291a2922-1a84-4014-aa9b-5c207b23db5a · outbound

This paper cites Magicoder: Empowering code generation with OSS -instruct.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Magicoder: Empowering code generation with OSS -instruct

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.659141Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.086937Z digest=sha256:94cfef157c9e3d0c1f5a71712f74b15e6c763d0d53a4daa3f57b92d6505177fc

Observation f5a13ddf-4d83-4ce3-ae3d-4f07f7413dfb · outbound

This paper cites Qwen2.5 Technical Report.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Qwen2.5 Technical Report

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.091037Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.091037Z digest=sha256:c87ca5cb5f89e249c9bfc61d73ec125aaba456f65435e6f167f68dfe96670ddd

Observation cb309eb7-bd23-453e-81f5-4cad2b614138 · outbound

This paper cites and Liang, P.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification and Liang, P

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.639126Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.095510Z digest=sha256:2d39dc271feef657db394158f6882d9ce2d1db808cf0e7d0db13093a86c4b655

Observation 8ba92b89-6781-4cb0-b05b-f5aedd330860 · outbound

This paper cites and Harman, M.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification and Harman, M

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.621538Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.099608Z digest=sha256:2ebf0e1d189119c4ef5496b5160d949795f23a09c1d01f3ca7753675041d77a6

Observation 28b3986c-117e-4fb5-abf9-4b6ac14657d1 · outbound

This paper cites Evaluating and improving chatgpt for unit test generation.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Evaluating and improving chatgpt for unit test generation

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.603549Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.103527Z digest=sha256:56b6985b4095c1a2020d5fd419c9f3b555af6fcc3db54ec76a3b38af5d90b088

Observation 8be7cd65-24b6-47a7-ae15-563f1939239d · outbound

This paper cites TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.107547Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.107547Z digest=sha256:b167c6aab1e49b1f13dfdeb93a10cdeefcc938264816122e9629776318a67058

Observation dd257b3b-4bc3-4ffc-a66b-1c549c8f179a · outbound

This paper cites B ench: Extending long context evaluation beyond 100 K tokens.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification B ench: Extending long context evaluation beyond 100 K tokens

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.587274Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.111985Z digest=sha256:04ab913be7cc751025d0a2183814f40f90a22e4da5e9aa339d5c0ac46e1a1db6

Observation 8e74ffd1-4237-4dca-98df-9a1838e9e116 · outbound

This paper cites Y., Vu, M.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Y., Vu, M

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:42:26.567859Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.116342Z digest=sha256:0a6f4102bf4aa8a5456b484102e92a37280487e49615304626456b312f8b4db4

Observation bb4fa065-3de2-4d8d-a73b-422b961060e2 · outbound

This paper cites @esa (Ref.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification @esa (Ref

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.120518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.120518Z digest=sha256:44c0a89a844768f5d9bb5c26de3666eb8a0e4bf3d8128eb7806be6d77238af82

Observation 980300f9-2a1c-41c7-a2b8-410545e523b8 · outbound

This paper cites an unresolved cited work.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification Unresolved cited work

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T23:42:26.125205Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:42:26.125205Z digest=sha256:a31d11a9bf6edba9feb2f57b79243b90fa08bc2c8421e71c69b223b1ff49454e

Observation 829199ae-e796-4229-a703-89a0d9b1c398 · outbound

This paper cites a") == "a.

CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification a") == "a

Reference 46

Resolution
malformed identifier
raw_fallback, observed 2026-08-07T23:42:26.529291Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-08-07T23:42:26.129442Z digest=sha256:4574c470153b35d98ac27529081761eea8a9d54ad725dfc014767d8c0aceb49c

Pith citing papers

Observation b0f194d3-517d-42d2-b2ed-3996b777a5ec · inbound

Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI cites this paper.

Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification

Reference 209

Resolution
unresolved
no resolver link, observed 2026-08-07T14:15:51.646014Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:15:51.646014Z digest=sha256:e7d912c1eb648d7e80eb92f623926fde7d483749192d9caf7a3bc9b4ba7410d3

Observation 49ea228e-2a51-4dcc-b708-6a6263debd60 · inbound

Mutation-Guided Unit Test Generation with a Large Language Model cites this paper.

Mutation-Guided Unit Test Generation with a Large Language Model CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification

Reference 71

Resolution
verified exact
arxiv_id, observed 2026-05-19T11:07:15.213581Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-19T11:05:15.898419Z digest=sha256:8565518ccdd7fdec0c142e8cb588ad2a5258313de9122ddf6bdc2aab9fe9dd61