{"as_of":"2026-08-17T22:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:40bf2cb5aa26560d882af44c11cdf0ea7bf9535d78eaa57b6ccab9f0bc65e372","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:28:10.282270Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:44:09.176660Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T16:22:39.566099Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18843","snapshot_observed_at":"2026-08-07T05:53:18.419223Z","title":"Improving the readability of automatically generated tests using large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06764","last_updated":"2025-08-22T22:18:34Z","snapshot_observed_at":"2026-08-14T09:01:01.093590Z","submitted_at":"2025-06-07T11:16:13Z","title":"Rethinking Cognitive Complexity for Unit Tests: Toward a Readability-Aware Metric Grounded in Developer Perception","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:18.419223Z"},"links":{"cited_paper":"/paper/2412.18843","citing_paper":"/paper/2506.06764"},"observation_digest":"sha256:ca625179ff2363dece4a2f73f679860b366714db2efff51bf9761202f7edfaf0","observation_id":"9f914983-e735-4ae1-aa7e-76f90e23c740","resolution":{"observed_at":"2026-08-07T05:53:18.419223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18843","snapshot_observed_at":"2026-08-15T19:44:09.176660Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15227","last_updated":"2025-06-18T08:11:10Z","snapshot_observed_at":"2026-08-16T09:14:27.248409Z","submitted_at":"2025-06-18T08:11:10Z","title":"Large Language Models for Unit Testing: A Systematic Literature Review","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T19:44:09.176660Z"},"links":{"cited_paper":"/paper/2412.18843","citing_paper":"/paper/2506.15227"},"observation_digest":"sha256:8d266a587a450800a9ba24b763b762363f181e7f644ef720fa8905ec904a0649","observation_id":"c9fc85ea-01b1-44f8-be04-36b49c8f60a0","resolution":{"observed_at":"2026-08-15T19:44:09.176660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.18843","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18843","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2412.18843 , year=","venue":null,"work_id":"74d32bc1-0de8-4739-8565-69693b94bc10","year":null},"citing_paper":{"arxiv_id":"2605.15248","last_updated":"2026-05-14T12:16:34Z","snapshot_observed_at":"2026-08-09T02:30:05.892906Z","submitted_at":"2026-05-14T12:16:34Z","title":"Probing Privacy Leaks in LLM-based Code Generation via Test Generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-19T16:21:11.506550Z"},"links":{"cited_paper":"/paper/2412.18843","citing_paper":"/paper/2605.15248"},"observation_digest":"sha256:e30f588f6efb17a089f752c4f85e39c81847827a37819151beee58c4e8732a8a","observation_id":"cb882bdc-1b12-49b0-a4e0-edc34c7367f1","resolution":{"observed_at":"2026-05-19T16:22:39.567906Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18843/citation-record","integrity":"/paper/2412.18843/integrity","json":"/paper/2412.18843/citation-record.json","paper":"/paper/2412.18843"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/11758549","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:03:20.376878Z","title":"Search based software engineering,","venue":"Lecture notes in computer science","work_id":"52a64284-6c50-4aa4-afb1-a980d57b9b29","year":2006},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:09.946684Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:aeb4d2af4f7654cc99e4eca04c01f4e642bdd00d84414a52e89c7c3615cfa068","observation_id":"98e40d1c-c452-4f59-884e-01f9ddb841d7","resolution":{"observed_at":"2026-08-11T04:28:10.513435Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:09.953626Z","title":"Evolutionary testing of classes,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:09.953626Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:d95a1c221977a50369c1081771872b3819cb1f7c7c922321c5b5c5f4a0cadf77","observation_id":"c47ccf8e-815f-4dbb-80d0-317ea4a98df8","resolution":{"observed_at":"2026-08-11T04:28:09.953626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:09.958932Z","title":"Evosuite: automatic test suite generation for object-oriented software,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:09.958932Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:110bcae0c0f9aa5bb1dfb93fef6a865d1efee8dd1c5e8e6e01d0d1c9d72fdcd5","observation_id":"15ffffaa-aea8-453d-8a6a-27f87101a51f","resolution":{"observed_at":"2026-08-11T04:28:09.958932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:09.964803Z","title":"Whole test suite generation,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:09.964803Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:6d44df3d0f93d2911a173e7199f9e5a4ed3b9242712174cc443b668fe4456859","observation_id":"38b3a4a2-7d52-4080-907c-7de055054bd1","resolution":{"observed_at":"2026-08-11T04:28:09.964803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:09.976169Z","title":"Automated test case generation as a many-objective optimisation problem with dynamic selection of the targets,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:09.976169Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:713ba6ef26e7ac2f151af3ab2c043f9a5a53139f1ad8458e858101b190ac8ec6","observation_id":"02ecb53d-0877-4dac-a642-6070ea841a57","resolution":{"observed_at":"2026-08-11T04:28:09.976169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:09.982796Z","title":"Pynguin: Automated unit test generation for python,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:09.982796Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:9343877b20d3e4b327c30b4950d9ede8cd5cc2aa722a0505a1dadeabee1fed45","observation_id":"a45b1f50-8219-4421-be57-5feab09c2cfe","resolution":{"observed_at":"2026-08-11T04:28:09.982796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3659.36439","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:12.490908Z","title":"Syntest-javascript: Automated unit-level test case generation for javascript,","venue":null,"work_id":"cca5cabc-c2e3-4d9b-bd3a-3ac4ba139a94","year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:09.988204Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:5a40583dccc571c7ade398f73495860cc361385d5657b430f9b5371acf4a76c7","observation_id":"7b79793b-4e00-4092-87dc-4926690dad07","resolution":{"observed_at":"2026-08-11T04:28:12.500216Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:09.994019Z","title":"Evomaster: Evolutionary multi-context automated system test generation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:09.994019Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:8a2782a356aa2546586dd3afe855563f1518ad58049d8ba93e1af2b8063e14db","observation_id":"528fc7f4-3e17-4971-8d15-98cfcda5b91d","resolution":{"observed_at":"2026-08-11T04:28:09.994019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.005011Z","title":"Sapienz: multi-objective automated testing for android applications,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.005011Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:b3e0ef089e0ae9a9cd24bcb93589576c4b7261da0af9d6aa3113385dd0f1b80f","observation_id":"9744b00a-27f7-4072-84ef-491e8378cbd9","resolution":{"observed_at":"2026-08-11T04:28:10.005011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.010564Z","title":"Modeling readability to improve unit tests,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.010564Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:ceceae2371152ea8865532692af69191eb803d8c1a6277d372303d97a51fd6bb","observation_id":"8c7de6ee-aa2e-4699-b23e-23f8854c144d","resolution":{"observed_at":"2026-08-11T04:28:10.010564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.015479Z","title":"Generating unit tests with descriptive names or: would you name your children thing1 and thing2?","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.015479Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:7da5d8d24f08dd2944a8223687917a66035918cc7082be6866a31a13e947c6f9","observation_id":"686e96c2-ea73-4758-be92-99800529fd33","resolution":{"observed_at":"2026-08-11T04:28:10.015479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.05617","last_updated":"2021-05-20T23:11:01Z","snapshot_observed_at":"2026-08-16T20:50:56.360501Z","submitted_at":"2020-09-11T18:57:36Z","title":"Unit Test Case Generation with Transformers and Focal Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.05617","snapshot_observed_at":"2026-08-11T04:28:10.020419Z","title":"Unit test case generation with transformers and focal context,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.020419Z"},"links":{"cited_paper":"/paper/2009.05617","citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:a5e3157e2f2f162838fc003300a0d6edd51c47601aa0ee2f95636b9cbcb57388","observation_id":"ba0236a8-17be-48d6-a6df-7620fb7c6d11","resolution":{"observed_at":"2026-08-11T04:28:10.020419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.026325Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.026325Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:6f51b2b83a2a20b5bb5778986696d3f688d399e20808008f34cb60e9dc87d2c6","observation_id":"55580c8f-20eb-46f8-9ac8-b9f829bf8a66","resolution":{"observed_at":"2026-08-11T04:28:10.026325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.031408Z","title":"An empirical evaluation of using large language models for automated unit test generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.031408Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:fcd8719e36b4bf6cfa01d7674cc2cc4b2c892d23a5061a8a9cc5393bca97c685","observation_id":"e53a378f-b443-491d-af10-bf0deb5cf6c5","resolution":{"observed_at":"2026-08-11T04:28:10.031408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.041578Z","title":"Evaluating and improving chatgpt for unit test generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.041578Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:138ce0953f6c38d20ef83f46f08613cc7626fc97f7af5d94e2dcd4d874886368","observation_id":"c768b270-bdcf-4394-acc5-469028278bd6","resolution":{"observed_at":"2026-08-11T04:28:10.041578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.047222Z","title":"Testspark: Intellij idea’s ultimate test generation companion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.047222Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:fc2d4195d8ddf8194466b76d06559dbac5e132b8c59885dee7719c49bcdd5a8a","observation_id":"a1a726f4-ff23-453b-ac77-5cec3288f03c","resolution":{"observed_at":"2026-08-11T04:28:10.047222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.052569Z","title":"Chatgpt vs SBST: A comparative assessment of unit test suite generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.052569Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:5d48a2ee583c5afa59fd74f0b799be5d2e8987a99d6b8b32beecc34fa546fb28","observation_id":"8a644b58-5ec1-41a9-b90e-2c2723685b6e","resolution":{"observed_at":"2026-08-11T04:28:10.052569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00418","last_updated":"2024-03-09T00:59:18Z","snapshot_observed_at":"2026-08-16T15:36:42.887088Z","submitted_at":"2023-04-30T07:28:06Z","title":"Using Large Language Models to Generate JUnit Tests: An Empirical Study","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00418","snapshot_observed_at":"2026-08-11T04:28:10.057748Z","title":"An empirical study of using large language models for unit test generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.057748Z"},"links":{"cited_paper":"/paper/2305.00418","citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:109e44ce91b9b69dac4a1af3b5f37f947ce7533d121f2798f938e92f1ef41052","observation_id":"3dbc879a-01eb-42e3-978f-67d8d82b9836","resolution":{"observed_at":"2026-08-11T04:28:10.057748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04764","last_updated":"2024-05-07T09:08:13Z","snapshot_observed_at":"2026-08-16T15:34:45.655305Z","submitted_at":"2023-05-08T15:12:07Z","title":"ChatUniTest: A Framework for LLM-Based Test Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04764","snapshot_observed_at":"2026-08-11T04:28:10.063276Z","title":"Chatunitest: a chatgpt- based automated unit test generation tool,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.063276Z"},"links":{"cited_paper":"/paper/2305.04764","citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:ca774504add738d42d713a666a5a4f9a14b421ca244e7e8e16cb08173d0a0796","observation_id":"4e3c1fc5-2948-4848-a76b-db2de1ee1c1f","resolution":{"observed_at":"2026-08-11T04:28:10.063276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-66299-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-13T11:03:48.094449Z","title":"Generating effective test suites by combining coverage criteria,","venue":"Lecture notes in computer science","work_id":"46524221-338e-4366-83c5-b0fe6c83babf","year":2017},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.074414Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:59d6249dfd9c09a7af49c73cd4935e3af467e94747e87110a23135a6e46092df","observation_id":"3ac43d2d-c4f9-4195-a0a9-c78225434e6b","resolution":{"observed_at":"2026-08-11T04:28:10.484018Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.079781Z","title":"Automated unit test improvement using large language models at meta,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.079781Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:001c71a5832e0aa178fd5caa0a9d73827c9dcb47aff3faa05594fd3da3949cc6","observation_id":"60a1781e-f4d0-4fde-aec2-75fa5598ef9a","resolution":{"observed_at":"2026-08-11T04:28:10.079781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:13.062523Z","title":"Lost in the middle: How language models use long contexts,","venue":null,"work_id":"7f4ab034-ae82-49c0-8d8d-3a9f9e2b5c5f","year":null},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.084968Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:568dffe09e8e7d9b9f2d216504436b15cf2649390c21c798b7f6501b848e62bf","observation_id":"2844d53b-e78b-41f5-a9ca-966806553d80","resolution":{"observed_at":"2026-08-11T04:28:13.068124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:13.044682Z","title":"A large scale empirical comparison of state-of-the-art search-based test case generators,","venue":null,"work_id":"394621df-33ce-462f-98ef-a668ea5ab976","year":2018},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.096186Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:7d83bf28e493631c3307733a2b85ef27f9a77027eab91b73123045101ee311e6","observation_id":"b364a598-099b-48df-ae0c-1da0003a7c0f","resolution":{"observed_at":"2026-08-11T04:28:13.050383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.102768Z","title":"Search-based software test data generation: a survey,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.102768Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:ab9a2c9dae11879862c0a8fcddce2dac83949d6b94b61907be010b57d4e09988","observation_id":"ac5f69de-ce69-41f2-b29c-ac80b62070c1","resolution":{"observed_at":"2026-08-11T04:28:10.102768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.108207Z","title":"A systematic review of the application and empirical investigation of search-based test case generation,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.108207Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:71676df0ed812cca5665c75f8fa8183b8b73664c8ec004eb8891f86317a90944","observation_id":"9c43c4d6-dd05-4873-aaff-583a737acba6","resolution":{"observed_at":"2026-08-11T04:28:10.108207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.113792Z","title":"Randoop: feedback-directed random testing for java,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.113792Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:e40cc6759e45f34904e13ea7e8c426a7b2c1ef2cfe0fb0a27544bc05ab5454df","observation_id":"a297866d-587e-4fda-bcc5-3edbe02de145","resolution":{"observed_at":"2026-08-11T04:28:10.113792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9156.2023","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:11.640331Z","title":"SBFT tool competition 2023 - java test case generation track,","venue":null,"work_id":"eeb7b481-40d9-4c02-a605-2a05ebf6b45d","year":2023},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.118980Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:d300ec2be5758b9e36696dd1a6f2d062a3a5e758599be5d4894d0af66aec05f7","observation_id":"8c46e16b-e891-4b66-b7c7-ab1762e7e1f8","resolution":{"observed_at":"2026-08-11T04:28:11.650282Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.124031Z","title":"Restful API automated test case generation with evomaster,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.124031Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:aa85076b8077c35daa95dea33ac00a2bd88248aba8e597eb2a3bb2cd471c8670","observation_id":"99830420-028d-46c2-9319-cb033ce77269","resolution":{"observed_at":"2026-08-11T04:28:10.124031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:13.026905Z","title":"An empirical study of automated unit test generation for python,","venue":null,"work_id":"18254c7b-6566-48fe-99bb-5178311c566f","year":null},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.129371Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:ea7f5a76c7991ce8f286c814445ac8e54cc346d32ac94fb911fbb0c6b09447a8","observation_id":"3ef02b17-98a4-4870-ac42-2ed602de8584","resolution":{"observed_at":"2026-08-11T04:28:13.032636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.140899Z","title":"Software testing with large language models: Survey, landscape, and vision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.140899Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:a3de270d27c4536815107b9521b849845221ca544da6df0601daf1370904ac68","observation_id":"7c2912f4-14a7-4ede-bdee-c562851cb601","resolution":{"observed_at":"2026-08-11T04:28:10.140899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.146094Z","title":"A3test: Assertion- augmented automated test case generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.146094Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:4a3d3679d38e6615a304509068d2d09bfe580df7d67933b1b6a738d021948f5f","observation_id":"948ff539-de23-467e-adfd-6051c89efdfc","resolution":{"observed_at":"2026-08-11T04:28:10.146094Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.134651Z","title":"Available: https://doi.org/10.1007/s10664-022-10248-w","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.134651Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:46f89bdcfd028d5e5dad20c9c41e5fe8a6a831ff779c471e41beb6eba995cf6a","observation_id":"0d324b14-2444-4596-96cb-59e21ef6b279","resolution":{"observed_at":"2026-08-11T04:28:10.134651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:13.005919Z","title":"A complexity measure,","venue":null,"work_id":"5a4f3069-9dbc-4c6a-9b3c-6a4a72116dad","year":1976},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.156535Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:7c189964ae5487f920402a4026ae4e766837ab79637eac1699ebb752229ba57e","observation_id":"535e97b6-51bf-41c8-83a8-b25a491be783","resolution":{"observed_at":"2026-08-11T04:28:13.012134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.161837Z","title":"Cognitive complexity: an overview and evaluation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.161837Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:58c279c0cfc3f239965b1fad2b6bde17565f17d10b31b15f846186c783d9f858","observation_id":"915b6e57-1d22-48b7-95d9-d735b059dbcf","resolution":{"observed_at":"2026-08-11T04:28:10.161837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.151190Z","title":"Automatic generation of test cases based on bug reports: a feasibility study with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.151190Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:f804ce6c99fd30a30a94aaf03e6915adccf31436712dab29108c5ca4d801144a","observation_id":"f5fb1487-f627-4a33-af2c-18bf7a32875f","resolution":{"observed_at":"2026-08-11T04:28:10.151190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:12.986413Z","title":"Effective test generation using pre-trained large language models and mutation testing,","venue":null,"work_id":"de2904d9-dffc-4215-be75-31ce3a2f9468","year":null},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.172576Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:35f558d4bf41c69cc3d4d97b84017e2db735bb658bd6117e16df772403fb471b","observation_id":"537257c0-35e1-4f8b-9912-f3fd3b686b3e","resolution":{"observed_at":"2026-08-11T04:28:12.992610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.183498Z","title":"Learning a metric for code readability,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.183498Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:ea78c5ea45965cc7cad02d7bb84e209b3a7ebfdf997dea73f5956e01281dc7c1","observation_id":"a50c079d-6c4c-41d0-9b5a-e3a16991dbbc","resolution":{"observed_at":"2026-08-11T04:28:10.183498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.166991Z","title":"Codamosa: Escaping coverage plateaus in test generation with pre-trained large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.166991Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:e58ee61d695b4c9d6bd7a4d91604e4f913d931c5b7fa542c788adad5e47b8084","observation_id":"058f385a-85b1-44f2-865c-0a175684f659","resolution":{"observed_at":"2026-08-11T04:28:10.166991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:12.954973Z","title":"The effect of modularization and comments on program comprehension,","venue":null,"work_id":"056062a7-f267-4dfa-b90c-3fd901ff9095","year":1981},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.193987Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:395c4bbaefc816fa9912bb1bf6eb64bc5bda66816d72a26020067be71729c711","observation_id":"52663665-f134-41d7-81a2-00e1473a83a0","resolution":{"observed_at":"2026-08-11T04:28:12.960843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.178049Z","title":"Available: https://doi.org/10.1016/j.infsof.2024.107468","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.178049Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:2ca3e05f1fdbe1f8a96f81f954dd81716e6e216f5f6dfc6723d609a047934acb","observation_id":"a4128c3b-21de-42fd-8760-780e70592fa0","resolution":{"observed_at":"2026-08-11T04:28:10.178049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/cseet","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.370246Z","title":"Code readability testing, an empirical study,","venue":null,"work_id":"44d3c905-91d2-4350-a53c-73ebeefb2bda","year":2016},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.204662Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:0295343047b7fae3f62eaf1d50f96a8679678d7b5026d2e511fb1c37bdf91be1","observation_id":"ca927d82-3a71-4938-8c58-d1489418fb62","resolution":{"observed_at":"2026-08-11T04:28:10.378124Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.188813Z","title":"An empirical validation of cognitive complexity as a measure of source code understandability,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.188813Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:39d5a4a17d4841b62d50c46316d98a13227ed6b219f15f62d7296d66fbc455b3","observation_id":"33f1833f-af1b-4c31-8a85-c5f53b851ddc","resolution":{"observed_at":"2026-08-11T04:28:10.188813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.216336Z","title":"Deeptc-enhancer: Improving the readability of automatically generated tests,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.216336Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:7dabda8627d91a9a066e5a048f84227d21083a0864096a4e6b58e2a16d1db973","observation_id":"6d80c625-2ea3-4512-93fe-a77e4e5be06c","resolution":{"observed_at":"2026-08-11T04:28:10.216336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:12.937248Z","title":"Shorter identifier names take longer to comprehend,","venue":null,"work_id":"3518051f-862e-4b60-af31-91adf5ac7c51","year":2019},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.199377Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:55825f1673df0ccfc85993348e03e780db75af436a4776091ee0686b9fc9c76d","observation_id":"5eac0751-4403-43a5-b614-f0c0101c0333","resolution":{"observed_at":"2026-08-11T04:28:12.942925Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.227272Z","title":"Improving the readability of generated tests using GPT-4 and chatgpt code interpreter,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.227272Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:7f9ab1c0b040de34c091e00c797a5a51fddc26e9e78777ed1a7abdfed944c7b3","observation_id":"f9b97525-426d-4d81-a3ca-abec48a5abbd","resolution":{"observed_at":"2026-08-11T04:28:10.227272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.210388Z","title":"The impact of test case summaries on bug fixing performance: an empirical investigation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.210388Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:e288ccdf14f4b5d85252df8c45617b16d55655dec948a1613f370a00ef66f9a0","observation_id":"50bb86af-fe76-498a-87a2-f041f0f4429a","resolution":{"observed_at":"2026-08-11T04:28:10.210388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07927","last_updated":"2025-03-16T06:23:34Z","snapshot_observed_at":"2026-08-16T14:09:52.485275Z","submitted_at":"2024-02-05T19:49:13Z","title":"A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07927","snapshot_observed_at":"2026-08-11T04:28:10.238661Z","title":"A systematic survey of prompt engineering in large language models: Techniques and applications,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.238661Z"},"links":{"cited_paper":"/paper/2402.07927","citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:37dc9144991f981ef3dc10b487e6ee04783dfa43517f3a8167b95990ed19c7fc","observation_id":"2a36dfaa-157c-4f56-a374-9597635d9591","resolution":{"observed_at":"2026-08-11T04:28:10.238661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.32274","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.865021Z","title":"Interevo-tr: Interactive evolutionary test generation with readability assessment,","venue":null,"work_id":"1a68184c-4532-4141-a561-8ae5b8306337","year":2023},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.221768Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:123ebfb354cac9b89a9e259ea87666858733179195c9df315d8b5d86183862f4","observation_id":"8071ce64-d059-47c3-aa36-2f77e6579cd7","resolution":{"observed_at":"2026-08-11T04:28:10.874160Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:12.897879Z","title":"Large language models are zero-shot reasoners,","venue":null,"work_id":"a32a9975-1c1d-49e7-be4e-578775fb62be","year":2022},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.249976Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:a7a390d179275a559129126382bad56817464bdc6839f6a4c2fe38fe81859cf5","observation_id":"7151535b-6088-4da6-b21e-a364775bb57a","resolution":{"observed_at":"2026-08-11T04:28:12.904082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02828","last_updated":"2024-10-17T17:38:59Z","snapshot_observed_at":"2026-08-17T07:12:52.973190Z","submitted_at":"2023-08-05T09:30:33Z","title":"An Empirical Study of the Non-determinism of ChatGPT in Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02828","snapshot_observed_at":"2026-08-11T04:28:10.232745Z","title":"LLM is like a box of chocolates: the non-determinism of chatgpt in code generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.232745Z"},"links":{"cited_paper":"/paper/2308.02828","citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:eaaf6e133983031196246c08232e649c1d6e3f1b8510d4e8799b144b8183f681","observation_id":"3ff8a30a-60a4-4747-87e0-1468c8e951a0","resolution":{"observed_at":"2026-08-11T04:28:10.232745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.265970Z","title":"An empirical validation of oracle improvement,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.265970Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:692b0cc9030c42d132f1abbe99c8f264e5d528a0fa7c7c27512d0182da501cbe","observation_id":"bc516a7b-5719-4296-b1ab-e4bd75a20d4c","resolution":{"observed_at":"2026-08-11T04:28:10.265970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:12.917944Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":"bff0470d-b539-4a11-bf6f-b70e55b030d2","year":2022},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.244315Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:b78c9b9a6dfd0f91192707141672e0723531c57e0e6f4b49463cafa65e17b24a","observation_id":"79106864-6437-4098-b053-a9e6f3e7c549","resolution":{"observed_at":"2026-08-11T04:28:12.923729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.276618Z","title":"Individual comparisons by ranking methods,","venue":null,"work_id":null,"year":1945},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.276618Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:48dd8cff890d4d48b8a62352145db95bde72fc7555fee07c322f17f301bcd344","observation_id":"f037191d-466d-40dd-92bc-7849845794cf","resolution":{"observed_at":"2026-08-11T04:28:10.276618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:12.846307Z","title":"Retrieval-augmented generation for knowledge-intensive NLP tasks,","venue":null,"work_id":"d3ccd3de-4e70-41c6-b286-2c32804d4e95","year":2020},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.282270Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:bf06b7fedb8c9699c201d05e21e95eeff8bb87c892c1efebf6b1e19ef3f08690","observation_id":"11f3cbb1-4077-460c-8017-6c7fa0d514a7","resolution":{"observed_at":"2026-08-11T04:28:12.852257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:12.866509Z","title":"Ghisolotti, 2025","venue":null,"work_id":"12ea3fa4-32e9-4d7d-a718-26e759c4be40","year":2025},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.260667Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:ff975845e6935856343b900d3e4c36992c1e7b14c7bdbe242ae6d6b9b0e4c6ec","observation_id":"f4e16c57-d985-465a-a3a6-3e25e95a97bd","resolution":{"observed_at":"2026-08-11T04:28:12.872627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.271462Z","title":"Gamifying a software testing course with code defenders,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.271462Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:4c78f8bb1eb78717347f3f5e4993ff9ea0b32958005852c69934b3ae73097c22","observation_id":"d5aa5072-b803-4a54-969a-bdc87f30072c","resolution":{"observed_at":"2026-08-11T04:28:10.271462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.255516Z","title":"Available: http://papers.nips.cc/paper files/paper/2022/ hash/8bb0d291acd4acf06ef112099c16f326-Abstract-Conference.html","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.255516Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:a1426f66744e95e544ec542b4b9bcedce52daaf7ef9e7fcf157c225bcd7dda30","observation_id":"ef86ff02-aca0-4fbd-bdbc-a1129bac384c","resolution":{"observed_at":"2026-08-11T04:28:10.255516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04764","last_updated":"2024-05-07T09:08:13Z","snapshot_observed_at":"2026-08-16T15:34:45.655305Z","submitted_at":"2023-05-08T15:12:07Z","title":"ChatUniTest: A Framework for LLM-Based Test Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04764","snapshot_observed_at":"2026-08-11T04:28:10.068560Z","title":"Available: https://doi.org/10.48550/arXiv.2305.04764","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.068560Z"},"links":{"cited_paper":"/paper/2305.04764","citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:df3381164a6c55199a9e89fcbe4d13f27507d22e0ba1bdf5c0519924f40627a4","observation_id":"6c462962-676b-47d2-87ba-a04a71734024","resolution":{"observed_at":"2026-08-11T04:28:10.068560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:28:10.090217Z","title":"Available: https://doi.org/10.1162/tacl a 00638","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T04:28:10.090217Z"},"links":{"citing_paper":"/paper/2412.18843"},"observation_digest":"sha256:c8ae6cf3cd95c9811b035892552d17bf0beaab86e12e4ae609b8d6a53e88b008","observation_id":"4bb55039-ef36-4748-ad00-48501d6477de","resolution":{"observed_at":"2026-08-11T04:28:10.090217Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.18843","last_updated":"2024-12-25T09:08:53Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-11T04:23:03.994376Z","submitted_at":"2024-12-25T09:08:53Z","title":"Improving the Readability of Automatically Generated Tests using Large Language Models"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":4,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":40,"verified_exact":3,"verified_fuzzy":10},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 3 inbound Pith citation observations for arXiv:2412.18843."}