{"as_of":"2026-08-19T12:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0717cc18041e7bdc3e255dd7d152eb71c8fe0ee1fe01e219a2cbf5578600c1b7","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:22:57.229784Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T17:37:51.790000Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T20:46:10.824386Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14297","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quality assessment of pythontestsgeneratedbylargelanguagemodels.arXivpreprint","venue":null,"work_id":"b4dc2e23-74c8-4788-a6e7-e803a13caaaa","year":2025},"citing_paper":{"arxiv_id":"2604.23340","last_updated":"2026-04-25T15:00:14Z","snapshot_observed_at":"2026-08-16T00:38:30.269990Z","submitted_at":"2026-04-25T15:00:14Z","title":"Can LLMs be Effective Code Contributors? A Study on Open-source Projects","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T08:09:33.211692Z"},"links":{"cited_paper":"/paper/2506.14297","citing_paper":"/paper/2604.23340"},"observation_digest":"sha256:45ef2a68af2fe7fc826b50a3c0abc60956a5266347ea677455b7deb44ff8d4b4","observation_id":"039d6874-8fbe-4269-9744-543facd57397","resolution":{"observed_at":"2026-05-11T20:46:10.830944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14297","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quality assessment of pythontestsgeneratedbylargelanguagemodels.arXivpreprint","venue":null,"work_id":"b4dc2e23-74c8-4788-a6e7-e803a13caaaa","year":2025},"citing_paper":{"arxiv_id":"2605.05267","last_updated":"2026-05-06T09:38:31Z","snapshot_observed_at":"2026-08-04T17:41:12.164736Z","submitted_at":"2026-05-06T09:38:31Z","title":"Bridging Generation and Training: A Systematic Review of Quality Issues in LLMs for Code","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T17:37:51.790000Z"},"links":{"cited_paper":"/paper/2506.14297","citing_paper":"/paper/2605.05267"},"observation_digest":"sha256:bba06157c0e75aaac1f4e24483e0958098ba7c2731556fe79a347e7c976f4564","observation_id":"a220b4a9-3197-41ba-95b2-36e94fffb31a","resolution":{"observed_at":"2026-05-11T17:26:04.393629Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.14297/citation-record","integrity":"/paper/2506.14297/integrity","json":"/paper/2506.14297/citation-record.json","paper":"/paper/2506.14297"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.10716","last_updated":"2024-01-19T14:27:44Z","snapshot_observed_at":"2026-08-19T08:49:21.137931Z","submitted_at":"2024-01-19T14:27:44Z","title":"Structured Code Representations Enable Data-Efficient Adaptation of Code Language Models","version":1},"cited_work":{"arxiv_id":"2401.10716","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.10716","snapshot_observed_at":"2026-08-07T00:23:00.472532Z","title":"Structured Code Representations Enable Data-Efficient Adaptation of Code Language Models","venue":"cs.CL","work_id":"0a1d4378-21b7-4ca8-a073-e20423d3a05c","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:52.907011Z"},"links":{"cited_paper":"/paper/2401.10716","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:3077985ca662ea0dabd35343c5286708efd283cd49709c483e0eb46b2f039887","observation_id":"f2ce75d2-4b3d-4acf-8427-82c68f5519f3","resolution":{"observed_at":"2026-08-07T00:23:00.522246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:52.956816Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:52.956816Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:2a94bf5fe0cce432d7771a60482544539135710b60db0bfd4217780b8b58fd32","observation_id":"2baf4883-dc09-4d31-ad66-46f3a5a069e6","resolution":{"observed_at":"2026-08-07T00:22:52.956816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.3561","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.296096Z","title":null,"venue":null,"work_id":"5fd4c35c-8d1b-4c42-b071-79d8b1f24c52","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.166885Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:4555eba5becd6dbb3d28acb029b67a17731b16d36cb451abb77faf16212a7a04","observation_id":"b74754e8-2605-493f-add0-a45212bee263","resolution":{"observed_at":"2026-08-07T00:23:00.320326Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:53.383429Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.383429Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:6a480db4dbb426e1999d8776a5147b56479913bcb870e1eea60bc88958c66cc7","observation_id":"c992e3e7-edcd-42eb-aa68-d3d4ea0763e0","resolution":{"observed_at":"2026-08-07T00:22:53.383429Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11528-023-00896-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"TechTrends","work_id":"43949605-c4e8-469e-b821-e1d599a8a166","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.465341Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:75522efae9ba38d37232e373a932cfc63a7b14df5b704a823dddb1d50ca8e25c","observation_id":"a591b136-a682-4b39-8399-501e867fa2c6","resolution":{"observed_at":"2026-08-07T00:22:57.527939Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T00:22:53.528702Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.528702Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:7b55d6bb14396a62e287933d2c66acc331671bafd9b07d0251cb45dad1d1b792","observation_id":"3492489c-369f-471f-aa77-e76fca365e09","resolution":{"observed_at":"2026-08-07T00:22:53.528702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:53.620863Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.620863Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:45f2bfc20d1e9e20a4cb8c1ccf881ebcc4678ad4773423faa996e022d78a987a","observation_id":"7c700471-b715-4be9-932c-072a26a67464","resolution":{"observed_at":"2026-08-07T00:22:53.620863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:53.777526Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.777526Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:252eb735e720093d603a0243d0f1d51be3942461786bffc45f72ccad38466098","observation_id":"f53d4363-7104-4d7a-be28-8c88d3f2c9e3","resolution":{"observed_at":"2026-08-07T00:22:53.777526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.3195","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:59.774096Z","title":null,"venue":null,"work_id":"a305aff4-b44c-4bb4-a760-2355f5cb63a6","year":2023},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.861129Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:198f2d5d4b2f784e5c91c78f7c0fed6373c86288061d629afd861328a4dbb18d","observation_id":"3dbac20d-5c75-4c0f-86c4-021eaf678633","resolution":{"observed_at":"2026-08-07T00:22:59.852913Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4032.36444","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:59.580621Z","title":null,"venue":null,"work_id":"ccd9b396-d4b3-49e6-9f57-5627a9b12bdb","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.926091Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:85432809a5bd830bf78349cbf265069b336803303c88073c3b3a2c16e4411c1b","observation_id":"05025f6e-0f17-4f8f-9cf2-b90afd9365ab","resolution":{"observed_at":"2026-08-07T00:22:59.627204Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.000232Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.000232Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:b835876a4eb8fe4289298efbcf1d21f3b6d8afd3b1ddbf90f45d18e47990d873","observation_id":"f0773172-c8a0-4b84-ab6c-cc268ddd6c2d","resolution":{"observed_at":"2026-08-07T00:22:54.000232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.048447Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.048447Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:24747af61f8fd0434f695e0c3197a906c7e8758859ae120fc3f9079df3bab23d","observation_id":"6f2a4774-4e72-495a-88aa-4d5328114048","resolution":{"observed_at":"2026-08-07T00:22:54.048447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.117566Z","title":"Santos, Andrew Popovich, Mehdi Mirakhorli, and Mei Nagappan","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.117566Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:e20a78b06969ead2330bda63e0bd0231c835823c2789f19d0183183bc64ff193","observation_id":"406b2339-ec23-49fb-ae9d-635d5e903e2f","resolution":{"observed_at":"2026-08-07T00:22:54.117566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:01.513412Z","title":"Graham, R","venue":null,"work_id":"c79667e3-50e4-4ba4-acfb-6492f5ec2073","year":2021},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.188448Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:9e36886b30394c6aaae5b2830f889ff0f98bde103e41ff4fafc9e6a83698c478","observation_id":"652449a9-dd3d-4787-b770-88486c2f2ec8","resolution":{"observed_at":"2026-08-07T00:23:01.553263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:01.491090Z","title":"2023.Code Correctness and Quality in the Era of AI Code Generation: Examining ChatGPT and GitHub Copilot","venue":null,"work_id":"4e0fbac0-7106-457c-b017-894261c83c1c","year":2023},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.285734Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:5f78cc43b3704e2c38319d627ead7199384ba2a5aebc1767e312d9867577476c","observation_id":"4d2b26f3-3ec7-4b32-8016-91961208dc66","resolution":{"observed_at":"2026-08-07T00:23:01.495272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:01.332735Z","title":"Khorikov","venue":null,"work_id":"f0272b62-7d47-46b9-b05c-5a959fd9a01c","year":2020},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.290955Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:54422265b4e3caad069d820df780d82cf061151729051d8334868f4862a73d2f","observation_id":"714c059f-df9c-4ebc-82a6-8e96fafcbce3","resolution":{"observed_at":"2026-08-07T00:23:01.388956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:01.243853Z","title":null,"venue":null,"work_id":"d7e840c0-8436-4ea0-9fcc-46023de369ff","year":2020},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.366203Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:839f2232a038337ee6e294a191456bc49171da3e1c48f4a6a313a6dbb2d72c2e","observation_id":"30ff293e-bddf-4993-aa49-e27b5f4f3b5f","resolution":{"observed_at":"2026-08-07T00:23:01.267075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.510354Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.510354Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:dd1da902ef9e96bf5c6054a467260858f15ae14fc12fcb86db962dd01827454c","observation_id":"733ac602-bcdc-44aa-8cb6-c23bccdb624f","resolution":{"observed_at":"2026-08-07T00:22:54.510354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.593557Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.593557Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:bf07ea7b61c8e1e20682543e540e15f5f84f6ac890c055c9a016315f8b03549c","observation_id":"7b5b833e-b19b-4dc0-a875-998f9e59c5a5","resolution":{"observed_at":"2026-08-07T00:22:54.593557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04664","last_updated":"2021-03-16T08:28:37Z","snapshot_observed_at":"2026-08-17T12:20:19.399739Z","submitted_at":"2021-02-09T06:16:25Z","title":"CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04664","snapshot_observed_at":"2026-08-07T00:22:54.681694Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.681694Z"},"links":{"cited_paper":"/paper/2102.04664","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:42b06673943ae3fdef9f8a85c16dccb9dd9e93f8a88c25bacf242a730c5355d2","observation_id":"e591b293-72b1-4234-9c51-0df5c84c48a8","resolution":{"observed_at":"2026-08-07T00:22:54.681694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1103.0125","last_updated":"2011-03-01T10:19:11Z","snapshot_observed_at":"2026-08-15T09:45:24.368762Z","submitted_at":"2011-03-01T10:19:11Z","title":"Search-based software test data generation using evolutionary computation","version":1},"cited_work":{"arxiv_id":"1103.0125","doi":null,"metadata_source":"pith","pith_arxiv_id":"1103.0125","snapshot_observed_at":"2026-08-07T00:22:59.021234Z","title":"Search-based software test data generation using evolutionary computation","venue":"cs.SE","work_id":"cd8ff83e-1602-453f-81d7-0ba4b1d26f66","year":2011},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.843366Z"},"links":{"cited_paper":"/paper/1103.0125","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:208ae3c772ef0ad07b7f8e191ee73b0667b39d0820f9ebcb8bd4d393b5cdbf39","observation_id":"ac2fe842-4109-4667-8115-26f6bad1abd4","resolution":{"observed_at":"2026-08-07T00:22:59.126324Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.900003Z","title":"Marvin, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.900003Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:3ce4015d5504365323b02a7ab2a54deecef7db835814778e0f4f29e00dca3296","observation_id":"d7e546bd-95d7-4e47-9ef4-c4df30528740","resolution":{"observed_at":"2026-08-07T00:22:54.900003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:01.112214Z","title":null,"venue":null,"work_id":"e21b90f1-2ae3-493f-b992-f9344cbad77f","year":2004},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.164951Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:6f60544dbfc648d24625d21636fe061586514e5cbdc8ee240c25c88412ce7b86","observation_id":"7f82476d-740b-4305-80da-8fb4cd17db78","resolution":{"observed_at":"2026-08-07T00:23:01.190255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.3563","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:58.818922Z","title":null,"venue":null,"work_id":"af3c9b53-a916-4d70-a951-9037b734a932","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.292198Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:5aa01dd99325c12ca1d3ec6495d59815b16f1cd42345c76512c3b63ecdccda26","observation_id":"2eae1305-74c4-4636-a1fb-1b625e8ab18a","resolution":{"observed_at":"2026-08-07T00:22:58.832867Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:55.412598Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.412598Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:dc46b34c6bc0cca9f77e54acce1d9c8fcb9fb2529ff506f10becc94622ba84e4","observation_id":"11045527-012f-422f-8f98-653f9768ffc2","resolution":{"observed_at":"2026-08-07T00:22:55.412598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:55.499037Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.499037Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:4f44e4dcf48c466ad2c13a103fd24ff0cb0368c498b92f36cd21b5d0e3222d08","observation_id":"45045dd9-da6f-4acb-b9dd-f5b383544d3f","resolution":{"observed_at":"2026-08-07T00:22:55.499037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:55.606582Z","title":"Becker, Arto Hellas, Bailey Kimmel, Garrett Powell, and Juho Leinonen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.606582Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:9b2590c83dc8cc6e3dda5860a66b90c1cb49386ceb5180bf9c32aba252980a05","observation_id":"ef0d7043-afe7-4524-90f7-08061ce8e248","resolution":{"observed_at":"2026-08-07T00:22:55.606582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:55.733894Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.733894Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:7329cf1b349ce2f0ee8090cc3054e60df4ccc5c9283ad82b6d818d665824461a","observation_id":"d8e185d7-c9ad-4032-97ed-2d9d2b5b99b6","resolution":{"observed_at":"2026-08-07T00:22:55.733894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07927","last_updated":"2025-03-16T06:23:34Z","snapshot_observed_at":"2026-08-16T14:09:52.485275Z","submitted_at":"2024-02-05T19:49:13Z","title":"A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07927","snapshot_observed_at":"2026-08-07T00:22:55.803426Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.803426Z"},"links":{"cited_paper":"/paper/2402.07927","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:a1cca70e62097317809ef7bd713dcb81ca20285646d4ab661deec41226bfa429","observation_id":"b5459b6b-81ea-482d-94b1-af2126f754a0","resolution":{"observed_at":"2026-08-07T00:22:55.803426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.968654Z","title":null,"venue":null,"work_id":"5ed3a65d-189c-4201-9a92-ac5655f630a9","year":2020},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.889640Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:35e3bc8dc8fb7ec0386d52fddf5a087c0a880360a0eaadae9350dec69f961595","observation_id":"43a2ce56-4b73-4c8c-b842-8b7dc576f190","resolution":{"observed_at":"2026-08-07T00:23:01.023171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:55.959286Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.959286Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:050a51661342a8ee1f99f8d6847163f953feb6d2bda4ec85dde99c70057548f5","observation_id":"8b96de58-5399-4419-ad44-ca45813a2857","resolution":{"observed_at":"2026-08-07T00:22:55.959286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/icst","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:58.099472Z","title":null,"venue":null,"work_id":"34c97b9e-a884-45be-b741-f00774268e4c","year":2018},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.099483Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:a6884b7e1c9931faf0b8dade630d9107f4c5616283ec77d1baf5962df05d8c3a","observation_id":"b7803329-62f0-4a4b-871e-aff5426195d1","resolution":{"observed_at":"2026-08-07T00:22:58.159750Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1167.36612","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.086321Z","title":null,"venue":null,"work_id":"a733fd01-f677-429d-98c2-ca7350e4fb57","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.206882Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:a825cbbae750a5aa02e344d671f55e9732cbc0a8a45ca9e755c57aab6a050abb","observation_id":"f630d06a-d59c-4f07-8e21-b1f445bbf636","resolution":{"observed_at":"2026-08-07T00:23:00.129940Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.05617","last_updated":"2021-05-20T23:11:01Z","snapshot_observed_at":"2026-08-16T20:50:56.360501Z","submitted_at":"2020-09-11T18:57:36Z","title":"Unit Test Case Generation with Transformers and Focal Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.05617","snapshot_observed_at":"2026-08-07T00:22:56.344629Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.344629Z"},"links":{"cited_paper":"/paper/2009.05617","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:6755919cde26c5925572262ccef470314f72c5b45bad6b023d831cf928496e53","observation_id":"a362e75d-eb7b-4d96-a0fe-f4c181f31073","resolution":{"observed_at":"2026-08-07T00:22:56.344629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:56.473597Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.473597Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:3d8c51d97f72a878f4ce570420afb1ed32d6fde176d85eb4a7353fd1e51637bd","observation_id":"b5f5786d-522c-4a62-917c-d3003a413ac0","resolution":{"observed_at":"2026-08-07T00:22:56.473597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.848825Z","title":null,"venue":null,"work_id":"7b4db296-6068-4148-a460-fb0b64292cf8","year":2001},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.564574Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:2eb5ee23c2822983b0de1090b13d9e07d6e183a8fef2edc90844e52a77729a34","observation_id":"f45fb04c-3f11-425c-ac28-c4f22366833d","resolution":{"observed_at":"2026-08-07T00:23:00.923542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.96786","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:57.793435Z","title":null,"venue":null,"work_id":"c0aaa27b-dc00-4084-a379-50cef38ea598","year":2022},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.694578Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:f259cb3b06611c72c1806fabe2e875bcafc7824a4a71d70bfac47605e9e4290b","observation_id":"8f52b362-fb2f-43c2-9899-2532c4bca62b","resolution":{"observed_at":"2026-08-07T00:22:57.843768Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:56.791389Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.791389Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:7b889a1af167c579986c3770749cf5f0cf7e01fcc0ed7af4ad7fd9108bd38685","observation_id":"4a8b768d-a97c-4a77-8ef5-bcbe7c4bc016","resolution":{"observed_at":"2026-08-07T00:22:56.791389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.703233Z","title":null,"venue":null,"work_id":"aaeb3e0d-7893-4f2d-b0d9-fcf91e3131db","year":2006},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.914404Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:e6e41737aaa5723d92f727b2ef7da6b11d23d30cfcb86a44ab111f4211cfd002","observation_id":"4a1f0b84-16fa-41e4-bf57-aae274d446a0","resolution":{"observed_at":"2026-08-07T00:23:00.781962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:57.025241Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:57.025241Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:aa1ccb56bb7567de15a9a8215d0b484659c48892e2f2f470a1ad4e80645b6f7d","observation_id":"20852e48-d589-4406-8d08-7d1439c0ea86","resolution":{"observed_at":"2026-08-07T00:22:57.025241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10778","last_updated":"2023-10-22T01:48:39Z","snapshot_observed_at":"2026-08-18T20:44:56.750915Z","submitted_at":"2023-04-21T07:08:26Z","title":"Evaluating the Code Quality of AI-Assisted Code Generation Tools: An Empirical Study on GitHub Copilot, Amazon CodeWhisperer, and ChatGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10778","snapshot_observed_at":"2026-08-07T00:22:57.143131Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:57.143131Z"},"links":{"cited_paper":"/paper/2304.10778","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:69141d1004fd0c89bd528bf40706fba85531553249f2d9c6c9c78fdf8cc1b036","observation_id":"9da3e49d-a12e-44d9-b41c-d7f49378169f","resolution":{"observed_at":"2026-08-07T00:22:57.143131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.571912Z","title":null,"venue":null,"work_id":"f088726c-eae1-45ff-a17c-21b13e396644","year":2023},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:57.229784Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:037118cefd7484532108b8f14c3ea1c925be5c08d2a0aa4179bb6c5ccba3fcf0","observation_id":"32ddb553-d030-44a7-b15e-9ce263555191","resolution":{"observed_at":"2026-08-07T00:23:00.629614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-18T20:45:32.943904Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":3,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":28,"verified_exact":5,"verified_fuzzy":3},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2506.14297."}