{"as_of":"2026-08-13T17:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:451e6b5776b2ae20b12b04c4727c1915604425d8d81b52900374232ff77ea17a","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:35:51.340765Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:24:28.140998Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T16:24:28.418595Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"cited_work":{"arxiv_id":"2412.00314","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.00314","snapshot_observed_at":"2026-08-05T16:24:28.418595Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","venue":"cs.SE","work_id":"4089df0c-93d1-4e17-af39-52721683fafa","year":2024},"citing_paper":{"arxiv_id":"2508.18684","last_updated":"2026-06-23T04:40:30Z","snapshot_observed_at":"2026-08-09T18:27:28.770669Z","submitted_at":"2025-08-26T05:08:53Z","title":"FALCON: Transforming Cyber Threat Intelligence into Deployable IDS Rules with Self-Reflection","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T16:24:28.140998Z"},"links":{"cited_paper":"/paper/2412.00314","citing_paper":"/paper/2508.18684"},"observation_digest":"sha256:3b4ddca487796788b333ef8fa948c0338c17bd400ace85455bf58868f33b99ff","observation_id":"107c2bc4-bd65-498b-8a61-d813d5839c35","resolution":{"observed_at":"2026-08-05T16:24:28.422461Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.00314/citation-record","integrity":"/paper/2412.00314/integrity","json":"/paper/2412.00314/citation-record.json","paper":"/paper/2412.00314"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:52.033922Z","title":"Who judges the judge: An empirical study on online judge tests,","venue":null,"work_id":"46fa8bc2-780a-435d-828c-9fab6246ff41","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.117340Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:f15b67187f07d1927a2b80c41169b7ce445e51326d6f7969d9e67cce2b1003a9","observation_id":"752027d0-541b-4e23-9dde-d15fe79095bc","resolution":{"observed_at":"2026-08-12T05:35:52.039866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:52.017261Z","title":"Automatic source code evaluation test develop- ment in programming education using grey-box methods,","venue":null,"work_id":"768947ab-a439-40b1-bc6e-d7c9985fd12e","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.123217Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:f582388e31a4885c929c85eea746cbbdef8eb60d91eab332f7a3cd5435a8d141","observation_id":"f02cab78-82c1-40ef-93de-817ed722b6ba","resolution":{"observed_at":"2026-08-12T05:35:52.022557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04664","last_updated":"2021-03-16T08:28:37Z","snapshot_observed_at":"2026-07-06T10:39:42.676631Z","submitted_at":"2021-02-09T06:16:25Z","title":"CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04664","snapshot_observed_at":"2026-08-12T05:35:51.128443Z","title":"Codexglue: A machine learning benchmark dataset for code understanding and generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.128443Z"},"links":{"cited_paper":"/paper/2102.04664","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:43a85f79f36cab99b39cc96fd240d129e0144e60c29cda5b24c71fec82579e39","observation_id":"e6d004e8-46e5-4149-a0f6-ebf5bbbd1cc2","resolution":{"observed_at":"2026-08-12T05:35:51.128443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.133846Z","title":"Coderl: Mastering code generation through pretrained models and deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.133846Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:c807b8fc14f41b358dc3274001cf70643838b899537b74911dc3c0d3e84ffcf3","observation_id":"f6f2a5a7-d864-428e-b609-d78100806a24","resolution":{"observed_at":"2026-08-12T05:35:51.133846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.988737Z","title":"Large language models meet nl2code: A survey,","venue":null,"work_id":"66de325d-5992-4e56-b66c-cd954a109a1c","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.139127Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:27120535f7338433af654590ac4b481f56ad3c826658f5ec400173eb8557a9fc","observation_id":"deb65a93-2211-412d-927b-f870e39d239f","resolution":{"observed_at":"2026-08-12T05:35:51.993817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.09043","last_updated":"2024-09-05T14:00:11Z","snapshot_observed_at":"2026-08-13T13:00:05.139733Z","submitted_at":"2023-01-22T02:59:59Z","title":"CodeScore: Evaluating Code Generation by Learning Code Execution","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.09043","snapshot_observed_at":"2026-08-12T05:35:51.144229Z","title":"Codescore: Evaluating code generation by learning code execution,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.144229Z"},"links":{"cited_paper":"/paper/2301.09043","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:7cc0d7038753571e610b5b441dd75d88d37e89bc911832321729f299a9e8515f","observation_id":"1cd7d9a5-1049-42db-9821-3db990e28abc","resolution":{"observed_at":"2026-08-12T05:35:51.144229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.150080Z","title":"Spoc: Search-based pseudocode to code,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.150080Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:f299017189eab016e4d5c3e5a36e5a62c0c5fd022479f5592245424fcb57ba24","observation_id":"3992f1cc-c07c-4b5e-aa1b-3b96311eb678","resolution":{"observed_at":"2026-08-12T05:35:51.150080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.09938","last_updated":"2021-11-08T21:16:44Z","snapshot_observed_at":"2026-08-04T23:13:25.514661Z","submitted_at":"2021-05-20T17:58:42Z","title":"Measuring Coding Challenge Competence With APPS","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.09938","snapshot_observed_at":"2026-08-12T05:35:51.154868Z","title":"Measuring coding challenge competence with apps,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.154868Z"},"links":{"cited_paper":"/paper/2105.09938","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:46249ac2a49c1bad399ca04e12ebea70146211b7bcfafa237f9eb7ec70174bf0","observation_id":"c0bd294d-bee7-4eb8-a74d-6da231ae2dd3","resolution":{"observed_at":"2026-08-12T05:35:51.154868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.960951Z","title":"Out of the bleu: how should we assess quality of the code generation models?","venue":null,"work_id":"6044e897-6cb6-4528-988b-d0b162acc44a","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.160198Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:38a424765d45945f6055d81ad43d11ae1759f4f934392f6297d04fc1a57b8647","observation_id":"1a5342d1-b826-470c-ab36-4e52373ada91","resolution":{"observed_at":"2026-08-12T05:35:51.966553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.164815Z","title":"Bleu: a method for automatic evaluation of machine translation,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.164815Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:7687b0163778267e8c102aea4c4025bdc3ade7ef819ae7fa82c33b0906eda535","observation_id":"1287646d-da8b-41d5-8c8c-112888733f82","resolution":{"observed_at":"2026-08-12T05:35:51.164815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.933166Z","title":"A package for automatic evaluation of summaries,","venue":null,"work_id":"70ce3ceb-cfb4-4d11-a91c-73e8adee9559","year":2004},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.169661Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:ed5879f70a0753a4f9364cb7f54b53de98e3cd68d5381b51ecbc1b5b472dc818","observation_id":"c60260b5-3f25-40ea-a253-c423b5844166","resolution":{"observed_at":"2026-08-12T05:35:51.938577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.916281Z","title":"Does bleu score work for code migration?","venue":null,"work_id":"06283ab5-ec03-435d-9d42-6b5aaab8e93f","year":2019},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.174483Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:05e0efc9d20990529284ec68673f2bae14d4d4419e8e487caa1569be0cd18d2f","observation_id":"cdd5a12a-ef2c-468e-ac8c-754a3cc599ff","resolution":{"observed_at":"2026-08-12T05:35:51.921968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05527","last_updated":"2023-10-31T13:44:36Z","snapshot_observed_at":"2026-08-13T12:47:06.898651Z","submitted_at":"2023-02-10T22:12:05Z","title":"CodeBERTScore: Evaluating Code Generation with Pretrained Models of Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05527","snapshot_observed_at":"2026-08-12T05:35:51.179925Z","title":"Codebertscore: Evaluating code gener- ation with pretrained models of code,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.179925Z"},"links":{"cited_paper":"/paper/2302.05527","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:7aed7d3a9cc1b22ff5a962d3a33e5c259f10bf01f8eafda8342c91b4e693d95a","observation_id":"f5dc2978-eab1-4b94-8c2f-b83e9be49e99","resolution":{"observed_at":"2026-08-12T05:35:51.179925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10297","last_updated":"2020-09-27T04:07:11Z","snapshot_observed_at":"2026-08-12T14:26:33.940158Z","submitted_at":"2020-09-22T03:10:49Z","title":"CodeBLEU: a Method for Automatic Evaluation of Code Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10297","snapshot_observed_at":"2026-08-12T05:35:51.185496Z","title":"Codebleu: a method for automatic evaluation of code synthesis,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.185496Z"},"links":{"cited_paper":"/paper/2009.10297","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:1c2f8f32747fbf00c7c85f34e383f44faa56133ce768b887657f6baa7cebf720","observation_id":"068580ea-0365-4a79-8662-dc320204b5af","resolution":{"observed_at":"2026-08-12T05:35:51.185496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.190751Z","title":"chrf: character n-gram f-score for automatic mt evalu- ation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.190751Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:92ff324c8cf21edb46fc1ead84de57aecd7b494ed287fd4c3e70acaa1e0ffb3f","observation_id":"b00d2833-ff52-4abf-b2af-97f2860c9cfc","resolution":{"observed_at":"2026-08-12T05:35:51.190751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-12T05:35:51.195631Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.195631Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:06bed64cb41f36cca19aef9896b39c24cf1316b167826ebaf84248e3b7ab0d61","observation_id":"526d3951-d78a-4f68-a0a5-34915fb4f34a","resolution":{"observed_at":"2026-08-12T05:35:51.195631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14317","last_updated":"2024-01-22T17:06:50Z","snapshot_observed_at":"2026-08-13T11:53:53.432805Z","submitted_at":"2023-04-27T16:38:17Z","title":"ICE-Score: Instructing Large Language Models to Evaluate Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14317","snapshot_observed_at":"2026-08-12T05:35:51.200654Z","title":"Large language models are state-of-the-art evaluators of code generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.200654Z"},"links":{"cited_paper":"/paper/2304.14317","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:0a607f6565fbc60f383a07ae213ac96c3686df877aa2dcfe60533f69887874d3","observation_id":"a931a814-1e50-4419-8454-83330b2aedd9","resolution":{"observed_at":"2026-08-12T05:35:51.200654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.206144Z","title":"Learning to mine aligned code and natural language pairs from stack overflow,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.206144Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:0c08158852b172e488dac46b512af137db29c422f440edfec66d0498f4861100","observation_id":"fc582aaf-96ce-489c-bc10-abc4196325ca","resolution":{"observed_at":"2026-08-12T05:35:51.206144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1603.06744","last_updated":"2016-06-08T14:46:00Z","snapshot_observed_at":"2026-07-06T04:50:17.203328Z","submitted_at":"2016-03-22T11:41:51Z","title":"Latent Predictor Networks for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.06744","snapshot_observed_at":"2026-08-12T05:35:51.211234Z","title":"Latent predictor networks for code gen- eration,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.211234Z"},"links":{"cited_paper":"/paper/1603.06744","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:d6f2cc9bfb82be8aca7cd81bfea27167a58c3b2b96cd55b37f570c46daa9263d","observation_id":"dc7885f2-297a-4488-b3a4-02136c718eaa","resolution":{"observed_at":"2026-08-12T05:35:51.211234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07197","last_updated":"2022-10-13T17:17:03Z","snapshot_observed_at":"2026-08-13T14:05:46.815071Z","submitted_at":"2022-10-13T17:17:03Z","title":"Towards a Unified Multi-Dimensional Evaluator for Text Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07197","snapshot_observed_at":"2026-08-12T05:35:51.217643Z","title":"Towards a unified multi-dimensional evaluator for text generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.217643Z"},"links":{"cited_paper":"/paper/2210.07197","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:af22291645287296798c2361518bad4bb0911088945e5cd651cf4761f3d02391","observation_id":"7b7dda7c-3b6a-4183-a7ec-cd239a5faef4","resolution":{"observed_at":"2026-08-12T05:35:51.217643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.223383Z","title":"Survey of hallucination in natural language generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.223383Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:d933b9e3550e04453c44a04b1217d5f53f49341aa7163e237d93a01a00e6d31d","observation_id":"9b1269a7-94a0-469d-ba27-29e26808068e","resolution":{"observed_at":"2026-08-12T05:35:51.223383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.14271","last_updated":"2022-08-30T13:44:41Z","snapshot_observed_at":"2026-08-13T14:36:02.734748Z","submitted_at":"2022-08-30T13:44:41Z","title":"Faithful Reasoning Using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.14271","snapshot_observed_at":"2026-08-12T05:35:51.228537Z","title":"Faithful reasoning using large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.228537Z"},"links":{"cited_paper":"/paper/2208.14271","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:c4d5cc1184ccfab7bbd04533cbb86e4fd6c5187ed97d3c4518ffd294e46e2993","observation_id":"911bbbca-0825-4cfd-aebe-06eb822312c4","resolution":{"observed_at":"2026-08-12T05:35:51.228537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.12655","last_updated":"2021-08-29T19:43:43Z","snapshot_observed_at":"2026-08-06T05:51:42.612813Z","submitted_at":"2021-05-25T00:13:29Z","title":"CodeNet: A Large-Scale AI for Code Dataset for Learning a Diversity of Coding Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.12655","snapshot_observed_at":"2026-08-12T05:35:51.233779Z","title":"Codenet: A large- scale ai for code dataset for learning a diversity of coding tasks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.233779Z"},"links":{"cited_paper":"/paper/2105.12655","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:836787495cc3fa25429807e205774f2ca08a454ab32f0fb55ffb0419f4d6a178","observation_id":"38d12603-7d58-4eef-b6d8-a1b436fc1f86","resolution":{"observed_at":"2026-08-12T05:35:51.233779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.865937Z","title":"Increasing employability of indian engineering graduates through experiential learning programs and competitive programming: Case study,","venue":null,"work_id":"96e4f56a-6b55-4244-9d65-e486dae718ce","year":2020},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.239284Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:2100a6bacfd9c184231ed4633aa94b9eee648f5f59dcf2d861ae5fb1c9a2ab57","observation_id":"15094510-9d6d-4464-adee-e218b43d67e8","resolution":{"observed_at":"2026-08-12T05:35:51.871489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-12T05:35:51.244040Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.244040Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:87c5179061516a772e97adba9ba92b24c476fd7c0cea44c26b33b92add6424a8","observation_id":"d119ebda-43a2-480f-8312-099250ea6d70","resolution":{"observed_at":"2026-08-12T05:35:51.244040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.249521Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.249521Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:f5f8f41c04c834b620fd1ee4ccaebe2aefadfd8a17f0b95a6bab2ff7931e43bb","observation_id":"a7846e2d-37fc-4255-bb1b-7869fa9d4059","resolution":{"observed_at":"2026-08-12T05:35:51.249521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.838293Z","title":"Fine-grained code clone detection with block-based splitting of abstract syntax tree,","venue":null,"work_id":"bf265066-3ebb-4f27-9164-1d9d800ff4ca","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.254513Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:97d3706ea77a802daa1a2499e87a9a4d5ae0e06857c3a994e8a16c26d5828c59","observation_id":"faa84c3d-c7b7-4c30-b14c-c3d58d8170ad","resolution":{"observed_at":"2026-08-12T05:35:51.843479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.822016Z","title":"Cocoast: Representing source code via hierarchical splitting and re- construction of abstract syntax trees,","venue":null,"work_id":"96a1e223-f567-4bd7-9991-88ec9e36e48e","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.259535Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:dc6da483c87420af4d7da3b590bfb14a67088326a721e53a1d707ab24d2eda27","observation_id":"4cdc6928-b329-4be6-a59f-0a6e3d58de07","resolution":{"observed_at":"2026-08-12T05:35:51.827289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.803733Z","title":"Blocsum: Block scope-based source code summarization via shared block representation,","venue":null,"work_id":"ab980eca-b619-485d-8eba-50fca7e4bb4b","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.264836Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:80fcb3fa5908d5405785d982e66c66c89bdc69113b075dbf27ca841c3c198c39","observation_id":"d0f395a4-6c88-4b23-8d2e-8e074dec6c5f","resolution":{"observed_at":"2026-08-12T05:35:51.809874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.786141Z","title":"Openai gpt-3.5 turbo,","venue":null,"work_id":"cd47549a-7586-4b29-9971-70635575171b","year":2022},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.270072Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:7568c0fa050dc0452bbe93b8b1dd1e06c94667c5667caabfca19fe062bc91679","observation_id":"674e58ec-730e-4b40-b7df-0ba2037027af","resolution":{"observed_at":"2026-08-12T05:35:51.791428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.769423Z","title":"Exploring security vulnerabilities in competitive programming: An empirical study,","venue":null,"work_id":"c698fbee-838a-41f4-bfc2-9553ddb75388","year":2022},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.275147Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:1e13c4dc05db1eb97bfa6cbc748da666d43be20e94d212ef6d3d1bec2e45e140","observation_id":"2aeb5347-8c25-45fc-bcd5-f766c271daf2","resolution":{"observed_at":"2026-08-12T05:35:51.774773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.751474Z","title":"Multipl-e: A scalable and polyglot approach to benchmarking neural code generation,","venue":null,"work_id":"28093a97-dd99-405c-a31e-cb8ff8e5c17f","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.280106Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:b333d8e56c4e5d7434ff47da0cdd01ff6cb5260746096a7757c7cefc8b8fd454","observation_id":"3ae686d0-9386-4566-837b-0b9fd98375a2","resolution":{"observed_at":"2026-08-12T05:35:51.756582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.733782Z","title":"Gpt-4: Language models at scale,","venue":null,"work_id":"0e44719f-2525-417b-9d7e-4cdcc4b9edc4","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.285090Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:7bf083a25958907ae71982c71db5910de045de74ada8e25d9431a3c6c21c76a7","observation_id":"69553955-b7c8-4108-a109-f3161c4fe0c0","resolution":{"observed_at":"2026-08-12T05:35:51.739906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.716604Z","title":"Openai gpt-4 turbo,","venue":null,"work_id":"a31e3031-b13d-46b8-92d2-16a51e19e82d","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.289829Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:b428a80295db466263317a69d909300f626296526df000e4b86cf99da014a037","observation_id":"7d8c3c11-2f7e-4ff2-a96a-7a5e878a1e38","resolution":{"observed_at":"2026-08-12T05:35:51.722040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.294747Z","title":"Meteor: An automatic metric for mt evalua- tion with improved correlation with human judgments,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.294747Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:d008df8237cf7f5670cd2ebdce5285253b264ef48fccb82a73f872fa3885845e","observation_id":"7c7178db-2b09-486a-aa18-98ba39063488","resolution":{"observed_at":"2026-08-12T05:35:51.294747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.299866Z","title":"Large lan- guage models are zero-shot reasoners,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.299866Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:5a121c211a594404a89b611e50b42be32ad804717b7278e8771a3c1537f6887d","observation_id":"76779232-788b-4f44-8ea5-5f673283996a","resolution":{"observed_at":"2026-08-12T05:35:51.299866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.305123Z","title":"Language mod- els are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.305123Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:eec4b5b2cd65b31762ceb48cca53866dea691cf9b83b8e99c8bc04072308ec3b","observation_id":"df9a7451-b3c2-4b4f-919b-4f0f479b29ab","resolution":{"observed_at":"2026-08-12T05:35:51.305123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.310133Z","title":"A new measure of rank correlation,","venue":null,"work_id":null,"year":1938},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.310133Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:6cf56ebb9b5a437b327da92f94bc94c8a72f6b7095a647bfb4f23dd43694be01","observation_id":"4cfeeb3d-d209-4133-bc10-1c835bd9c235","resolution":{"observed_at":"2026-08-12T05:35:51.310133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.315250Z","title":"Pearson correlation coefficient,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.315250Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:b66804fe761ea5f4c5d5be4bc634a071f49fc61f35f0e00c69829ea1855429fc","observation_id":"58cd1b00-3a99-4ab5-b1d2-a38d1dd020a7","resolution":{"observed_at":"2026-08-12T05:35:51.315250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.321002Z","title":"Likert scale: Explored and explained,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.321002Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:824640871cfcd8d03774a160c5b054c248601471ecf9ff02db2f00cbaf360e69","observation_id":"31a71bb3-22ba-4f7b-ba02-01f535efb7b9","resolution":{"observed_at":"2026-08-12T05:35:51.321002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.635483Z","title":"Unsu- pervised translation of programming languages,","venue":null,"work_id":"5d8109c6-5fd2-4980-adaf-c4065f9e4a6e","year":2020},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.326026Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:6f90fd80ecc85b083d47fab6c040c8f7c4fdaeca00d03085593db14a6316255b","observation_id":"65067bc0-9be7-446d-9b5c-1c0d2785c538","resolution":{"observed_at":"2026-08-12T05:35:51.641453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:51.615902Z","title":"An empirical study of auto- mated unit test generation for python,","venue":null,"work_id":"2a5dbf1b-b196-4d85-85cc-83011c35d0cf","year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.331017Z"},"links":{"citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:4f994c79d8a9b0772cc9b3c372d16121e8c097029c8cf47b8c50dc8340d018e0","observation_id":"98cca902-aa89-44ac-80d1-ee826433265b","resolution":{"observed_at":"2026-08-12T05:35:51.623676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01937","last_updated":"2023-05-03T07:28:50Z","snapshot_observed_at":"2026-08-13T11:50:17.843572Z","submitted_at":"2023-05-03T07:28:50Z","title":"Can Large Language Models Be an Alternative to Human Evaluations?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01937","snapshot_observed_at":"2026-08-12T05:35:51.335834Z","title":"Can large language models be an alterna- tive to human evaluations?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.335834Z"},"links":{"cited_paper":"/paper/2305.01937","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:65382519964c0d71035548ca533ccfd88ed8083292762f06d98262f98988dc99","observation_id":"24059aa6-2376-47a7-9ebe-1ebf7aeeb741","resolution":{"observed_at":"2026-08-12T05:35:51.335834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16634","last_updated":"2023-05-23T22:12:16Z","snapshot_observed_at":"2026-08-02T04:02:36.848064Z","submitted_at":"2023-03-29T12:46:54Z","title":"G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16634","snapshot_observed_at":"2026-08-12T05:35:51.340765Z","title":"G-eval: Nlg evaluation using gpt-4 with better human alignment, may 2023,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:51.340765Z"},"links":{"cited_paper":"/paper/2303.16634","citing_paper":"/paper/2412.00314"},"observation_digest":"sha256:5eff15371c0d7e0082fec1dd05fc7e53f9c6fa46f3810987fde0ef1d89851cc2","observation_id":"b4e5cb43-f826-4735-be77-653f9dbce629","resolution":{"observed_at":"2026-08-12T05:35:51.340765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.00314","last_updated":"2024-11-30T01:49:25Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-12T08:01:46.878825Z","submitted_at":"2024-11-30T01:49:25Z","title":"Human-Like Code Quality Evaluation through LLM-based Recursive Semantic Comprehension"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2412.00314."}