{"as_of":"2026-08-17T23:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e58f0e8511594e58882ebcf8cec423c559bbbc889e311885f51b1f74bf7739f4","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:02:54.374219Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:36:36.484575Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T21:10:09.278283Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"cited_work":{"arxiv_id":"2509.03331","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.03331","snapshot_observed_at":"2026-07-04T21:10:09.278283Z","title":"VulnRepairEval: An exploit-based evaluation framework for assessing large language model vulnerability repair capabilities,","venue":null,"work_id":"007cdee6-8e4f-4a4a-be74-82f398bb1a8d","year":2025},"citing_paper":{"arxiv_id":"2605.28893","last_updated":"2026-07-03T07:41:40Z","snapshot_observed_at":"2026-08-02T07:12:40.296167Z","submitted_at":"2026-05-27T08:11:37Z","title":"Towards Demystifying and Repairing LLM-in-the-Loop Vulnerabilities","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T11:21:33.012202Z"},"links":{"cited_paper":"/paper/2509.03331","citing_paper":"/paper/2605.28893"},"observation_digest":"sha256:4379cc6268ee255ec9ce78068976df9ecc07964ff723fd4098d0cbd3e9d72448","observation_id":"b7c6bc9d-3adf-4169-8b9d-9aa773a4d679","resolution":{"observed_at":"2026-06-29T11:23:20.652423Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"cited_work":{"arxiv_id":"2509.03331","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.03331","snapshot_observed_at":"2026-07-04T21:10:09.278283Z","title":"VulnRepairEval: An exploit-based evaluation framework for assessing large language model vulnerability repair capabilities,","venue":null,"work_id":"007cdee6-8e4f-4a4a-be74-82f398bb1a8d","year":2025},"citing_paper":{"arxiv_id":"2606.25973","last_updated":"2026-06-24T15:45:38Z","snapshot_observed_at":"2026-08-16T19:41:41.697303Z","submitted_at":"2026-06-24T15:45:38Z","title":"Helpful or Harmful? Evaluating LLM-Assisted Vulnerability Patching via a Human Study","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-25T19:02:45.109478Z"},"links":{"cited_paper":"/paper/2509.03331","citing_paper":"/paper/2606.25973"},"observation_digest":"sha256:39492fbeebec34d45f21f79930569fa692ef7ab49890b7e373b0cae69ac99762","observation_id":"d7933b54-82de-45c3-a3a0-052065f36990","resolution":{"observed_at":"2026-07-04T21:10:09.279825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03331","snapshot_observed_at":"2026-08-05T00:36:36.484575Z","title":"arXiv preprint arXiv:2509.03331 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00692","last_updated":"2026-08-01T14:40:33Z","snapshot_observed_at":"2026-08-16T18:10:24.137624Z","submitted_at":"2026-08-01T14:40:33Z","title":"Vul4Py: Benchmarking Automated Vulnerability Repair in Python with Paired Exploit and Functional Oracles","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:36.484575Z"},"links":{"cited_paper":"/paper/2509.03331","citing_paper":"/paper/2608.00692"},"observation_digest":"sha256:71e2481dddf12fc8128201616f308c9e3b6d90751aaa392221fb8018d5c81533","observation_id":"61821484-3ea5-4605-8978-8c3a73778f7f","resolution":{"observed_at":"2026-08-05T00:36:36.484575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.03331/citation-record","integrity":"/paper/2509.03331/integrity","json":"/paper/2509.03331/citation-record.json","paper":"/paper/2509.03331"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.499931Z","title":"git-apply Documentation","venue":null,"work_id":"39027a02-3a0b-4cfb-a6f2-e6dd2a0ad438","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.215896Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:4b4ea308eed2f3a50525dba3c5e5ef2f563b995b07f81dbe72a2019a40e1f8ba","observation_id":"1fe78373-78ef-4580-897d-c3f6e6f9c67d","resolution":{"observed_at":"2026-08-05T11:02:55.504115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.485365Z","title":"patch Command – IBM AIX Documentation","venue":null,"work_id":"22c929d5-7ef5-4dc0-835a-4dc3941e64f5","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.221430Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:6ed409a363dbad813e4dd1c9f9050545344c38ed72081e1107d2fbbd69673e43","observation_id":"aae13449-36d6-4e44-82e8-f001940e9357","resolution":{"observed_at":"2026-08-05T11:02:55.489752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19828","last_updated":"2025-05-26T11:06:03Z","snapshot_observed_at":"2026-08-17T13:19:59.196536Z","submitted_at":"2025-05-26T11:06:03Z","title":"SecVulEval: Benchmarking LLMs for Real-World C/C++ Vulnerability Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19828","snapshot_observed_at":"2026-08-05T11:02:54.227103Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.227103Z"},"links":{"cited_paper":"/paper/2505.19828","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:d2aa547b1fe822440bcce171abfff92435b3a9ed1e288dddb1f5b8da582ce021","observation_id":"3335d6c9-997a-4a55-abf1-39b619b0fd84","resolution":{"observed_at":"2026-08-05T11:02:54.227103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.469151Z","title":null,"venue":null,"work_id":"c9c89a45-dfdc-400e-9901-cc6ab3cad061","year":null},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.232277Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:4e86bb4e67298b91ae3bbb28cb6606cc1fad330706df98510bd9887177081c41","observation_id":"6aa13417-3567-4b24-87c2-647a4f7da1e2","resolution":{"observed_at":"2026-08-05T11:02:55.474274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5960.34759","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.149477Z","title":null,"venue":null,"work_id":"3e0678d4-70da-4b9b-a602-767155493761","year":2021},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.240818Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:12ea7bda757247ae637a855ff1c0f6674c4fc6710c086cbd301d3116540106e6","observation_id":"fcf7e0e2-84fd-43bc-b1f0-4d209fe7434f","resolution":{"observed_at":"2026-08-05T11:02:55.159079Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.453060Z","title":"Smith, Donald Stufft","venue":null,"work_id":"e1e2cc5a-6216-42e3-92fe-8c1d24e4360f","year":2016},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.244993Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:f053b060cd343f1e50aebadbae7c77fb419897d25f8a3202330d05d116df00de","observation_id":"2160a1e4-ca25-49b7-84aa-d9015e8f31ae","resolution":{"observed_at":"2026-08-05T11:02:55.457829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.436814Z","title":"Díaz Ferreyra","venue":null,"work_id":"3b0bc9fc-3c95-44e7-9885-ed381650cd55","year":2022},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.249614Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:86c2b1fcfa01c3c5c9e67b84a7d78647d679dc70d77bd8b749bf3d13f6745272","observation_id":"51f3abce-3622-4da9-baa8-ec4d4fca65e7","resolution":{"observed_at":"2026-08-05T11:02:55.441769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-05T11:02:54.257899Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.257899Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:80765fa347718e0ea2d89a20ff1bfff08e9c5b83652098958549e3945cc6fe34","observation_id":"fa455ae8-adb9-4dee-9914-3948c20a4cd3","resolution":{"observed_at":"2026-08-05T11:02:54.257899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.422073Z","title":null,"venue":null,"work_id":"2d13bb5f-750a-41b7-a37c-c805a1c0a0c1","year":2020},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.262484Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:045b5205959a667417c419f8ff34a69858ec87579f9c604db365d6c1fdef4d27","observation_id":"32531a87-5e05-4bb2-9c9f-a93a7e93b598","resolution":{"observed_at":"2026-08-05T11:02:55.426094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.405514Z","title":"2024.{PentestGPT}: Evaluating and harnessing large language models for automated penetration testing","venue":null,"work_id":"f1deaf4d-984e-4a9a-ab6e-88914acf6947","year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.266534Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:71cc98ae57179b4fec7627897023accf1a4866a9582b1a0e6dd9e3c591b21282","observation_id":"ccacb866-ac59-4ebe-a5de-aad7dd7a32c3","resolution":{"observed_at":"2026-08-05T11:02:55.410264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T11:02:54.270368Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.270368Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:839f06d463c9e6e247ea8706e84c144bf10d82920c46229d400a1f44eb865f61","observation_id":"9975aef7-e0ce-43ae-bcf8-fa8bb060bcba","resolution":{"observed_at":"2026-08-05T11:02:54.270368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11697","last_updated":"2025-06-13T11:59:04Z","snapshot_observed_at":"2026-08-17T04:07:32.560921Z","submitted_at":"2025-06-13T11:59:04Z","title":"SoK: Automated Vulnerability Repair: Methods, Tools, and Assessments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11697","snapshot_observed_at":"2026-08-05T11:02:54.274440Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.274440Z"},"links":{"cited_paper":"/paper/2506.11697","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:e3b96b722fb8128a05f15e508380f7601b000318dab890ad6c50dcfca61b7ddc","observation_id":"eda7427e-65f4-4ccb-a686-4742b5b712b8","resolution":{"observed_at":"2026-08-05T11:02:54.274440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T11:02:54.278555Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.278555Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:19ee7e0a20699740d81ab60d21e77e6b536b390d1a0c505f738b784b17444e81","observation_id":"78c2840b-a16b-462f-8517-8453d680abe7","resolution":{"observed_at":"2026-08-05T11:02:54.278555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-12T14:56:35.025839Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-05T11:02:54.282800Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.282800Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:3729fe901662195de6240b804edfffd0875254427707628dd98076b1c42f9408","observation_id":"fa2a095b-71c5-4e85-9e5c-17d13bc37afb","resolution":{"observed_at":"2026-08-05T11:02:54.282800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/2610384","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"756f23bd-5950-43ed-b64f-80651393a897","year":2014},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.286766Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:f0a7722ee4f11ab3f0175032f721335ff2e6c8bb321543079e71ffb700ddcd86","observation_id":"c5ce7e3e-d9f2-482e-8a85-40c6ff2a6991","resolution":{"observed_at":"2026-08-05T11:02:54.433629Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-05T11:02:54.290488Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.290488Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:cf61ce70201851eb1762bc3882892c1879b3505405969ac838b0f56631a4cc7b","observation_id":"94b8e3ec-25f3-4208-a029-5e9f5af06b14","resolution":{"observed_at":"2026-08-05T11:02:54.290488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8499.2023","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.859260Z","title":null,"venue":null,"work_id":"8212c541-dd3d-430f-b896-3a0e94b39b5a","year":2023},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.294508Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:261fd1e73983892f6b71d72efd2ae9ca6de741df8045f2bfc892f6ad03c15db0","observation_id":"b19cda7d-ec03-4ea9-a087-29efc38f48da","resolution":{"observed_at":"2026-08-05T11:02:54.868133Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.298556Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.298556Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:4e61ac74e4af489b99a35569264dac72d0098b9f5553beb1ceead1aabd90a2b6","observation_id":"daf00636-cbd1-45d5-af4b-823bc58e582e","resolution":{"observed_at":"2026-08-05T11:02:54.298556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.302738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.302738Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:a65c0620b8a0e29421d7a5c6ef3a44a3713953a5a6c0e4ad15dbdecd227a1871","observation_id":"5c25037c-6566-4125-9537-c9bb6f45048b","resolution":{"observed_at":"2026-08-05T11:02:54.302738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.389601Z","title":null,"venue":null,"work_id":"154c1f9b-e27b-4e59-b12f-da74dcb40cb7","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.306710Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:a8b74a2153ddb5a063df12b8c4dccdac61089eb62fdbfac90a7f3fcecbbf3061","observation_id":"f87cfc28-6fc0-4aef-b2b0-e21b1884ea57","resolution":{"observed_at":"2026-08-05T11:02:55.394487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.373975Z","title":null,"venue":null,"work_id":"0d0d270e-14ef-4e31-a5f2-ee2d3957a1c7","year":2021},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.310590Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:1959703c48f8867faf2a28603cd05d23af25f2702a51d18f23cf90f10285ca76","observation_id":"638c9e38-958c-4a99-8720-cfd443933dee","resolution":{"observed_at":"2026-08-05T11:02:55.378799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.355856Z","title":null,"venue":null,"work_id":"c18f4714-3c8b-4d9d-837c-6bbdacbdb1e5","year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.314475Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:3b4c27830763c7c6559e5c1a1d38c52c493469467e6f17130e18bb5ced98de49","observation_id":"dd2a5acd-51d3-4125-9988-298a3e56e04c","resolution":{"observed_at":"2026-08-05T11:02:55.360546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.341079Z","title":null,"venue":null,"work_id":"a4eff38f-1a48-4b65-beb7-e2c9afffb7ee","year":2023},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.318435Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:9b3f4f2f0c1c82772bbb00f483a475c7410b9e738f781dd104ebcb6f8184be63","observation_id":"dae2b195-b9f8-4b0a-bf7a-c0d0fe8dace1","resolution":{"observed_at":"2026-08-05T11:02:55.345392Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.325776Z","title":null,"venue":null,"work_id":"b271c8a6-40fc-41e3-b362-5981e61c11f3","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.322331Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:5bf291f20e2867c2c9077e95537df17b67ff2e4b56e83b43c6edc5cfad4b2055","observation_id":"894ea19f-28fb-40ab-82a3-0d38da2b47f9","resolution":{"observed_at":"2026-08-05T11:02:55.330514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10443","last_updated":"2026-05-07T08:39:34Z","snapshot_observed_at":"2026-08-02T12:51:54.815471Z","submitted_at":"2025-05-15T16:04:25Z","title":"Are Large Language Models Robust in Understanding Code Against Semantics-Preserving Mutations?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10443","snapshot_observed_at":"2026-08-05T11:02:54.326649Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.326649Z"},"links":{"cited_paper":"/paper/2505.10443","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:2177ff2fff9281107d7ec0c9d770f83e524b7244cef29eae0ff887f67f5a3836","observation_id":"d68be404-6158-48e5-84aa-bd3386653d12","resolution":{"observed_at":"2026-08-05T11:02:54.326649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04962","last_updated":"2026-06-28T09:23:55Z","snapshot_observed_at":"2026-08-16T21:27:46.312495Z","submitted_at":"2025-06-05T12:37:33Z","title":"PoCGen: Generating Proof-of-Concept Exploits for Vulnerabilities in Npm Packages","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04962","snapshot_observed_at":"2026-08-05T11:02:54.330975Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.330975Z"},"links":{"cited_paper":"/paper/2506.04962","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:5b38233cfabec6819cec25ec10c1d52e621eff74fc904e1584f3bc8708950510","observation_id":"4027879f-411b-4ce2-82d8-470bf078a7db","resolution":{"observed_at":"2026-08-05T11:02:54.330975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.310701Z","title":null,"venue":null,"work_id":"5c54489f-456a-40ad-810c-690bcd439d47","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.335305Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:46f94dbed96fe857f2a1cfa7f396f2eb2fb22b1963d639cf77b897f1d9c67ffd","observation_id":"93938fae-9036-4db6-8c12-d5deee521d12","resolution":{"observed_at":"2026-08-05T11:02:55.314977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.292037Z","title":null,"venue":null,"work_id":"d72a12ed-bd1d-445b-9133-b5c52bc302ac","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.339819Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:6581c502a981f6e140d84427491e6cccd40f771bcf23318529a490dfd5d8c32f","observation_id":"d0b7014b-3e98-4d3c-af4d-aa9436733ee1","resolution":{"observed_at":"2026-08-05T11:02:55.296795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.344033Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.344033Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:feb70ce7051898d470906b1f1fd168f9550b897a5e1769cc5cc8d3bb013806b0","observation_id":"8a98f66b-e71a-4e1a-ac0c-fdf38f97bfa9","resolution":{"observed_at":"2026-08-05T11:02:54.344033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9478.36476","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.729732Z","title":null,"venue":null,"work_id":"6809ab0c-c83c-4b02-82eb-2dd551af5f20","year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.348211Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:f605a4b0ef7a5dd027e6577024800448f906e85139d5de8b12af811ca2ee6a0e","observation_id":"9cd4b76a-358a-491e-9a76-0e1296531cd4","resolution":{"observed_at":"2026-08-05T11:02:54.738213Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.264085Z","title":"Chi, Quoc V","venue":null,"work_id":"9b48b343-f59e-45fc-96ba-3848bfbfd10a","year":2022},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.352409Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:a32794f3fe565a543e6f20a26c90433a5ac8ff136b2234bf77063d03bfcff7a4","observation_id":"fbd3072f-6bfa-4d4c-a6dc-f74e563abc10","resolution":{"observed_at":"2026-08-05T11:02:55.268973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18449","last_updated":"2025-12-01T00:16:59Z","snapshot_observed_at":"2026-08-13T07:37:18.494967Z","submitted_at":"2025-02-25T18:45:04Z","title":"SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18449","snapshot_observed_at":"2026-08-05T11:02:54.356699Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.356699Z"},"links":{"cited_paper":"/paper/2502.18449","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:9b0d12f4de3c44ec5fc0400774c952c19df063581147fead2ac2c72abf45b9a6","observation_id":"9acab7d4-dcaa-44f8-956e-afa3feefab96","resolution":{"observed_at":"2026-08-05T11:02:54.356699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.361313Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.361313Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:c6d69e4086e782ff202ef2484558d4c198fe59996f655cadcdcbf4a224430a26","observation_id":"4510945b-4e26-41f5-82ba-5f17b02228d2","resolution":{"observed_at":"2026-08-05T11:02:54.361313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T11:02:54.365718Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.365718Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:3c964ed82c3a2d85f2c98709fe6bafe15c2f9642e0fc48ed75d667fd183a1a29","observation_id":"6bec30c8-092d-490b-9c66-b16ad0df4e5b","resolution":{"observed_at":"2026-08-05T11:02:54.365718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-05T11:02:54.369975Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.369975Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:883be997d7346d5bff33e62214aeabd0a2acd4c3adc5c4e3f528d7563aabea4c","observation_id":"70468bcb-b603-4346-9b14-e217fe97db3e","resolution":{"observed_at":"2026-08-05T11:02:54.369975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15877","last_updated":"2025-04-01T08:36:44Z","snapshot_observed_at":"2026-08-14T15:45:30.011625Z","submitted_at":"2024-06-22T15:52:04Z","title":"BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15877","snapshot_observed_at":"2026-08-05T11:02:54.374219Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.374219Z"},"links":{"cited_paper":"/paper/2406.15877","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:ee8da344c22da76c93bff99de8b622b5e1e51157974545a9c8683dd6969ce19e","observation_id":"4eee2536-09a9-429d-a48e-5bb0e504d29c","resolution":{"observed_at":"2026-08-05T11:02:54.374219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.253699Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":468,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.253699Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:34110fc9daf8502a1925f61fa88f934c1ab0b10241e0162ed67dd54c32861bdb","observation_id":"5ae84726-e274-437f-98ff-e1aace6cfe89","resolution":{"observed_at":"2026-08-05T11:02:54.253699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.236609Z","title":"In Proceedings of the 20th International Confer- ence on Predictive Models and Data Analytics in Software Engineering (PROMISE 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.236609Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:dd53ee7f239910f9f367613c770ca6d102494127284079b3416ab256354cad08","observation_id":"0e0f64d6-918a-46ff-974b-6e73324bd0a2","resolution":{"observed_at":"2026-08-05T11:02:54.236609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-17T11:57:28.590096Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":28,"verified_exact":2,"verified_fuzzy":6},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 3 inbound Pith citation observations for arXiv:2509.03331."}