{"as_of":"2026-08-13T14:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:edf76174943dd1a65f2cbe9f09b3db8d2f5aad7ba1924e3889d17e596a5e24b3","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:39:33.837756Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T16:27:43.489582Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T08:26:01.477245Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":"2411.18019","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18019","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9b540192-2043-4617-a464-a80fbaea7afa","year":2024},"citing_paper":{"arxiv_id":"2604.11270","last_updated":"2026-07-30T10:58:23Z","snapshot_observed_at":"2026-08-02T23:57:43.901147Z","submitted_at":"2026-04-13T10:24:28Z","title":"Evaluating LLM Agents on Automated Software Analysis Tasks","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T16:38:12.144252Z"},"links":{"cited_paper":"/paper/2411.18019","citing_paper":"/paper/2604.11270"},"observation_digest":"sha256:17559002f0e9936d5cab0f27aad3d9fbc4ff16454007cdd06bc499fb1e562907","observation_id":"399dd694-103d-440f-80a1-257581758b6a","resolution":{"observed_at":"2026-05-11T08:26:01.479107Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18019","snapshot_observed_at":"2026-08-02T16:27:43.489582Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.11270","last_updated":"2026-07-30T10:58:23Z","snapshot_observed_at":"2026-08-02T23:57:43.901147Z","submitted_at":"2026-04-13T10:24:28Z","title":"Evaluating LLM Agents on Automated Software Analysis Tasks","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T16:27:43.489582Z"},"links":{"cited_paper":"/paper/2411.18019","citing_paper":"/paper/2604.11270"},"observation_digest":"sha256:28a54947b108ff66b19333b92f6b67c0e3f376d1e591b5b486e1dbbe11447f38","observation_id":"f9bd4156-3400-4ce0-b5f5-ffdad8f9f162","resolution":{"observed_at":"2026-08-02T16:27:43.489582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.18019/citation-record","integrity":"/paper/2411.18019/integrity","json":"/paper/2411.18019/citation-record.json","paper":"/paper/2411.18019"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.556342Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.556342Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:5ae65ef22eea6a482881935d83ec36e7f9b25b5bf8ad4cdbd371a7953b250c8e","observation_id":"09da401d-680c-41cb-9c88-4677228200fa","resolution":{"observed_at":"2026-08-12T11:39:33.556342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-12T11:39:33.561080Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.561080Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:8085c1bc7f76e4a7ddafebe332ec237294f65bf0a0bf90b7e305ac66025f0697","observation_id":"218b4b6e-83fb-454b-90ab-4f796936a9cd","resolution":{"observed_at":"2026-08-12T11:39:33.561080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.327198Z","title":null,"venue":null,"work_id":"4c783f37-39eb-431f-9bf6-62df91a6ccf7","year":2021},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.565553Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:e56bcd16e0e25da401d76eff07fec6f5c6be9d5d3d295b870bb728af4afb6f2e","observation_id":"ff833103-d0a0-4aef-90a7-92706b999a49","resolution":{"observed_at":"2026-08-12T11:39:34.330935Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-12T11:39:33.569353Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.569353Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:737f894d49da57611abf6629237dd48f04afd7d902acb83ae56675683ee0f02e","observation_id":"7c550b34-48bc-4c13-90f6-7edb3122a433","resolution":{"observed_at":"2026-08-12T11:39:33.569353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.573403Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.573403Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:4f2baed5aca29d6d19405213f531eab4d92ecc04024605743fb70740190c3061","observation_id":"c385cfc2-44c4-4d5b-aa5d-3efc4dc463ad","resolution":{"observed_at":"2026-08-12T11:39:33.573403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.309166Z","title":null,"venue":null,"work_id":"04b74a13-bfb3-4e16-941e-db7649d8e2d5","year":2022},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.577316Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:947868ec0c07d9256dc6a15a41c2db2b957e72b6c9034cbcba9cf58a697b6cdc","observation_id":"f6e0fc25-e88b-492b-a1cc-8fcd40f42907","resolution":{"observed_at":"2026-08-12T11:39:34.312866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03718","last_updated":"2024-06-06T03:29:05Z","snapshot_observed_at":"2026-08-12T23:49:09.720752Z","submitted_at":"2024-06-06T03:29:05Z","title":"Generalization-Enhanced Code Vulnerability Detection via Multi-Task Instruction Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03718","snapshot_observed_at":"2026-08-12T11:39:33.581251Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.581251Z"},"links":{"cited_paper":"/paper/2406.03718","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:1afd4a4508961a2c6dcb96c62077584b4e7cd71a040896b8cf2f36f9bf5aea3b","observation_id":"d36b637b-25cd-40f7-a11c-f28f7f5f6516","resolution":{"observed_at":"2026-08-12T11:39:33.581251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.297933Z","title":null,"venue":null,"work_id":"c9b8d7b4-a17f-4b65-b222-787c9a7a84ab","year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.585128Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:409d8ceba1db19747de2f03445fcb4d6c0b9e7ebda28ddc6b7ca392a22f42023","observation_id":"0e32bc69-8746-42ce-84c1-3048914e325c","resolution":{"observed_at":"2026-08-12T11:39:34.301704Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.588766Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.588766Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:948010e0330079b137c55a28696859b4eca8839d3aae6527c9576e4470e835c9","observation_id":"8993847b-e09b-4c02-a348-b535ba8a88ff","resolution":{"observed_at":"2026-08-12T11:39:33.588766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01940","last_updated":"2024-03-11T08:07:28Z","snapshot_observed_at":"2026-08-13T10:20:24.463337Z","submitted_at":"2023-09-05T04:12:01Z","title":"CodeApex: A Bilingual Programming Evaluation Benchmark for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01940","snapshot_observed_at":"2026-08-12T11:39:33.593222Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.593222Z"},"links":{"cited_paper":"/paper/2309.01940","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:ec0f17bbccab5ebbf2cbf4b11fbedf974972b79e64904e69d0db1c34364a7363","observation_id":"3c90e457-6e5d-4901-8970-c3ae95b5f194","resolution":{"observed_at":"2026-08-12T11:39:33.593222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.712047Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.712047Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:5b480fc55d47d433fc139f47c29b9b11e93dd70d701ff6cf30d9f1522a424cc9","observation_id":"b66db029-2a51-42cc-9860-3601c0dda63f","resolution":{"observed_at":"2026-08-12T11:39:33.712047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.266118Z","title":null,"venue":null,"work_id":"cd1211f9-c98c-4e54-beb1-6c5b6b40daca","year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.719649Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:1a28a18ce26feb411f0051f6a6d6194b5d556662db8777892fc28e2574bd8ff0","observation_id":"603ebf6a-a91d-4a0e-8569-ee18c40581ee","resolution":{"observed_at":"2026-08-12T11:39:34.270351Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.09938","last_updated":"2021-11-08T21:16:44Z","snapshot_observed_at":"2026-08-04T23:13:25.514661Z","submitted_at":"2021-05-20T17:58:42Z","title":"Measuring Coding Challenge Competence With APPS","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.09938","snapshot_observed_at":"2026-08-12T11:39:33.723218Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.723218Z"},"links":{"cited_paper":"/paper/2105.09938","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:2f5ec86162ab51f0a025b4f82ac3f484dab19f078ea4933b58862e8d1af3ffba","observation_id":"f9094f8b-fd9f-4cbd-b51f-8f7bd58ae0bc","resolution":{"observed_at":"2026-08-12T11:39:33.723218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.253798Z","title":null,"venue":null,"work_id":"e385de7c-12f1-4b73-abf5-3007db9acfe6","year":2021},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.727099Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:421dd12f5809edd6528ae42fe4383ca8488b9f1cbe838a1f1c30ec5c6f3099f0","observation_id":"3d4846ff-6186-436e-8bcb-25942094c996","resolution":{"observed_at":"2026-08-12T11:39:34.257902Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.730593Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.730593Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:3bc792ad98261bd1de1f409d49ccbbbf9d296cdb6641c828ebb0845bc9f291e3","observation_id":"f91bd4fa-8d70-4197-8546-c6aa0eb04328","resolution":{"observed_at":"2026-08-12T11:39:33.730593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.233371Z","title":null,"venue":null,"work_id":"9a891f03-3e1a-449a-a59d-e233edb29139","year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.738942Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:e274dacba2bb30459bc29aef01aa439a0123f23c0f56ed27a071a67b04f982de","observation_id":"138d75c1-91f8-4f0e-93b1-dfaa283e39ab","resolution":{"observed_at":"2026-08-12T11:39:34.237292Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-12T14:56:35.025839Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-12T11:39:33.742992Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.742992Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:d567ba73ec97b4b6570fab67c879fe91f04b1a01af03015f4c2f886e9141b256","observation_id":"4e0c54d3-92cd-429a-bede-39ee02206601","resolution":{"observed_at":"2026-08-12T11:39:33.742992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.746615Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.746615Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:e9a99c530e33fc08a1be53286e93512c259d265bcf22023bf3698f8c8ffaca28","observation_id":"3cb517ee-ad6b-48d5-a850-253c1869d346","resolution":{"observed_at":"2026-08-12T11:39:33.746615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.212918Z","title":null,"venue":null,"work_id":"6fa5096e-847e-47bb-952d-bf546605974b","year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.750070Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:c661840fb7922e69e6e4699ee757e9c58718f428cc059a11c96e6bc2c2ecd900","observation_id":"2841977a-9a7e-455b-b836-2c4e3972167a","resolution":{"observed_at":"2026-08-12T11:39:34.216995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14494","last_updated":"2022-10-26T05:40:34Z","snapshot_observed_at":"2026-08-13T13:56:56.807614Z","submitted_at":"2022-10-26T05:40:34Z","title":"CS1QA: A Dataset for Assisting Code-based Question Answering in an Introductory Programming Course","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14494","snapshot_observed_at":"2026-08-12T11:39:33.753114Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.753114Z"},"links":{"cited_paper":"/paper/2210.14494","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:cd176ddb24e57e393482532667eb481124e6e87c92928a60462a86c0014a22ec","observation_id":"7794c252-cdcd-4f02-9bc9-8412265b1c88","resolution":{"observed_at":"2026-08-12T11:39:33.753114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.201087Z","title":null,"venue":null,"work_id":"f1d72f84-63a4-40ae-a503-fda6a301a0e0","year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.756280Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:04b51f6a11d45d0bb7d37eadf02345c20e36d0d59a1e4747eea9dbd3351ccbe3","observation_id":"69294333-50c2-4ef3-b636-1bf4817087f7","resolution":{"observed_at":"2026-08-12T11:39:34.204800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.188775Z","title":null,"venue":null,"work_id":"4112e722-ed37-4e48-960f-1419dfb24acc","year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.759303Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:c91b73a3c839edbcb42f2728060ccc42595bb9a6e609df1ca7f4df552ee00f8d","observation_id":"b4c27d15-aa5c-44db-8fb6-0b7301f71394","resolution":{"observed_at":"2026-08-12T11:39:34.192800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08365","last_updated":"2021-09-17T06:06:38Z","snapshot_observed_at":"2026-08-13T05:58:11.571003Z","submitted_at":"2021-09-17T06:06:38Z","title":"CodeQA: A Question Answering Dataset for Source Code Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08365","snapshot_observed_at":"2026-08-12T11:39:33.762383Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.762383Z"},"links":{"cited_paper":"/paper/2109.08365","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:669f840082f95d03493d310965c364203180d8f38fee0fedb50fd811ecd666f1","observation_id":"33acb935-17d1-4061-8383-46031e2b2343","resolution":{"observed_at":"2026-08-12T11:39:33.762383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02977","last_updated":"2025-12-03T03:33:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-04T15:59:41Z","title":"Large Language Model-Based Agents for Software Engineering: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02977","snapshot_observed_at":"2026-08-12T11:39:33.766173Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.766173Z"},"links":{"cited_paper":"/paper/2409.02977","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:dccee15d76988723af9303f531ebdd81913065c0a5bbe98819702f71c3edd7e8","observation_id":"b18bc12a-fdfd-4b29-9623-ea71967496e3","resolution":{"observed_at":"2026-08-12T11:39:33.766173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00899","last_updated":"2024-09-04T06:19:08Z","snapshot_observed_at":"2026-08-12T22:53:25.616878Z","submitted_at":"2024-09-02T02:24:38Z","title":"MarsCode Agent: AI-native Automated Bug Fixing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00899","snapshot_observed_at":"2026-08-12T11:39:33.769898Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.769898Z"},"links":{"cited_paper":"/paper/2409.00899","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:933a780ba9cd4de896ee5ec1f3c10e41e73c5ca6a606561c27908f0abd0b0696","observation_id":"31f7ff52-f071-4e90-a145-3178924804fd","resolution":{"observed_at":"2026-08-12T11:39:33.769898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01422","last_updated":"2025-03-26T03:26:09Z","snapshot_observed_at":"2026-08-12T23:51:27.922461Z","submitted_at":"2024-06-03T15:20:06Z","title":"Alibaba LingmaAgent: Improving Automated Issue Resolution via Comprehensive Repository Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01422","snapshot_observed_at":"2026-08-12T11:39:33.773884Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.773884Z"},"links":{"cited_paper":"/paper/2406.01422","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:a295acbe7ed9c3fad5bf7c0f5dc2f7c03aabe7d9d1b79ac7aff845c031c4f3ca","observation_id":"b47db412-079e-494d-a814-8a89fa9c97d6","resolution":{"observed_at":"2026-08-12T11:39:33.773884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.778162Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.778162Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:9a69dc99d1a0f6497dde6c49bb392d4c352446a3185a8795fb33d75da9abf5f6","observation_id":"66788ad5-5064-4a54-b1d9-5af72ea5cec7","resolution":{"observed_at":"2026-08-12T11:39:33.778162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.154610Z","title":null,"venue":null,"work_id":"367885ab-2fef-4958-9d5a-c525c671a3d0","year":2022},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.786237Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:074c359f706be99c082a056c580965de7a8a1c5af2cd7500c5a6af2e4f575db9","observation_id":"671f294d-ae94-453c-a163-5aeb427b7e48","resolution":{"observed_at":"2026-08-12T11:39:34.159665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.790435Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.790435Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:3221b23357092c2008ccc990983c13e66ef1b15cbf27124c3a0fe87a9e9147c7","observation_id":"aa3ec18d-c639-4023-9d2c-99dc5375fb90","resolution":{"observed_at":"2026-08-12T11:39:33.790435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.168051Z","title":"In Proceedings of the 54th ACM Technical Symposium on Computer Science Education V","venue":null,"work_id":"91145322-0ef9-42e8-8289-832b89a5d7d4","year":null},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.782273Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:bebc5baff3659ad45f325f75bc72fad85f156463c3b4afdb83f00c84f59bd758","observation_id":"1fdc7f2c-5d5b-4eb1-9228-2795fcff54a8","resolution":{"observed_at":"2026-08-12T11:39:34.172802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06161","snapshot_observed_at":"2026-08-12T11:39:33.797995Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.797995Z"},"links":{"cited_paper":"/paper/2305.06161","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:bf7a5a8dce3dd38799a397e02fa3ada2a7b5bde500ff874c4204a0768b505437","observation_id":"0133477d-ebf4-49d4-b6a6-4910dcec5908","resolution":{"observed_at":"2026-08-12T11:39:33.797995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.802325Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.802325Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:4a588ab7296b621403a9d2fbc9500ab3e270087d2c8c1ddc8425f9351b932816","observation_id":"27c3fe17-275b-4b4e-880c-c764f2c3589b","resolution":{"observed_at":"2026-08-12T11:39:33.802325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16362","last_updated":"2025-02-24T03:23:06Z","snapshot_observed_at":"2026-08-13T00:46:44.854987Z","submitted_at":"2024-03-25T01:58:19Z","title":"AgentFL: Scaling LLM-based Fault Localization to Project-Level Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16362","snapshot_observed_at":"2026-08-12T11:39:33.793973Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.793973Z"},"links":{"cited_paper":"/paper/2403.16362","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:1213b0785782c1da220164e2b4083a712ef4142591a00c64f3c453061e116e0a","observation_id":"f09e517f-a269-43da-a9fa-f52a74cc2dbd","resolution":{"observed_at":"2026-08-12T11:39:33.793973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.114615Z","title":null,"venue":null,"work_id":"76eb8408-8bc1-4c20-9d4b-24f970975edd","year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.810551Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:f17b33bfb7685698545688460e143a1761894dd0ec2664d42bfe38be91b8d689","observation_id":"446a64cd-193c-4482-a7cc-e40d4b44be73","resolution":{"observed_at":"2026-08-12T11:39:34.118431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17927","last_updated":"2024-06-27T12:40:12Z","snapshot_observed_at":"2026-08-13T00:44:27.459975Z","submitted_at":"2024-03-26T17:57:57Z","title":"MAGIS: LLM-Based Multi-Agent Framework for GitHub Issue Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17927","snapshot_observed_at":"2026-08-12T11:39:33.814213Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.814213Z"},"links":{"cited_paper":"/paper/2403.17927","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:09e711905917f8aad8c8c5a1d79fe3e137b7e3632cb3bed0591c00a2b595f367","observation_id":"2f37515f-e2c9-4d98-9dee-2af068903482","resolution":{"observed_at":"2026-08-12T11:39:33.814213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.126902Z","title":null,"venue":null,"work_id":"e273742a-ad2a-4718-9c03-cae864dfe9c1","year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.806747Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:ae5c450f4cdf329d47fa1246baa04fd4a89be32560608e68adae01d454096d41","observation_id":"45ce0934-704d-4f33-9a3a-323af91f0e8d","resolution":{"observed_at":"2026-08-12T11:39:34.130653Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.821566Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.821566Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:b801a7aacdbdd233586fe3fc88b290e31950fa34bcc6d92ed8d8a75826a47adb","observation_id":"496d94a6-a0c0-4c82-a9a9-25c5ece1129e","resolution":{"observed_at":"2026-08-12T11:39:33.821566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01489","last_updated":"2024-10-29T17:29:27Z","snapshot_observed_at":"2026-08-10T19:28:41.964638Z","submitted_at":"2024-07-01T17:24:45Z","title":"Agentless: Demystifying LLM-based Software Engineering Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01489","snapshot_observed_at":"2026-08-12T11:39:33.825804Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.825804Z"},"links":{"cited_paper":"/paper/2407.01489","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:89d3eee455bf7020a7bee3be0561fc6152b791601396f30a6769a8cae4fdd849","observation_id":"51e64f52-0f11-41cc-b9b2-2539d36e359f","resolution":{"observed_at":"2026-08-12T11:39:33.825804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:34.101912Z","title":null,"venue":null,"work_id":"9a9d0120-87da-4452-91ef-b3cde38ae2bc","year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.818246Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:8c2e7b50bd9917a0797afd825e831d0e2233ab3904f0f520519772930f7d1205","observation_id":"a524a3c0-1beb-4cf6-ac80-750ab6937de7","resolution":{"observed_at":"2026-08-12T11:39:34.106655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.834103Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.834103Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:44013053e7a5fc8046f35f6730388600a0e7c241f3aae64942fc2b456588a881","observation_id":"b1235a58-3ac0-4cf2-bb7c-6467c8b9fea3","resolution":{"observed_at":"2026-08-12T11:39:33.834103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05427","last_updated":"2024-07-25T16:54:41Z","snapshot_observed_at":"2026-08-13T00:35:04.496677Z","submitted_at":"2024-04-08T11:55:09Z","title":"AutoCodeRover: Autonomous Program Improvement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05427","snapshot_observed_at":"2026-08-12T11:39:33.837756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.837756Z"},"links":{"cited_paper":"/paper/2404.05427","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:1513fb9be57396e0b3f8b708492bcf0d2d66ee939611d9a9a776d72bfaff0dd0","observation_id":"00923c45-29b0-42ac-85a4-417bf0225f83","resolution":{"observed_at":"2026-08-12T11:39:33.837756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-12T11:39:33.829678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.829678Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:d8242a05e757f3f16a2cb284ac401be8b5d09e564c8276b808825af92187a94e","observation_id":"1be7cee2-c66c-424e-95eb-752600efba8c","resolution":{"observed_at":"2026-08-12T11:39:33.829678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10620","last_updated":"2024-04-10T08:41:22Z","snapshot_observed_at":"2026-08-13T10:30:33.044991Z","submitted_at":"2023-08-21T10:37:49Z","title":"Large Language Models for Software Engineering: A Systematic Literature Review","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10620","snapshot_observed_at":"2026-08-12T11:39:33.734856Z","title":"arXiv preprint arXiv:2308.10620 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.734856Z"},"links":{"cited_paper":"/paper/2308.10620","citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:482e7a123b6a0079cec47209dff8b0069ee05ae55b01b7326923d0dd0d4d4012","observation_id":"5c952517-67fa-4ecd-a0d6-1a4c14c51d23","resolution":{"observed_at":"2026-08-12T11:39:33.734856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:39:33.715985Z","title":"In Proceedings of the 46th IEEE/ACM International Conference on Software Engineering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T11:39:33.715985Z"},"links":{"citing_paper":"/paper/2411.18019"},"observation_digest":"sha256:16641f792cd1546306fe4f8add6d0c846df8acdbac345b5784c9c73dfb981796","observation_id":"24de3a1a-f3f7-46ff-8bf9-9a7ea1c3be3b","resolution":{"observed_at":"2026-08-12T11:39:33.715985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.18019","last_updated":"2024-11-27T03:25:44Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-13T01:21:20.825854Z","submitted_at":"2024-11-27T03:25:44Z","title":"A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 2 inbound Pith citation observations for arXiv:2411.18019."}