{"as_of":"2026-08-10T20:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d6af981d52fa4cd9bd658dd794e1b9c7b1c234210f074aa900b65877c88096d6","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T09:04:06.347354Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:47:01.373765Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06125","snapshot_observed_at":"2026-08-01T12:47:01.373765Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26591","last_updated":"2026-07-29T08:13:12Z","snapshot_observed_at":"2026-08-08T08:31:22.452274Z","submitted_at":"2026-07-29T08:13:12Z","title":"MultiFixer: A Coordinator-Proposer Based Multi-Agent Framework For Fixing Multi-Hunk Bugs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T12:47:01.373765Z"},"links":{"cited_paper":"/paper/2605.06125","citing_paper":"/paper/2607.26591"},"observation_digest":"sha256:e977db4b05ba2a91cb5f7384840b133a71aa12ffe94d702922e4071a193d1c14","observation_id":"549c5b4b-52d0-4b48-9297-33de4b6f62c9","resolution":{"observed_at":"2026-08-01T12:47:01.373765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.06125/citation-record","integrity":"/paper/2605.06125/integrity","json":"/paper/2605.06125/citation-record.json","paper":"/paper/2605.06125"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.02883","last_updated":"2024-12-03T22:38:05Z","snapshot_observed_at":"2026-08-09T14:07:19.465632Z","submitted_at":"2024-12-03T22:38:05Z","title":"TDD-Bench Verified: Can LLMs Generate Tests for Issues Before They Get Resolved?","version":1},"cited_work":{"arxiv_id":"2412.02883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.02883","snapshot_observed_at":"2026-07-05T09:10:52.106373Z","title":"TDD-Bench verified: Can LLMs generate tests for issues before they get resolved?arXiv preprint arXiv:2412.02883","venue":null,"work_id":"b0a18d84-bbf2-47a5-9c44-5e3812f07b46","year":2024},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2412.02883","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:9dc11923946f000ab4b53c60e7d5351f79e71b9d13beb215624768056bf5fa41","observation_id":"c56448ec-fe67-4be4-b095-fed53ac09e85","resolution":{"observed_at":"2026-05-11T20:26:12.022865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12952","last_updated":"2025-02-07T12:33:06Z","snapshot_observed_at":"2026-08-04T01:27:27.027017Z","submitted_at":"2024-06-18T14:54:37Z","title":"SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents","version":3},"cited_work":{"arxiv_id":"2406.12952","doi":"10.48550/arxiv.2406.12952","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.12952","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Code agents are state of the art software testers","venue":"arXiv (Cornell University)","work_id":"f82ce16b-a3f7-49db-81b8-d272759cc9d7","year":2024},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2406.12952","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:c45cf1dd548912e6e6da84f4f1e8da316c7b5770175c0f4aa383112ac7073e8a","observation_id":"0325c06c-79f0-4450-b662-d01a85937647","resolution":{"observed_at":"2026-05-11T20:26:12.077714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-31T23:49:25.878472Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":"2512.02556","doi":"10.18653/v1/d18-1512","metadata_source":"pith","pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","venue":"cs.CL","work_id":"07c85cc5-4086-4abc-823b-6d0f4ff784d0","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:051f39e399bc170476f92d82d766439088e3cb82c0d01b185611abd3156e6c22","observation_id":"95194f36-9e8e-441c-991a-63883f4a566a","resolution":{"observed_at":"2026-05-11T20:26:12.004352Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16941","last_updated":"2025-11-14T22:00:03Z","snapshot_observed_at":"2026-08-10T12:32:55.999823Z","submitted_at":"2025-09-21T06:28:17Z","title":"SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?","version":2},"cited_work":{"arxiv_id":"2509.16941","doi":"10.48550/arxiv.2509.16941","metadata_source":"pith","pith_arxiv_id":"2509.16941","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?","venue":"cs.SE","work_id":"a561c78a-4b02-4053-a92a-bc5c7c5f6b9b","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2509.16941","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:d40ce60ddce9ae0de162a4c9c37f910c5a9391b5b4ce76fb42c87ee7cfc1b0c9","observation_id":"e5097a72-fd71-451d-b850-25b82c93f511","resolution":{"observed_at":"2026-05-12T13:48:53.849224Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:48.977196+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:48.977196+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":"2602.15763","doi":"10.48550/arxiv.2602.15763","metadata_source":"pith","pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","venue":"cs.LG","work_id":"ad29b1a2-bf77-46b3-9ead-fb62b1d2c6fe","year":2026},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:8087bcaf8971b55256cffcf4b690f98fb5517333e333351d4090aba0960764e9","observation_id":"e46be76a-84d0-46be-87f5-0fc62ff52bef","resolution":{"observed_at":"2026-05-11T20:26:12.010118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Just, R., Jalali, D., and Ernst, M","venue":null,"work_id":"3fe6d934-8c7e-428d-9e79-a881c7c11efa","year":2014},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:ff0316ab2ebf5d67cfd500ae8d6dbade64feef8b9e8f55c6909d3bbb26f5a948","observation_id":"36d55959-6cc0-4892-bcbb-70d17e6c3419","resolution":{"observed_at":"2026-05-26T16:28:03.244773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":"2602.02276","doi":"10.48550/arxiv.2602.02276","metadata_source":"pith","pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi K2.5: Visual Agentic Intelligence","venue":"cs.CL","work_id":"d690be8f-5d53-49b0-b1e7-79668eb8fcdb","year":2026},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:aa42d5113fa1bcdc484727ccb2bcc3f723f358c02e55c24c7aa736ccba2a46ec","observation_id":"c58597ae-8aeb-4413-b338-28b08539beb4","resolution":{"observed_at":"2026-05-11T20:26:11.984427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-07T20:38:24.673777+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T20:38:24.673777+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:5749e42360e2b1a8618c05c548769ca1a3ad2ff08caede74790e42b0e4c91c7c","observation_id":"9ce0dc4d-c8a0-457e-9668-a9a46654f7be","resolution":{"observed_at":"2026-05-11T20:26:12.040198Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.18470","last_updated":"2026-04-04T09:52:04Z","snapshot_observed_at":"2026-07-30T13:30:43.108201Z","submitted_at":"2025-12-20T19:08:15Z","title":"SWE-EVO: Benchmarking Coding Agents in Long-Horizon Software Evolution Scenarios","version":5},"cited_work":{"arxiv_id":"2512.18470","doi":"10.48550/arxiv.2512.18470","metadata_source":"pith","pith_arxiv_id":"2512.18470","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"SWE-EVO: Benchmarking Coding Agents in Long-Horizon Software Evolution Scenarios","venue":"cs.SE","work_id":"4dc0b41e-24de-4bd4-8e7d-9dccefa116f8","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2512.18470","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:01f47b2322c6a3eddd180e1b448c8c348580773c363873ced54d1459975aec91","observation_id":"db750414-5a0e-476d-8032-6b5f0586f0f6","resolution":{"observed_at":"2026-05-11T20:26:12.030598Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:38:06.868017+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T06:38:06.868017+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01602","last_updated":"2024-01-03T08:13:55Z","snapshot_observed_at":"2026-08-03T19:49:58.167664Z","submitted_at":"2024-01-03T08:13:55Z","title":"Exotic Topological Phenomena in Chiral Superconducting States on Doped Quantum Spin Hall Insulators with Honeycomb Lattices","version":1},"cited_work":{"arxiv_id":"2401.01602","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.01602","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"R., and Ma, L","venue":null,"work_id":"f187e6aa-c5e7-4110-ab49-47b6787037e3","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2401.01602","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:eff3b5645655050e3d730f99de3f8435628c525e119c9d704d34b08a92620a31","observation_id":"911de558-d813-44b2-9a25-b6b6c46b441b","resolution":{"observed_at":"2026-05-11T20:26:11.976093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04966","last_updated":"2025-07-15T03:52:37Z","snapshot_observed_at":"2026-08-10T04:40:34.577511Z","submitted_at":"2024-04-07T14:08:28Z","title":"Advancing Code Coverage: Incorporating Program Analysis with Large Language Models","version":2},"cited_work":{"arxiv_id":"2404.04966","doi":"10.48550/arxiv.2404.04966","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.04966","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enhancing llm-based test generation for hard-to-cover branches via program analysis.CoRR, abs/2404.04966","venue":"arXiv (Cornell University)","work_id":"76a2a410-21bc-4d13-8c7d-3d47837eccd1","year":2024},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2404.04966","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:eca552e559924e5a92086154993836f56e04248483dc305ff704104680020cc4","observation_id":"2ae7aeed-dde3-43fc-ad02-536464b3ff4d","resolution":{"observed_at":"2026-05-11T20:26:11.944425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.24419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unit test up- date through LLM-driven context collection and error- type-aware refinement.arXiv preprint arXiv:2509.24419","venue":null,"work_id":"3b49ec94-df1a-40d6-92e2-ef32fe54550b","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:382f82e3ff15439bc44431329c6ccdf90de201ef71e0c41d7dc63c26677aa594","observation_id":"caa121fa-d441-4354-8d44-8ccb4580c19a","resolution":{"observed_at":"2026-05-11T20:26:11.962909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":9,"verified_fuzzy":1},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 1 inbound Pith citation observation for arXiv:2605.06125."}