{"as_of":"2026-08-10T09:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:915bdc13e1221df5acf22febb5925817a0aa52d945319fe4bbbb03b9895893d6","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:49:58.363965Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:43:23.450401Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T02:19:23.892865Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":"2509.09614","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-07-04T02:19:23.892865Z","title":"LocoBench: A benchmark for long-context large language models in complex software engineering","venue":null,"work_id":"df13cfae-c50e-48ae-a33e-f00fe04051c8","year":2025},"citing_paper":{"arxiv_id":"2605.06184","last_updated":"2026-05-07T13:01:06Z","snapshot_observed_at":"2026-08-08T18:04:17.889207Z","submitted_at":"2026-05-07T13:01:06Z","title":"Teaching LLMs Program Semantics via Symbolic Execution Traces","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T08:56:25.022619Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2605.06184"},"observation_digest":"sha256:ae57832b9618f2f9d7ad52b6b8d47a4554dca7d592b17c7674448cdcf9674032","observation_id":"36ac7432-fe0d-4fc0-ae88-941abf859042","resolution":{"observed_at":"2026-05-11T20:26:13.431111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":"2509.09614","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-07-04T02:19:23.892865Z","title":"LocoBench: A benchmark for long-context large language models in complex software engineering","venue":null,"work_id":"df13cfae-c50e-48ae-a33e-f00fe04051c8","year":2025},"citing_paper":{"arxiv_id":"2605.29790","last_updated":"2026-05-28T11:40:16Z","snapshot_observed_at":"2026-08-06T19:17:26.541233Z","submitted_at":"2026-05-28T11:40:16Z","title":"Evolve as a Team: Collaborative Self-Evolution for LLM-based Multi-Agent Systems","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T00:05:31.780655Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2605.29790"},"observation_digest":"sha256:3537a2a7313250c46dafd3ca572640048798a24e6805cf15dcd58384c1849dd5","observation_id":"2f3bccff-abd0-4bfc-8f9e-235cc02ea999","resolution":{"observed_at":"2026-06-29T00:12:50.100767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":"2509.09614","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-07-04T02:19:23.892865Z","title":"LocoBench: A benchmark for long-context large language models in complex software engineering","venue":null,"work_id":"df13cfae-c50e-48ae-a33e-f00fe04051c8","year":2025},"citing_paper":{"arxiv_id":"2606.19613","last_updated":"2026-06-17T21:36:09Z","snapshot_observed_at":"2026-08-07T13:16:30.354063Z","submitted_at":"2026-06-17T21:36:09Z","title":"StaminaBench: Stress-Testing Coding Agents over 100 Interaction Turns","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T19:47:59.090249Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2606.19613"},"observation_digest":"sha256:2a6389c434a38e90ca4db2ca8c2d76911b298bf035851eb6d58b489733bb7c42","observation_id":"50d8dcb4-9a02-4d1b-9532-237f5fc10dd5","resolution":{"observed_at":"2026-07-04T02:19:23.894455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":"2509.09614","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-07-04T02:19:23.892865Z","title":"LocoBench: A benchmark for long-context large language models in complex software engineering","venue":null,"work_id":"df13cfae-c50e-48ae-a33e-f00fe04051c8","year":2025},"citing_paper":{"arxiv_id":"2606.20607","last_updated":"2026-05-21T23:35:15Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-21T23:35:15Z","title":"LLM4CAD-Editor: An Intent-Aware Large Language Model Framework for Multi-Level Computer-Aided Design Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T15:33:46.125268Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2606.20607"},"observation_digest":"sha256:46ef7e017faaeb74d9227728b6a71d1bd134e16c671e47ddda5cea414f7b146c","observation_id":"33cea02d-7582-4710-bc45-154befe7621f","resolution":{"observed_at":"2026-06-30T15:34:47.857778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-08-06T16:45:20.185074Z","title":"arXiv preprint (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04783","last_updated":"2026-08-06T09:16:21Z","snapshot_observed_at":"2026-08-10T05:43:05.331687Z","submitted_at":"2026-08-05T12:49:36Z","title":"RepoProbe: Benchmarking Architecture-Aware Repository Comprehension with Checklists","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.185074Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2608.04783"},"observation_digest":"sha256:4fc83a4bfe060350f12677dd9bda88f56f8d7b96b58b296d1e933a035e63c036","observation_id":"0533a6b0-74ee-4240-9432-ce915d1fde6d","resolution":{"observed_at":"2026-08-06T16:45:20.185074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09614","snapshot_observed_at":"2026-08-08T17:43:23.450401Z","title":"arXiv preprint (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04783","last_updated":"2026-08-06T09:16:21Z","snapshot_observed_at":"2026-08-10T05:43:05.331687Z","submitted_at":"2026-08-05T12:49:36Z","title":"RepoProbe: Benchmarking Architecture-Aware Repository Comprehension with Checklists","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T17:43:23.450401Z"},"links":{"cited_paper":"/paper/2509.09614","citing_paper":"/paper/2608.04783"},"observation_digest":"sha256:4e9aae69db4f52c8d1fb9ffcb867622d6bb128f190dab84a39721b8a7b85aa39","observation_id":"766a219c-b512-493a-88dd-24965e3e3de0","resolution":{"observed_at":"2026-08-08T17:43:23.450401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.09614/citation-record","integrity":"/paper/2509.09614/integrity","json":"/paper/2509.09614/citation-record.json","paper":"/paper/2509.09614"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.338747Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.338747Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:190af7b411356c47b4a0d6682374e6b84e25cc030616653144124fb762a05021","observation_id":"31972309-3f8b-451f-95fb-dd90fe48eaf4","resolution":{"observed_at":"2026-08-04T18:49:58.338747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.341602Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.341602Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:e6d1a82bf9ffef4c1d7a7b7199a55a754e1111301df23d013f1153d9a45a56ac","observation_id":"ea22d1db-4028-4a29-bc75-6c222f76bd34","resolution":{"observed_at":"2026-08-04T18:49:58.341602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.332193Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.332193Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:7b841fbb4dd610fd1466bac4086141c1a0a8d789c1780c33269550455a7bd384","observation_id":"5820baf9-d8c7-448a-bdda-ba8a5989d429","resolution":{"observed_at":"2026-08-04T18:49:58.332193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.335170Z","title":"\"\" def __init__(self): self._subscribers = \\{\\} self._async_subscribers = \\{\\} def subscribe(self, event_type: Type[Event], handler: EventHandler):","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.335170Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:8a5601559e994ab7075deb4b6612db68f822dcef8b3f68f293ad7523dfae5dc6","observation_id":"87554561-0d91-41dc-89d0-91cf9cc53b0a","resolution":{"observed_at":"2026-08-04T18:49:58.335170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.319394Z","title":"APPS provides 10,000 problems from coding compe- titions, while LiveCodeBench offers contamination-free evaluation with problems collected from ongoing contests","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.319394Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:ad554249d8238dd5b78633292419307bc233487fd092abb5044f8e64964a31b8","observation_id":"32b045b8-b3fb-44f7-a6e1-c607363c9379","resolution":{"observed_at":"2026-08-04T18:49:58.319394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.322473Z","title":"While domain-specific, these benchmarks still primarily evaluate isolated function or script generation rather than comprehensive software development capabilities","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.322473Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:d501d030a94aa345a549986e678e1f8ebe3ac43932319142e352f44d1acede27","observation_id":"a814b9c7-4c01-4532-b0ef-41260f5112be","resolution":{"observed_at":"2026-08-04T18:49:58.322473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.325923Z","title":"LongICLBench (An et al., 2024) evaluates in-context learning capabilities at extreme lengths, while LongAlign (Bai et al., 2024a) addresses instruction following in long contexts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.325923Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:c3f0f39ab651279fc99269fd143afecff730a72e4e5015936e44b54f33668218","observation_id":"2dba29e3-50f2-41fb-a81f-770d684cb2e8","resolution":{"observed_at":"2026-08-04T18:49:58.325923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.344904Z","title":"id\": \"java_api_graphql_easy_007_feature_implementation_expert_01","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.344904Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:94db9703fe4b6efefa0c191983f8c1efce6f2cc1f057c791795943277ea3530e","observation_id":"02347c3b-1dad-466a-af39-59e4d75759cf","resolution":{"observed_at":"2026-08-04T18:49:58.344904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.348184Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.348184Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:646c80d4fa6fb921f6a5a2cfc72f6f8ba4e5981d6b7f1ceb07fab245a26afea8","observation_id":"94a9b891-e205-4e93-bcad-286cc5e62bfd","resolution":{"observed_at":"2026-08-04T18:49:58.348184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.351595Z","title":"GPT-4o\": \\{","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.351595Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:d9e071097fbfa5ba676fa9ae2fe97c82fae466c55d61e8511f01440e950c66ee","observation_id":"8b2af64e-2b9a-4db6-ad1c-6a30f3bfe3a3","resolution":{"observed_at":"2026-08-04T18:49:58.351595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.354651Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.354651Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:d33f35ef2dba44310a122e19551fc366b7f185548ee722ee1a5d6c7e48a0a853","observation_id":"1152389c-f47e-45c2-a503-f4d0739036f1","resolution":{"observed_at":"2026-08-04T18:49:58.354651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.357809Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.357809Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:2398136716037fe8ebd9e937e73e2350fc2a68400dc52327556f1f3891aefce1","observation_id":"8f7081cd-3520-40e3-ba44-29964d933cec","resolution":{"observed_at":"2026-08-04T18:49:58.357809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.360736Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.360736Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:88b0669e207ff328e3df8a5d0ec2569c88f3a2fa3daf44bb5a716254ae219956","observation_id":"d67603e4-9bd2-453f-81cd-f1b033d84f20","resolution":{"observed_at":"2026-08-04T18:49:58.360736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.363965Z","title":"approach","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.363965Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:58f0b36c0efd6d6da6e7f68ecd67261c72b21c31bfd6285b7be09b3b55a0dd48","observation_id":"a832a7d4-8487-4c5c-9768-2933db128c07","resolution":{"observed_at":"2026-08-04T18:49:58.363965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02060","last_updated":"2024-06-12T02:46:16Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T15:59:11Z","title":"Long-context LLMs Struggle with Long In-context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02060","snapshot_observed_at":"2026-08-04T18:49:58.304178Z","title":"Zetian An, Chanakya Chen, Weiyan Zheng, Hendrik Geissler, Yiyang Qian, Peiyi Wang, Shuohang Chen, Tianyu Wang, Zhenguo Wu, and William Yang Wang","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.304178Z"},"links":{"cited_paper":"/paper/2404.02060","citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:68168a27d2975f568e6eb51c035a2f08dfd21a30fca25b0bd9c126fd38741a1a","observation_id":"82bdb0c9-8baf-4baf-a895-7bfd9ded53c8","resolution":{"observed_at":"2026-08-04T18:49:58.304178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13474","last_updated":"2023-02-27T21:26:48Z","snapshot_observed_at":"2026-07-06T12:52:16.992962Z","submitted_at":"2022-03-25T06:55:15Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13474","snapshot_observed_at":"2026-08-04T18:49:58.308701Z","title":"InarXiv preprint arXiv:2203.13474","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.308701Z"},"links":{"cited_paper":"/paper/2203.13474","citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:b398c4f9fd4731ae6857733e490f28d0978710ccbf5f5f96764a20f4bca56761","observation_id":"3ebd0d67-0c64-4c58-b5c5-3616d57863e9","resolution":{"observed_at":"2026-08-04T18:49:58.308701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10007","last_updated":"2023-05-24T06:56:45Z","snapshot_observed_at":"2026-08-08T15:03:11.388057Z","submitted_at":"2022-12-20T05:48:09Z","title":"CoCoMIC: Code Completion By Jointly Modeling In-file and Cross-file Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10007","snapshot_observed_at":"2026-08-04T18:49:58.312286Z","title":"InIEEE/ACM International Conference on Computer-Aided Design","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.312286Z"},"links":{"cited_paper":"/paper/2212.10007","citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:2ef2f37c6045d2f198764000dc928ab3659c80ac652e10f132857dc344448e5c","observation_id":"ae4eccc4-520f-40c7-9b76-c1efa36ec6dc","resolution":{"observed_at":"2026-08-04T18:49:58.312286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15296","last_updated":"2024-08-27T10:51:51Z","snapshot_observed_at":"2026-07-06T19:06:45.969497Z","submitted_at":"2024-08-27T10:51:51Z","title":"Feature Representations for Automatic Meerkat Vocalization Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15296","snapshot_observed_at":"2026-08-04T18:49:58.315651Z","title":"InarXiv preprint arXiv:2408.15296","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.315651Z"},"links":{"cited_paper":"/paper/2408.15296","citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:fd53c6edf30bddc5aafaab61f2e6931ce7ff3e616d4f75d39b7a820dafaf7902","observation_id":"5420b973-b513-4a44-9930-615871ecb629","resolution":{"observed_at":"2026-08-04T18:49:58.315651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:49:58.328653Z","title":"unique_id","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:58.328653Z"},"links":{"citing_paper":"/paper/2509.09614"},"observation_digest":"sha256:881744b28ca28c823cd74f9c07dba833587324607b61765a73ebc69cfe2f1065","observation_id":"afe80bab-3d70-478d-92a0-7d3725f73b08","resolution":{"observed_at":"2026-08-04T18:49:58.328653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09614","last_updated":"2025-09-11T16:55:04Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-05T13:16:19.308984Z","submitted_at":"2025-09-11T16:55:04Z","title":"LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 6 inbound Pith citation observations for arXiv:2509.09614."}