{"as_of":"2026-08-21T02:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:67259c0a8f5a1756f79a37621e5e88cf29522064a7c3d1557775b7d607b45b33","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:12:27.279857Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.22086/citation-record","integrity":"/paper/2507.22086/integrity","json":"/paper/2507.22086/citation-record.json","paper":"/paper/2507.22086"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T13:12:25.144642Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.144642Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:b19fa3472aaa3dbd39adfd63400ed4eefd26ff65654231e7f061d0ccf01aa528","observation_id":"8522e1f7-83b8-4382-8ada-484bc2d8e6fa","resolution":{"observed_at":"2026-08-06T13:12:25.144642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T13:12:25.587220Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.587220Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:687d685eeedf0d2cac39e89ba95242585492bbe12dfc9653125d441ae14f4a54","observation_id":"ec4ecc15-ae91-4602-96e3-e0e07251f99c","resolution":{"observed_at":"2026-08-06T13:12:25.587220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:29.156380Z","title":"J., Bird, C., Barr, E","venue":null,"work_id":"a2f67c1c-4752-4d54-8fc4-87dabf84777d","year":2018},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.670459Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:94c98ad164f33691a9bbcf0761da42f344e67bd7b30d88a8641398bdf06f0586","observation_id":"a2053efd-16bd-41ca-9a2e-829bd07f44ba","resolution":{"observed_at":"2026-08-06T13:12:29.306879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T13:12:25.896581Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.896581Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:7e52f74ef3a1145268c73e8a44a6570049a0055fe7c969f60374bea0bf265a54","observation_id":"313ae3af-7d69-4a9a-991c-b8d67e535382","resolution":{"observed_at":"2026-08-06T13:12:25.896581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.684207Z","title":null,"venue":null,"work_id":"9fe6d6a3-579e-4252-abc3-b09b6c8c84dd","year":2023},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.149430Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:cac6768174977ae37cec4bd1fd0a954843e8645f4db6831336aef3d1f2df67cc","observation_id":"3d0ffcb1-2cfd-4476-a5c5-b2a92334c48d","resolution":{"observed_at":"2026-08-06T13:12:28.816108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.439258Z","title":"P., Sabu, S., Wang, J., M","venue":null,"work_id":"b4801ed1-1765-48c5-82c0-9a097ccab981","year":2024},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.369220Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:1324f686ba6db254ca56a01ba2d4d95464612617e482ae03c42684b63e4d0871","observation_id":"62677a37-6445-43a2-a151-546f381c4141","resolution":{"observed_at":"2026-08-06T13:12:28.579917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:26.467618Z","title":"Repotrans- bench: A real-world benchmark for repository-level code translation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.467618Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:127009d81648f8bd7d69ac56b3a1bad93f5da61e1f71782033832aa5f086e73b","observation_id":"b9adfcaf-32a1-4c59-8e7d-4503dcc2fa11","resolution":{"observed_at":"2026-08-06T13:12:26.467618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T13:12:26.605674Z","title":"Yang, A., Yang, B., Zhang, B., Hui, B., Zheng, B., Yu, B., Li, C., Liu, D., Huang, F., Wei, H., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.605674Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:b578bf3560773bb45547e6a54b7240b5677b306681908466defbdfa86d7ac627","observation_id":"8addf16b-77ef-4ab1-8250-d51afb7b2ac5","resolution":{"observed_at":"2026-08-06T13:12:26.605674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15877","last_updated":"2025-04-01T08:36:44Z","snapshot_observed_at":"2026-08-14T15:45:30.011625Z","submitted_at":"2024-06-22T15:52:04Z","title":"BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15877","snapshot_observed_at":"2026-08-06T13:12:26.731265Z","title":"Y ., Vu, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.731265Z"},"links":{"cited_paper":"/paper/2406.15877","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:1f5a2c5f3fb288afa127c075a04b646059d7844baa259b13f7f2df8b2bf99b48","observation_id":"d619baaa-5ab7-4ab6-94c7-115876ba40bb","resolution":{"observed_at":"2026-08-06T13:12:26.731265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.267783Z","title":null,"venue":null,"work_id":"c7f955d3-5dfb-4d85-800a-0dacd5570e2f","year":2024},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.835649Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:93c1ad3ff2f1bcd21d98c0a8213daffedbca9888a9c5f42f4ca2ae9cde027d9e","observation_id":"0f4ab164-89c7-4161-bd98-8b34d370b2b0","resolution":{"observed_at":"2026-08-06T13:12:28.329334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.159502Z","title":"The test sets are further split into two test1 and test2 based on the date created to test the data contamination issue","venue":null,"work_id":"dcc82b13-20c4-447e-a31a-57f18bddd817","year":2014},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.928560Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:4aea6d21bf4c368b6dadd978c8afc9c621c80f0c96e56b8168f25967ef5630fc","observation_id":"c42e22cd-197f-4ada-9a83-c266a5426851","resolution":{"observed_at":"2026-08-06T13:12:28.216862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.055837Z","title":null,"venue":null,"work_id":"8b31740f-9347-49c8-8d3f-512b6daf4b53","year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:27.069811Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:83550b0c58e10d7236191ca394e0fe3c110f3944864e0b837d49f94cc69f258e","observation_id":"8ceb5ea3-078b-43e0-b82f-5fee4bfd689f","resolution":{"observed_at":"2026-08-06T13:12:28.100105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:27.984559Z","title":null,"venue":null,"work_id":"f66cbb19-a9f0-4d78-ae7f-f540ae5efc4c","year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:27.204923Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:74cc4e37c5d529e689bd0f803f6ea47307ff7cac97effa4c50234e105af0c56a","observation_id":"ff0cbb13-768b-4a6b-aba0-9004afde136c","resolution":{"observed_at":"2026-08-06T13:12:28.020057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:27.776774Z","title":null,"venue":null,"work_id":"e6f44a70-fbd9-49db-abfa-fb3e076f7063","year":2008},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:27.279857Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:28adac75c43e75ce569b9f48543a097060834deee697bf6e8273205dfc2c05ef","observation_id":"02b0cae8-38ac-489e-be96-ef4b0d8276e4","resolution":{"observed_at":"2026-08-06T13:12:27.881031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10628","last_updated":"2023-10-16T17:51:29Z","snapshot_observed_at":"2026-08-16T14:51:40.042976Z","submitted_at":"2023-10-16T17:51:29Z","title":"Data Contamination Through the Lens of Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10628","snapshot_observed_at":"2026-08-06T13:12:26.242662Z","title":"Data contamination through the lens of time","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.242662Z"},"links":{"cited_paper":"/paper/2310.10628","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:e1a4b3f66a5abc2ba1507cf671d4539338a567fe5007cbd1e470882527ae5aa0","observation_id":"f51def23-a51e-4190-9756-42c279a66d77","resolution":{"observed_at":"2026-08-06T13:12:26.242662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-16T07:05:57.323612Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-06T13:12:25.780029Z","title":"Monkeytype: A python library that generates static type annotations by collecting run- time types","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.780029Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:9d125672dabcf8efa45c0c80092cbae2c7ad2fd9477cf500caaefd3c4cd3b178","observation_id":"b3b83ac6-b9a9-4554-aea3-49dd60cbc2dc","resolution":{"observed_at":"2026-08-06T13:12:25.780029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:28.920271Z","title":"Pyright: Static type checker for python","venue":null,"work_id":"bd754a5a-c326-444d-a4ff-57de7e506ac2","year":2021},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:26.036090Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:42de05c13c26ace92db3ac07dbc615b9b0af425fcaa7bf993a929d354e7cf1e2","observation_id":"46b94a5b-c9e8-470f-bb59-88695b3faaf7","resolution":{"observed_at":"2026-08-06T13:12:29.042908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13161","last_updated":"2024-06-19T02:29:59Z","snapshot_observed_at":"2026-08-16T17:36:22.761951Z","submitted_at":"2024-06-19T02:29:59Z","title":"APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts","version":1},"cited_work":{"arxiv_id":"2406.13161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13161","snapshot_observed_at":"2026-08-06T13:12:27.552196Z","title":"APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts","venue":"cs.AI","work_id":"3561f8c4-1bfb-4968-93f4-58a4b7bec2e9","year":2024},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.496645Z"},"links":{"cited_paper":"/paper/2406.13161","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:1ef510cc331eb515b61df81baa75fc6838362caef4c593975f75a0f64d62cc3d","observation_id":"624e43b7-e775-4632-adfb-fece35d6f95d","resolution":{"observed_at":"2026-08-06T13:12:27.644129Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-06T13:12:25.366886Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.366886Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:5ee87ddc63f272f8f7a876d02b692ce09848a5a7936afdb41d85a0f2694d837e","observation_id":"bf30dcd8-a15b-4e87-95b2-92f1631972fc","resolution":{"observed_at":"2026-08-06T13:12:25.366886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:12:29.433445Z","title":"Brown, T., Mann, B., Ryder, N., Subbiah, M., Kaplan, J","venue":null,"work_id":"b46b804e-59e0-44fb-b7cc-572ad9617466","year":1901},"citing_paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T13:12:25.258861Z"},"links":{"citing_paper":"/paper/2507.22086"},"observation_digest":"sha256:74321fae89b26cd08ae77da8e38f5dcd704ca9288d32d3c49ba28b009f62b17e","observation_id":"eb5268bc-b9bb-43a4-894c-7d6bd9650e62","resolution":{"observed_at":"2026-08-06T13:12:29.540548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.22086","last_updated":"2025-07-28T14:54:00Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-14T15:46:15.467450Z","submitted_at":"2025-07-28T14:54:00Z","title":"TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2507.22086."}