{"as_of":"2026-08-09T11:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0c3dc57781f7276f1da814fa9a6d6fff6c5f0f5e4a937eb311be8623563fbbc1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:51:15.447817Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-24T03:58:51.426007Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.04811","last_updated":"2024-03-06T21:45:35Z","snapshot_observed_at":"2026-08-09T02:53:12.730289Z","submitted_at":"2024-03-06T21:45:35Z","title":"Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models","version":1},"cited_work":{"arxiv_id":"2403.04811","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.04811","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Riddell, A","venue":null,"work_id":"dfa09cb0-de50-4181-ba62-a4b76eb83b30","year":2024},"citing_paper":{"arxiv_id":"2402.01411","last_updated":"2026-05-19T14:24:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T13:42:50Z","title":"CodePori: Large-Scale System for Autonomous Software Development Using Multi-Agent Technology","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-24T03:58:32.556725Z"},"links":{"cited_paper":"/paper/2403.04811","citing_paper":"/paper/2402.01411"},"observation_digest":"sha256:c61e11cc2f5d728bf22e74109c974d7fdd2fc34b8c0b78770d5a6051ee12e19a","observation_id":"e6f1f4cd-6cce-4c4d-96dc-d25fe12355c9","resolution":{"observed_at":"2026-05-24T03:58:51.430188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04811","last_updated":"2024-03-06T21:45:35Z","snapshot_observed_at":"2026-08-09T02:53:12.730289Z","submitted_at":"2024-03-06T21:45:35Z","title":"Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models","version":1},"cited_work":{"arxiv_id":"2403.04811","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.04811","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Riddell, A","venue":null,"work_id":"dfa09cb0-de50-4181-ba62-a4b76eb83b30","year":2024},"citing_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"reference_index":296,"source":"arxiv_source","source_observed_at":"2026-05-10T17:34:42.565806Z"},"links":{"cited_paper":"/paper/2403.04811","citing_paper":"/paper/2403.07974"},"observation_digest":"sha256:c3d579f96fd20dddb3dd890054f26f57f3621e5fcdc4cea033d4a64b4d27715d","observation_id":"de7fd108-d787-4f08-b9ae-23d2f10b00aa","resolution":{"observed_at":"2026-05-10T17:34:42.983778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04811","last_updated":"2024-03-06T21:45:35Z","snapshot_observed_at":"2026-08-09T02:53:12.730289Z","submitted_at":"2024-03-06T21:45:35Z","title":"Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models","version":1},"cited_work":{"arxiv_id":"2403.04811","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.04811","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Riddell, A","venue":null,"work_id":"dfa09cb0-de50-4181-ba62-a4b76eb83b30","year":2024},"citing_paper":{"arxiv_id":"2406.04244","last_updated":"2024-06-06T16:41:39Z","snapshot_observed_at":"2026-07-30T15:43:06.151242Z","submitted_at":"2024-06-06T16:41:39Z","title":"Benchmark Data Contamination of Large Language Models: A Survey","version":1},"reference_index":124,"source":"pdf_text","source_observed_at":"2026-05-22T23:10:40.420241Z"},"links":{"cited_paper":"/paper/2403.04811","citing_paper":"/paper/2406.04244"},"observation_digest":"sha256:6fff0c065898bfe324d4f23fe75fb879943e37c5187e1dbdadf368c2ef7570c5","observation_id":"1157a8e4-8ecf-459f-96d5-870723109ae5","resolution":{"observed_at":"2026-05-22T23:10:41.061069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04811","last_updated":"2024-03-06T21:45:35Z","snapshot_observed_at":"2026-08-09T02:53:12.730289Z","submitted_at":"2024-03-06T21:45:35Z","title":"Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04811","snapshot_observed_at":"2026-08-08T14:51:15.447817Z","title":"Riddell, M., Ni, A., and Cohan, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06655","last_updated":"2025-05-12T14:34:05Z","snapshot_observed_at":"2026-08-09T03:53:29.137552Z","submitted_at":"2025-02-10T16:45:18Z","title":"Unbiased Evaluation of Large Language Models from a Causal Perspective","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T14:51:15.447817Z"},"links":{"cited_paper":"/paper/2403.04811","citing_paper":"/paper/2502.06655"},"observation_digest":"sha256:921631e1813198aae613aa0f10b399a42efeb3b4f29dae91b7f37dc8827cf99f","observation_id":"9ce1ddb3-57b9-482a-9d4c-84c632a00216","resolution":{"observed_at":"2026-08-08T14:51:15.447817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04811","last_updated":"2024-03-06T21:45:35Z","snapshot_observed_at":"2026-08-09T02:53:12.730289Z","submitted_at":"2024-03-06T21:45:35Z","title":"Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04811","snapshot_observed_at":"2026-08-06T22:03:28.728894Z","title":"Riddell, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22954","last_updated":"2025-06-28T17:18:23Z","snapshot_observed_at":"2026-08-07T05:17:48.616344Z","submitted_at":"2025-06-28T17:18:23Z","title":"Evaluating and Improving Large Language Models for Competitive Program Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:03:28.728894Z"},"links":{"cited_paper":"/paper/2403.04811","citing_paper":"/paper/2506.22954"},"observation_digest":"sha256:4d66cf4ee69be12e2a1850ee9c0ec2372a6372d123e089190d7f5346410927d2","observation_id":"f1bda1d8-c08a-4c9a-8336-4ee241f96f24","resolution":{"observed_at":"2026-08-06T22:03:28.728894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04811","last_updated":"2024-03-06T21:45:35Z","snapshot_observed_at":"2026-08-09T02:53:12.730289Z","submitted_at":"2024-03-06T21:45:35Z","title":"Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models","version":1},"cited_work":{"arxiv_id":"2403.04811","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.04811","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Riddell, A","venue":null,"work_id":"dfa09cb0-de50-4181-ba62-a4b76eb83b30","year":2024},"citing_paper":{"arxiv_id":"2605.21615","last_updated":"2026-05-20T18:23:17Z","snapshot_observed_at":"2026-07-06T23:32:01.202542Z","submitted_at":"2026-05-20T18:23:17Z","title":"ASSEMBLAGE-DEEPHISTORY: A Cross-Build Binary Dataset with Temporal Coverage","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-22T09:40:21.746161Z"},"links":{"cited_paper":"/paper/2403.04811","citing_paper":"/paper/2605.21615"},"observation_digest":"sha256:04a117c3fd69c9c8fcbeca99c9b681506b8f857791dfecd60b64c4c1c99bb2a5","observation_id":"e9c87746-5f6a-4225-bef9-7885130ba5eb","resolution":{"observed_at":"2026-05-22T09:41:21.760426Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04811","last_updated":"2024-03-06T21:45:35Z","snapshot_observed_at":"2026-08-09T02:53:12.730289Z","submitted_at":"2024-03-06T21:45:35Z","title":"Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04811","snapshot_observed_at":"2026-08-08T04:31:04.391835Z","title":"Manley Roberts, Himanshu Thakur, Christine Herlihy, Colin White, and Samuel Dooley","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02985","last_updated":"2026-08-04T00:45:54Z","snapshot_observed_at":"2026-08-09T03:46:38.259856Z","submitted_at":"2026-08-04T00:45:54Z","title":"Temporal Leakage in LLM Backtesting: Measurement, Validation, and Adjusted Scores","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T04:31:04.391835Z"},"links":{"cited_paper":"/paper/2403.04811","citing_paper":"/paper/2608.02985"},"observation_digest":"sha256:ec0e6de50f6869fb4c897a8875f560ba504b2c1fca8708ee94b4215af194655a","observation_id":"765eb102-f051-4d11-bad6-a9e8a45ace8c","resolution":{"observed_at":"2026-08-08T04:31:04.391835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.04811/citation-record","integrity":"/paper/2403.04811/integrity","json":"/paper/2403.04811/citation-record.json","paper":"/paper/2403.04811"},"outbound":[],"paper":{"arxiv_id":"2403.04811","last_updated":"2024-03-06T21:45:35Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-09T02:53:12.730289Z","submitted_at":"2024-03-06T21:45:35Z","title":"Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2403.04811."}