{"as_of":"2026-08-15T16:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c6d75febc727e2b5d175373bcd2736d6146f44d97e182d22255b08d5c1f50b8b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":29,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:33:13.132899Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-12T14:33:13.132899Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15114","last_updated":"2025-05-27T03:32:23Z","snapshot_observed_at":"2026-08-12T16:49:37.896696Z","submitted_at":"2024-11-22T18:30:46Z","title":"RE-Bench: Evaluating frontier AI R&D capabilities of language model agents against human experts","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T14:33:13.132899Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2411.15114"},"observation_digest":"sha256:e4ec4f22370e52d9bac1d2d0fe548a39201aa32cf8aaad62b881aba2e115d2ee","observation_id":"357ddd75-67dc-4f11-8700-e9dae2fa006f","resolution":{"observed_at":"2026-08-12T14:33:13.132899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2505.15134","last_updated":"2025-05-21T05:39:11Z","snapshot_observed_at":"2026-08-13T03:09:24.809367Z","submitted_at":"2025-05-21T05:39:11Z","title":"The Unreasonable Effectiveness of Entropy Minimization in LLM Reasoning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-18T15:58:33.219451Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2505.15134"},"observation_digest":"sha256:4f62a2c323b2d634d1127a3db9bedb599f7e98398d136672dac30e52ede57710","observation_id":"26ea0b99-71b6-4221-9c4f-e5a8a3ff6b75","resolution":{"observed_at":"2026-05-18T15:58:33.516755Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-07T00:48:36.931506Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12594","last_updated":"2025-06-14T18:19:05Z","snapshot_observed_at":"2026-08-13T01:21:59.385623Z","submitted_at":"2025-06-14T18:19:05Z","title":"A Comprehensive Survey of Deep Research: Systems, Methodologies, and Applications","version":1},"reference_index":268,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:36.931506Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2506.12594"},"observation_digest":"sha256:8d3a68259116ffacaeba302687597f9983947ceb0e4548fc872a929fedf5b776","observation_id":"f9ec80f5-56a6-423b-b50f-8a1c5c61ebc0","resolution":{"observed_at":"2026-08-07T00:48:36.931506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-06T20:28:58.706378Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02694","last_updated":"2025-07-03T15:04:38Z","snapshot_observed_at":"2026-08-13T15:17:29.145891Z","submitted_at":"2025-07-03T15:04:38Z","title":"Can LLMs Identify Critical Limitations within Scientific Research? A Systematic Evaluation on AI Research Papers","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T20:28:58.706378Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2507.02694"},"observation_digest":"sha256:99cca7b423a7711a8dd30aff7ea8ddf88b4862725540399d260859f15f224fac","observation_id":"800280f9-3e7f-4189-bc35-f3c1d4f2e981","resolution":{"observed_at":"2026-08-06T20:28:58.706378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-06T11:07:33.400361Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23096","last_updated":"2025-07-30T20:54:18Z","snapshot_observed_at":"2026-08-09T12:28:40.880549Z","submitted_at":"2025-07-30T20:54:18Z","title":"ChatVis: Large Language Model Agent for Generating Scientific Visualizations","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:33.400361Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2507.23096"},"observation_digest":"sha256:31c35dd42c356a932b50ea12b00254c4f8c7aba3bc94cdd875e602098d738aa0","observation_id":"ae47f8bd-341b-4e9d-b23f-311c2f666365","resolution":{"observed_at":"2026-08-06T11:07:33.400361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-06T10:55:15.053795Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23276","last_updated":"2025-08-01T12:49:36Z","snapshot_observed_at":"2026-08-06T10:54:57.937285Z","submitted_at":"2025-07-31T06:32:06Z","title":"How Far Are AI Scientists from Changing the World?","version":2},"reference_index":163,"source":"arxiv_source","source_observed_at":"2026-08-06T10:55:15.053795Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2507.23276"},"observation_digest":"sha256:2ef7409e85129abcce7a0a9a019bd4c8d2f226a427f5bb47f28933681e8177d9","observation_id":"e295e3be-ce7d-4a97-9302-ae35b64346f3","resolution":{"observed_at":"2026-08-06T10:55:15.053795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T16:35:14.166427Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18125","last_updated":"2025-08-27T16:18:00Z","snapshot_observed_at":"2026-08-05T16:34:54.686134Z","submitted_at":"2025-08-25T15:33:37Z","title":"Symmetry-induced magnetism in fullerene monolayers","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T16:35:14.166427Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2508.18125"},"observation_digest":"sha256:9d699c1db6fc79820d791e8240c0f359a0bb60d504f1090c960aa36f4d0a5028","observation_id":"8e7113de-0d70-49f1-aeda-073e81f86333","resolution":{"observed_at":"2026-08-05T16:35:14.166427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-04T14:52:49.846361Z","title":"Scicode: A research coding benchmark curated by scientists","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.22768","last_updated":"2026-07-28T18:10:53Z","snapshot_observed_at":"2026-08-13T16:20:35.016037Z","submitted_at":"2025-09-26T17:20:27Z","title":"ML2B: Benchmarking LLMs on Cross-Lingual ML Pipeline Generation","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T14:52:49.846361Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2509.22768"},"observation_digest":"sha256:a2c591c395a88eae7089fbb363820fbd6ece6c508d50cc21592dcd003e404280","observation_id":"c6c3e951-9187-446f-8974-1a3d1d2f5592","resolution":{"observed_at":"2026-08-04T14:52:49.846361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-04T13:51:31.686179Z","title":"Scicode: A research coding benchmark curated by scientists","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.24978","last_updated":"2026-07-08T17:52:03Z","snapshot_observed_at":"2026-08-15T15:54:15.667023Z","submitted_at":"2025-09-29T16:07:05Z","title":"Agentic Exploration of Physics Models","version":6},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:31.686179Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2509.24978"},"observation_digest":"sha256:1ea8480399fa4a0212a6519d98168d2df503ce308cb26c519451f25f7230e488","observation_id":"429efa30-d1ac-4a38-a32f-e2d181d4a552","resolution":{"observed_at":"2026-08-04T13:51:31.686179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2510.08804","last_updated":"2026-05-04T16:48:58Z","snapshot_observed_at":"2026-08-12T17:03:49.675968Z","submitted_at":"2025-10-09T20:35:23Z","title":"MOSAIC: Multi-agent Orchestration for Task-Intelligent Scientific Coding","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-18T08:28:59.161675Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2510.08804"},"observation_digest":"sha256:8c46745d3cb4a0a97ccfcbae7f8f021fb675b78118a5eb95f920d2049297ccca","observation_id":"6eb69df1-2e08-4527-a41a-0de411762877","resolution":{"observed_at":"2026-05-18T08:31:06.956134Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-03T14:45:42.228598Z","title":"https://arxiv.org/abs/2407.13168","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.19458","last_updated":"2026-07-07T09:00:18Z","snapshot_observed_at":"2026-08-13T17:45:16.784743Z","submitted_at":"2025-12-22T15:03:57Z","title":"VASP Agent: An Agentic Framework for Autonomous First-principles Calculations","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T14:45:42.228598Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2512.19458"},"observation_digest":"sha256:ff69267c204dc79d8825069cc2b982c827be476fd35dc8c0ff6ee9c0950a789f","observation_id":"7f7ee4fc-074c-4d6b-ab84-f9ccd8cd171e","resolution":{"observed_at":"2026-08-03T14:45:42.228598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2603.23964","last_updated":"2026-04-13T08:15:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-25T05:56:54Z","title":"From Pixels to Digital Agents: An Empirical Study on the Taxonomy and Technological Trends of Reinforcement Learning Environments","version":2},"reference_index":178,"source":"pdf_text","source_observed_at":"2026-05-15T01:20:03.181903Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2603.23964"},"observation_digest":"sha256:38344715cfa280f6cf3d248fc5bcfa3f1c86836cf31dd6ea68b809df2bef04e4","observation_id":"ed0b687e-cc6b-49be-92af-aff48f2bc8f9","resolution":{"observed_at":"2026-05-15T01:23:27.277193Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2604.00149","last_updated":"2026-05-10T06:05:55Z","snapshot_observed_at":"2026-08-14T08:16:38.214167Z","submitted_at":"2026-03-31T18:56:37Z","title":"Towards Verifiable and Self-Correcting AI Physicists for Quantum Many-Body Simulations","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T22:33:21.677835Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2604.00149"},"observation_digest":"sha256:f305d8df7ed3e7aea962ef19d3904a9e8ce65d345f5720fb0e8c161cd2b3a711","observation_id":"6f049bba-1a2d-402a-a552-2bf68bdd4445","resolution":{"observed_at":"2026-05-13T22:38:22.712994Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2604.23106","last_updated":"2026-04-25T02:01:54Z","snapshot_observed_at":"2026-08-15T08:15:50.151834Z","submitted_at":"2026-04-25T02:01:54Z","title":"No Test Cases, No Problem: Distillation-Driven Code Generation for Scientific Workflows","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T08:12:07.708441Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2604.23106"},"observation_digest":"sha256:9956a28e331f2f4ad5f8ef3d323a9a77e837c6d05319f565fdf4d683393e1868","observation_id":"9a3caa96-7fb9-48ad-9eaa-3db28ee5371c","resolution":{"observed_at":"2026-05-11T20:46:09.902343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2605.13950","last_updated":"2026-05-13T18:00:00Z","snapshot_observed_at":"2026-08-13T15:32:30.494754Z","submitted_at":"2026-05-13T18:00:00Z","title":"Collider-Bench: Benchmarking AI Agents with Particle Physics Analysis Reproduction","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-15T06:04:03.605898Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2605.13950"},"observation_digest":"sha256:6fa40187916bc29aad8221c4fc70345f89906e80d13a3011f912743681699199","observation_id":"749c09ca-c726-466e-bfc4-37015cd96f9b","resolution":{"observed_at":"2026-05-15T06:05:06.667656Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2605.18630","last_updated":"2026-05-18T16:34:45Z","snapshot_observed_at":"2026-08-15T15:54:08.065121Z","submitted_at":"2026-05-18T16:34:45Z","title":"SCICONVBENCH: Benchmarking LLMs on Multi-Turn Clarification for Task Formulation in Computational Science","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-20T10:36:09.724234Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2605.18630"},"observation_digest":"sha256:d5822251fefe2e70b4b2d07e708406f03dcdc46fd26b9e2820ec8d8bd02d48ae","observation_id":"30a26250-82a9-4582-9e30-92048bc76ffe","resolution":{"observed_at":"2026-05-20T10:38:12.125490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2605.18661","last_updated":"2026-07-20T17:24:03Z","snapshot_observed_at":"2026-08-14T09:37:41.438142Z","submitted_at":"2026-05-18T17:08:26Z","title":"AI for Auto-Research: Roadmap & User Guide","version":1},"reference_index":204,"source":"pdf_text","source_observed_at":"2026-05-20T10:30:50.256635Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2605.18661"},"observation_digest":"sha256:aee8b094a57cb4bdbadb8e5946c7332ea55c89949b8ac4305f5718734729ed48","observation_id":"3597d05c-7c21-4363-9498-43fc22e9abea","resolution":{"observed_at":"2026-05-20T10:33:12.560011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-02T13:43:48.326864Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.18661","last_updated":"2026-07-20T17:24:03Z","snapshot_observed_at":"2026-08-14T09:37:41.438142Z","submitted_at":"2026-05-18T17:08:26Z","title":"AI for Auto-Research: Roadmap & User Guide","version":2},"reference_index":203,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:48.326864Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2605.18661"},"observation_digest":"sha256:ee163cfa96ca7b9e3d5c05ca20d4f52dfbce55186614dc3f4c8dbc89dffd5deb","observation_id":"8461a9a1-6228-4f84-bb37-e12aa9854a6f","resolution":{"observed_at":"2026-08-02T13:43:48.326864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2605.20520","last_updated":"2026-05-19T21:42:32Z","snapshot_observed_at":"2026-08-14T21:21:38.708268Z","submitted_at":"2026-05-19T21:42:32Z","title":"Open-World Evaluations for Measuring Frontier AI Capabilities","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-21T06:38:51.427985Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2605.20520"},"observation_digest":"sha256:3c562f60f19aef78b177d5b939d6ed43cfb06e246045c01022d7125858ec2c06","observation_id":"594472bb-ef4d-4262-91ca-611201ccb2c1","resolution":{"observed_at":"2026-05-21T06:39:43.760942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2605.27210","last_updated":"2026-05-26T16:02:08Z","snapshot_observed_at":"2026-08-04T03:28:22.303695Z","submitted_at":"2026-05-26T16:02:08Z","title":"Qiskit QuantumKatas: Adapting Microsoft's Quantum Computing exercises for LLM evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T16:36:03.557894Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2605.27210"},"observation_digest":"sha256:a8ec4e1a61c3f44a2726d8303ba1c5487087fb7e2c8c1373d9a75d62550a200f","observation_id":"fe0e2b63-1e39-4c6a-8be7-353d8050740e","resolution":{"observed_at":"2026-06-29T17:13:45.141431Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2605.28371","last_updated":"2026-05-27T12:11:05Z","snapshot_observed_at":"2026-08-13T06:14:13.126261Z","submitted_at":"2026-05-27T12:11:05Z","title":"From paper to benchmark: agentic, framework-based reproduction of under-specified methods in machine health intelligence","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T12:13:58.111299Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2605.28371"},"observation_digest":"sha256:dfd07f47c8ce43e48d41edb19a712918b823a7e694ecfab9da2d7160e439b292","observation_id":"7dd2ce34-215a-455f-888a-04f918c13cd8","resolution":{"observed_at":"2026-06-29T12:23:24.667564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2606.01975","last_updated":"2026-06-01T09:36:59Z","snapshot_observed_at":"2026-08-14T13:35:42.078670Z","submitted_at":"2026-06-01T09:36:59Z","title":"Algorithmic algorithm development with LLMs: A Case Study on LLM-Usage for Contraction Order Optimization in Tensor Networks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T14:35:24.936368Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2606.01975"},"observation_digest":"sha256:b7419ed580cf28d0079b35318ab35c3d72253ee82423d87c096687fd3fa217f1","observation_id":"aa669625-4e45-48c8-876c-282fd3192d40","resolution":{"observed_at":"2026-07-01T23:16:23.648169Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2606.02258","last_updated":"2026-06-01T13:45:18Z","snapshot_observed_at":"2026-08-02T16:51:34.074966Z","submitted_at":"2026-06-01T13:45:18Z","title":"Matter to Mechanism: A Benchmark for AI Co-Scientists in Materials and Battery Research","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-06-28T12:08:10.552789Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2606.02258"},"observation_digest":"sha256:31f95adbb4d992fee7ccac451c2ac07821f93a2a1c933ad73b6b74f8cc083a9d","observation_id":"89a7cee2-b121-4937-8705-eabbf6158743","resolution":{"observed_at":"2026-06-28T12:12:07.890457Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2606.09550","last_updated":"2026-06-08T14:29:40Z","snapshot_observed_at":"2026-08-13T02:09:33.292917Z","submitted_at":"2026-06-08T14:29:40Z","title":"InquiTree: Evaluating AI Agents in the Scientific Inquiry Loop with Paper-Derived Research Trees","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-27T14:06:59.471772Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2606.09550"},"observation_digest":"sha256:a7926e1a7c7a6210153176a80a6a2c600b489fc3e317d417e7140e45d6c525f3","observation_id":"e06e1321-082c-49de-92e7-7e99f29feeab","resolution":{"observed_at":"2026-07-03T04:07:37.239543Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2606.17628","last_updated":"2026-06-16T07:33:53Z","snapshot_observed_at":"2026-08-05T17:08:33.405254Z","submitted_at":"2026-06-16T07:33:53Z","title":"OPD-Evolver: Cultivating Holistic Agent Evolver via On-Policy Distillation","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-06-27T01:07:49.603969Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2606.17628"},"observation_digest":"sha256:1facf371982e9e61314739453356fdcd55b91e4e0a770abca5c142eebd2bdd9c","observation_id":"c8187079-cfac-4b82-a5ec-4605193f6714","resolution":{"observed_at":"2026-07-03T20:48:56.399127Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":"2407.13168","doi":"10.48550/arxiv.2407.13168","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","venue":"arXiv (Cornell University)","work_id":"4bb6f36d-c350-4b7e-baf8-d3dea3e91d40","year":2024},"citing_paper":{"arxiv_id":"2607.00248","last_updated":"2026-06-30T22:57:43Z","snapshot_observed_at":"2026-08-12T14:16:56.866074Z","submitted_at":"2026-06-30T22:57:43Z","title":"Seed2.0 Model Card: Towards Intelligence Frontier for Real-World Complexity","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-07-02T18:57:46.841456Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2607.00248"},"observation_digest":"sha256:f8e963ec51e72320aa1670a28fb538577f19cce11b58a1901b7c0091330f4376","observation_id":"466d84a5-23b2-4baf-a4db-9ca0daa3f42f","resolution":{"observed_at":"2026-07-02T19:07:17.115724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:34.849698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-07-12T07:37:37.032195Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02703","last_updated":"2026-07-02T18:46:27Z","snapshot_observed_at":"2026-08-04T06:04:36.734771Z","submitted_at":"2026-07-02T18:46:27Z","title":"LLMoxie: Exploring Agentic AI for Scientific Software Development","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-12T07:37:37.032195Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2607.02703"},"observation_digest":"sha256:416237e755296556f6e305cf7803c6a903ea2a1ada608cd8226e4d21557f943f","observation_id":"30066e6f-b907-413c-86de-03e67bc40b24","resolution":{"observed_at":"2026-07-12T07:37:37.032195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-07-31T14:26:52.999650Z","title":"Scicode: A research coding benchmark curated by scientists.arXiv preprint arXiv:2407.13168,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24459","last_updated":"2026-07-28T04:09:04Z","snapshot_observed_at":"2026-08-14T19:26:53.678177Z","submitted_at":"2026-07-27T14:01:32Z","title":"From Execution to Capability: Scientific Experience Consolidation via Procedural Knowledge Synthesis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T14:26:52.999650Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2607.24459"},"observation_digest":"sha256:48db6287c2d9d200fc9c2024d260fcfd18adfd82dbf9c2e08d1683f6e8df683b","observation_id":"41d2b364-9ca8-404d-9205-a685dd5fa552","resolution":{"observed_at":"2026-07-31T14:26:52.999650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13168","snapshot_observed_at":"2026-08-01T00:52:32.159176Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27822","last_updated":"2026-07-30T08:02:33Z","snapshot_observed_at":"2026-08-06T16:33:41.959663Z","submitted_at":"2026-07-30T08:02:33Z","title":"CLVisc Agent for autonomous relativistic hydrodynamics studies","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T00:52:32.159176Z"},"links":{"cited_paper":"/paper/2407.13168","citing_paper":"/paper/2607.27822"},"observation_digest":"sha256:f371be801aab6c2d3d056b10818e9289180bfb82ac57c1806c29cefa2d324c97","observation_id":"4f56e5f3-0eb6-4bff-bf67-53c535cb0799","resolution":{"observed_at":"2026-08-01T00:52:32.159176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.13168/citation-record","integrity":"/paper/2407.13168/integrity","json":"/paper/2407.13168/citation-record.json","paper":"/paper/2407.13168"},"outbound":[],"paper":{"arxiv_id":"2407.13168","last_updated":"2024-07-18T05:15:24Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T19:05:50.244131Z","submitted_at":"2024-07-18T05:15:24Z","title":"SciCode: A Research Coding Benchmark Curated by Scientists"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 29 inbound Pith citation observations for arXiv:2407.13168."}