{"as_of":"2026-08-09T21:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d478ec63df18b9d6fd7be3dbc7ff79b36964a05d82af9b3b5115ec97d590dc8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":30,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:40:41.058314Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T14:40:41.058314Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18149","last_updated":"2025-05-23T17:57:43Z","snapshot_observed_at":"2026-08-08T15:09:49.469387Z","submitted_at":"2025-05-23T17:57:43Z","title":"First Finish Search: Efficient Test-Time Scaling in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:40:41.058314Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2505.18149"},"observation_digest":"sha256:cd76b7476d48aae673e1a906072a79a57e36102c312f4b8d7d8ed266d3559cb7","observation_id":"1d51f9f6-71e7-4b35-8641-d17ab126bf7f","resolution":{"observed_at":"2026-08-07T14:40:41.058314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T12:35:42.308005Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24863","last_updated":"2025-05-30T17:58:36Z","snapshot_observed_at":"2026-08-07T20:38:56.380571Z","submitted_at":"2025-05-30T17:58:36Z","title":"AlphaOne: Reasoning Models Thinking Slow and Fast at Test Time","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.308005Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2505.24863"},"observation_digest":"sha256:c40da5cf954b36d5e523378ed1e70c9c036767a77e9a53854da406383952aa3d","observation_id":"4479646c-d535-474b-a217-90628cfbcd97","resolution":{"observed_at":"2026-08-07T12:35:42.308005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T12:02:43.485411Z","title":"S*: Test time scaling for code generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.485411Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:a2c54e7b9aee355ec8d168ae8b75370e9d6762232acfeb74e49589f7e14998c1","observation_id":"941ccb5e-2660-441f-974b-0760f30b506e","resolution":{"observed_at":"2026-08-07T12:02:43.485411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T10:18:59.138334Z","title":"S*: Test time scaling for code generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05566","last_updated":"2025-07-15T21:44:21Z","snapshot_observed_at":"2026-08-09T09:46:49.462038Z","submitted_at":"2025-06-05T20:24:58Z","title":"ScaleRTL: Scaling LLMs with Reasoning Data and Test-Time Compute for Accurate RTL Code Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:59.138334Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2506.05566"},"observation_digest":"sha256:097b305a28fe0b213a23e7db3e317ecb65cdb473c1d19d3ccdb8d3fb89b90a82","observation_id":"013f40b3-c033-419e-b65d-a3e2733194da","resolution":{"observed_at":"2026-08-07T10:18:59.138334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T05:18:37.098954Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08311","last_updated":"2026-05-27T03:57:09Z","snapshot_observed_at":"2026-08-07T05:11:22.076864Z","submitted_at":"2025-06-10T00:41:54Z","title":"Understanding Automated Program Repair Agents Through the Lens of Traceability: An Empirical Study","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:18:37.098954Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2506.08311"},"observation_digest":"sha256:1f24b9470888b591b890c3dbaad4f2095b966658969ec1f525d9298b67ebeb7e","observation_id":"48efbcaf-ec31-42d7-91ec-08e02a006bee","resolution":{"observed_at":"2026-08-07T05:18:37.098954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-06T10:53:18.496007Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23370","last_updated":"2025-07-31T09:37:22Z","snapshot_observed_at":"2026-08-09T01:49:07.613123Z","submitted_at":"2025-07-31T09:37:22Z","title":"Trae Agent: An LLM-based Agent for Software Engineering with Test-time Scaling","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:18.496007Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2507.23370"},"observation_digest":"sha256:2de054975aec9b7d3ba44bc658f149800aa4a08018b07c6936b0dfd018ef849c","observation_id":"39b54d1f-1873-4251-9da3-7b0285ef22ff","resolution":{"observed_at":"2026-08-06T10:53:18.496007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T20:17:09.862906Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10874","last_updated":"2025-08-14T17:46:01Z","snapshot_observed_at":"2026-08-06T03:19:32.559275Z","submitted_at":"2025-08-14T17:46:01Z","title":"SSRL: Self-Search Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T20:17:09.862906Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2508.10874"},"observation_digest":"sha256:4bf1899fa357bad610cc52de07086e68eba15fa9313a52499f3251e0f9193437","observation_id":"cae576c8-daad-4d64-87ee-56724e58b22c","resolution":{"observed_at":"2026-08-05T20:17:09.862906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-04T13:26:49.991171Z","title":"S*: Test time scaling for code generation.arXiv preprint arXiv:2502.14382, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.00501","last_updated":"2026-08-05T06:01:15Z","snapshot_observed_at":"2026-08-09T15:30:29.509516Z","submitted_at":"2025-10-01T04:33:53Z","title":"CodeChemist: Test-Time Scaling for Low-Resource Code Generation via Functional Knowledge Transfer","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T13:26:49.991171Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2510.00501"},"observation_digest":"sha256:60f09394a807756ae8815e040ceb6e3bc12955b5209e56f00e02a75c6ed65ff5","observation_id":"dc82192f-1451-43bb-9bf0-f91e02c241b0","resolution":{"observed_at":"2026-08-04T13:26:49.991171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2511.16858","last_updated":"2026-04-03T16:15:46Z","snapshot_observed_at":"2026-07-06T22:36:35.545474Z","submitted_at":"2025-11-20T23:55:56Z","title":"Investigating Test Overfitting on SWE-bench","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T19:57:06.015270Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2511.16858"},"observation_digest":"sha256:300e5e9dd49c647f890a15a0ea3e01dafc8ebe134a87b9e11157a57744fdf9e8","observation_id":"60105154-838c-4fa0-8809-38d795e310ca","resolution":{"observed_at":"2026-05-17T20:00:10.752156Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2512.14917","last_updated":"2026-04-23T22:42:11Z","snapshot_observed_at":"2026-07-31T07:00:51.587326Z","submitted_at":"2025-12-16T21:12:53Z","title":"Evaluating Code Reasoning Abilities of Large Language Models Under Real-World Settings","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T21:23:44.762007Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2512.14917"},"observation_digest":"sha256:6c652a1c3f57e3fea9594cd96bb5c25b894d2a0386e2e0fd9e8a2c0dad90d8e8","observation_id":"e59f2cf1-0b7b-4366-be2c-eeb361f7d574","resolution":{"observed_at":"2026-05-16T21:28:34.161126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2603.27098","last_updated":"2026-04-04T02:18:57Z","snapshot_observed_at":"2026-08-02T12:17:19.632566Z","submitted_at":"2026-03-28T02:37:36Z","title":"Ensemble-Based Uncertainty Estimation for Code Correctness Estimation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T22:52:58.524934Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2603.27098"},"observation_digest":"sha256:6e6693f5b42206eaf2eefe560899ee2acad1015f962bc88f142d25461222c435","observation_id":"d95d7dcd-d1f6-45df-93ba-923fe35bc8ed","resolution":{"observed_at":"2026-05-14T22:53:14.064225Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.05560","last_updated":"2026-06-30T13:49:36Z","snapshot_observed_at":"2026-07-13T09:22:43.743786Z","submitted_at":"2026-04-07T08:00:54Z","title":"An Iterative Test-and-Repair Framework for Competitive Code Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T19:44:32.950977Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.05560"},"observation_digest":"sha256:a028e49b7fe09ba7a90fc165c1739a412be1e41d0becce0750b416171f76091c","observation_id":"b3404d8c-9966-497f-bd29-24c2f5ffc91a","resolution":{"observed_at":"2026-05-10T22:35:48.594787Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-07-13T09:22:44.557413Z","title":"S*: Test time scaling for code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.05560","last_updated":"2026-06-30T13:49:36Z","snapshot_observed_at":"2026-07-13T09:22:43.743786Z","submitted_at":"2026-04-07T08:00:54Z","title":"An Iterative Test-and-Repair Framework for Competitive Code Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T09:22:44.557413Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.05560"},"observation_digest":"sha256:fb014ba2de9c62b4a43ff113548de5a3c7f836dcfe849b2a8327b773d0288ce2","observation_id":"a8236709-bcd5-484c-9158-da14c3020ab2","resolution":{"observed_at":"2026-07-13T09:22:44.557413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.05868","last_updated":"2026-04-07T13:28:09Z","snapshot_observed_at":"2026-08-02T07:08:59.060388Z","submitted_at":"2026-04-07T13:28:09Z","title":"Understanding Performance Gap Between Parallel and Sequential Sampling in Large Reasoning Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T18:36:01.200412Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.05868"},"observation_digest":"sha256:ab3ff81f1fa5ce153ded878002b87632bc441c6ccc6224d317ea5a03bacc9495","observation_id":"ec0c04c0-b397-4a0d-9886-0f366c6fd68a","resolution":{"observed_at":"2026-05-11T00:20:52.512539Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.10449","last_updated":"2026-04-12T04:15:31Z","snapshot_observed_at":"2026-07-06T22:59:05.519456Z","submitted_at":"2026-04-12T04:15:31Z","title":"AdverMCTS: Combating Pseudo-Correctness in Code Generation via Adversarial Monte Carlo Tree Search","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-10T16:35:16.056397Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.10449"},"observation_digest":"sha256:1d1a664493d8bc5bd16828eb7e5bf1d4b185c046849b49b9e2ae54275bc5f8c6","observation_id":"d29b0de0-3ab9-4a04-a0c7-f33da9b39e87","resolution":{"observed_at":"2026-05-11T08:40:57.437957Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.16995","last_updated":"2026-04-18T13:49:47Z","snapshot_observed_at":"2026-07-06T23:04:10.324443Z","submitted_at":"2026-04-18T13:49:47Z","title":"SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-10T06:57:03.100519Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.16995"},"observation_digest":"sha256:7c8a375d6ca05674e19c9a3de3a252e2755cca6c6c8af4121ec2e37b42eb211e","observation_id":"084d5fc7-7dfe-47e3-8c35-eb9ec42f3423","resolution":{"observed_at":"2026-05-10T07:01:49.460726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.17288","last_updated":"2026-04-19T07:04:49Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T07:04:49Z","title":"Clover: A Neural-Symbolic Agentic Harness with Stochastic Tree-of-Thoughts for Verified RTL Repair","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T06:09:39.737812Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.17288"},"observation_digest":"sha256:01c8af2930ab98066a5468be6cbcd5d869b004efd155249f7446d9c735c9214b","observation_id":"34561241-24a2-4335-a14e-5af913e23ef2","resolution":{"observed_at":"2026-05-10T06:11:20.104728Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.21598","last_updated":"2026-04-28T05:10:28Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:21:03Z","title":"You Don't Need Public Tests to Generate Correct Code","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T20:57:43.802195Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.21598"},"observation_digest":"sha256:85aa7969a894786561d0b6260c40d35bd439d24c6e743b2efe7a2c8b7ed1c7f0","observation_id":"8c7e349d-7471-4b50-b644-a51d94124d86","resolution":{"observed_at":"2026-05-09T20:58:06.503019Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2605.01194","last_updated":"2026-05-02T02:13:11Z","snapshot_observed_at":"2026-07-06T23:14:29.125042Z","submitted_at":"2026-05-02T02:13:11Z","title":"VLA-ATTC: Adaptive Test-Time Compute for VLA Models with Relative Action Critic Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T15:10:16.533927Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.01194"},"observation_digest":"sha256:df3482ab3a733182bdda17eeb50ab74f4c68842cf404867ead486e18076df543","observation_id":"430b4b6e-b475-4e91-a67a-adec344410bc","resolution":{"observed_at":"2026-05-11T16:46:06.426908Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2605.11299","last_updated":"2026-05-13T03:29:35Z","snapshot_observed_at":"2026-07-06T23:23:11.928199Z","submitted_at":"2026-05-11T22:34:45Z","title":"Primal Generation, Dual Judgment: Self-Training from Test-Time Scaling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T02:25:58.830629Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.11299"},"observation_digest":"sha256:2344993c90d1a7aa03d15848641b53639d4a55f07a25aea1b953b7b42c20e2f2","observation_id":"11a23cf3-8394-4e6c-b64e-1fce1a319253","resolution":{"observed_at":"2026-05-13T02:27:07.012994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2605.11299","last_updated":"2026-05-13T03:29:35Z","snapshot_observed_at":"2026-07-06T23:23:11.928199Z","submitted_at":"2026-05-11T22:34:45Z","title":"Primal Generation, Dual Judgment: Self-Training from Test-Time Scaling","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-14T20:46:38.558668Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.11299"},"observation_digest":"sha256:ae1f7f4dd4b4a0f07d41b8ed27a623429be7a32c071ff44b8f2defe8a7ba7ed2","observation_id":"b89a0ac9-5bc9-476b-b632-ab8d0745da7d","resolution":{"observed_at":"2026-05-14T20:47:58.051554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2605.22478","last_updated":"2026-07-18T11:55:12Z","snapshot_observed_at":"2026-08-03T06:10:22.493856Z","submitted_at":"2026-05-21T13:36:38Z","title":"DeliCIR: Memory-Guided Test-Time Deliberation via Multi-Agent Collaboration for Composed Image Retrieval","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T06:40:58.445504Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.22478"},"observation_digest":"sha256:23713486de5b1d1c6e866a5a01935d8e8db7c35d9cb6da55f28486b8a92c7ddc","observation_id":"33272c18-01b7-4bd6-9f6e-5423c1aa525a","resolution":{"observed_at":"2026-05-22T06:41:10.244507Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2605.22478","last_updated":"2026-07-18T11:55:12Z","snapshot_observed_at":"2026-08-03T06:10:22.493856Z","submitted_at":"2026-05-21T13:36:38Z","title":"DeliCIR: Memory-Guided Test-Time Deliberation via Multi-Agent Collaboration for Composed Image Retrieval","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-30T17:10:54.790735Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.22478"},"observation_digest":"sha256:da1d9829eeb8ba6360ed2c2b672a12c622991fc363e86012c5c53b1c79bf5635","observation_id":"cc348fc7-c7ba-49bb-9976-a80e90665a51","resolution":{"observed_at":"2026-06-30T17:14:56.868345Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-02T13:28:23.927508Z","title":"S*: Test time scaling for code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22478","last_updated":"2026-07-18T11:55:12Z","snapshot_observed_at":"2026-08-03T06:10:22.493856Z","submitted_at":"2026-05-21T13:36:38Z","title":"DeliCIR: Memory-Guided Test-Time Deliberation via Multi-Agent Collaboration for Composed Image Retrieval","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T13:28:23.927508Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.22478"},"observation_digest":"sha256:2ccd56763e9802d6c20da3d7d7eb6328bdfdb9d832b1cf33760d65b0d523e471","observation_id":"a967c520-5d39-4e31-9d46-f014212f8f3f","resolution":{"observed_at":"2026-08-02T13:28:23.927508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2606.03102","last_updated":"2026-06-02T03:42:04Z","snapshot_observed_at":"2026-08-03T04:21:57.609394Z","submitted_at":"2026-06-02T03:42:04Z","title":"Small RL Controller, Large Language Model: RL-Guided Adaptive Sampling for Test-Time Scaling","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-06-28T10:25:10.559953Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2606.03102"},"observation_digest":"sha256:59103bdc3d3b53b0b2dcc558d845054808ff66bef3ce1e21f91f13fde8ef38e4","observation_id":"6070e180-aef8-41b1-8f17-4ae836593d6f","resolution":{"observed_at":"2026-07-02T02:56:29.979083Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2606.11052","last_updated":"2026-06-09T16:17:19Z","snapshot_observed_at":"2026-08-05T14:17:36.486236Z","submitted_at":"2026-06-09T16:17:19Z","title":"Attention Amnesia in Hybrid LLMs: When CoT Fine-Tuning Breaks Long-Range Recall, and How to Fix It","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-27T13:08:57.218711Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2606.11052"},"observation_digest":"sha256:7311d93a6bac39ced96875f3b9f0dc4b1a425122bae65f0486fa4bf91a59b12c","observation_id":"c09ccd2d-ced5-46f3-9547-459607b3825c","resolution":{"observed_at":"2026-07-03T05:37:40.386138Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2606.17682","last_updated":"2026-06-16T08:48:58Z","snapshot_observed_at":"2026-08-01T05:53:08.805029Z","submitted_at":"2026-06-16T08:48:58Z","title":"From Trainee to Trainer: LLM-Designed Training Environment for RL with Multi-Agent Reasoning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-27T00:59:50.038405Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2606.17682"},"observation_digest":"sha256:73d76e0de17d8323d559406594023e9884e490a79378231842a74877b377a79c","observation_id":"70039389-6f37-47db-a1d8-b85a68ea3bcd","resolution":{"observed_at":"2026-07-03T20:58:58.332792Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2606.27268","last_updated":"2026-06-25T16:50:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-25T16:50:21Z","title":"E-TTS: A New Embodied Test-Time Scaling Framework for Robotic Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T04:48:28.868562Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2606.27268"},"observation_digest":"sha256:967c608f84ee21c40ca54940f1d523ed5ed1caa3658e1dc32474f1dfeccac599","observation_id":"0cab6705-5cb2-4080-a953-dcf47cf963eb","resolution":{"observed_at":"2026-07-04T13:59:51.715906Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-07-13T01:18:48.061500Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08973","last_updated":"2026-07-09T22:34:00Z","snapshot_observed_at":"2026-08-07T22:15:33.720564Z","submitted_at":"2026-07-09T22:34:00Z","title":"SiFAR: Synchronization-Free All-Reduce for Low-Latency LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T01:18:48.061500Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2607.08973"},"observation_digest":"sha256:0a4588ee45d40e92f6b53f2680c208f82ba10297d0b8e466f2d4f583e88cfb65","observation_id":"716ac33a-5f25-4f61-86be-23b70caba98e","resolution":{"observed_at":"2026-07-13T01:18:48.061500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-01T14:11:55.463382Z","title":"S*: Test time scaling for code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18859","last_updated":"2026-07-21T08:49:30Z","snapshot_observed_at":"2026-08-08T05:58:51.576912Z","submitted_at":"2026-07-21T08:49:30Z","title":"PhoenixRepair: Rethinking Repair Strategy Exploration in Software Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T14:11:55.463382Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2607.18859"},"observation_digest":"sha256:d22253030eee9801b02fde2776f2846699c2b1f9bf1d024810fcb53e0abeea3f","observation_id":"cf445179-131f-4e19-b89d-5a56149ea7d0","resolution":{"observed_at":"2026-08-01T14:11:55.463382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.14382/citation-record","integrity":"/paper/2502.14382/integrity","json":"/paper/2502.14382/citation-record.json","paper":"/paper/2502.14382"},"outbound":[],"paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 30 inbound Pith citation observations for arXiv:2502.14382."}