{"as_of":"2026-08-14T18:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:065ab46dc97497f42f4f29899724a244adece25e76583245b236dfebc097ae28","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:05:56.920833Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:46:32.625500Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00794","snapshot_observed_at":"2026-08-06T22:46:32.625500Z","title":"Predicting Empirical AI Research Outcomes with Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20803","last_updated":"2025-06-25T19:47:23Z","snapshot_observed_at":"2026-08-13T09:24:08.635303Z","submitted_at":"2025-06-25T19:47:23Z","title":"The Ideation-Execution Gap: Execution Outcomes of LLM-Generated versus Human Research Ideas","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T22:46:32.625500Z"},"links":{"cited_paper":"/paper/2506.00794","citing_paper":"/paper/2506.20803"},"observation_digest":"sha256:d643af0fb009bd2223575c2ddae2e092ba9d9c38c85c4000e1de198f82a13cef","observation_id":"75729d29-f9d4-45d6-9258-680d865673ea","resolution":{"observed_at":"2026-08-06T22:46:32.625500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00794","snapshot_observed_at":"2026-08-06T14:22:31.403988Z","title":"Predicting empirical ai research outcomes with language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19477","last_updated":"2025-07-25T17:59:13Z","snapshot_observed_at":"2026-08-14T03:53:42.462951Z","submitted_at":"2025-07-25T17:59:13Z","title":"Advancing Event Forecasting through Massive Training of Large Language Models: Challenges, Solutions, and Broader Impacts","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T14:22:31.403988Z"},"links":{"cited_paper":"/paper/2506.00794","citing_paper":"/paper/2507.19477"},"observation_digest":"sha256:ed9d10b7e556f1b5aa9171b0fb95b21a2fc705181d34513e4678bf1f890733c8","observation_id":"ad6885f1-249d-4223-b8d8-ee4b259d3fc8","resolution":{"observed_at":"2026-08-06T14:22:31.403988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"cited_work":{"arxiv_id":"2506.00794","doi":"10.48550/arxiv.2506.00794","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00794","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"ArXiv.org","work_id":"045c057e-5a99-45d0-9915-8d6413c5c295","year":2025},"citing_paper":{"arxiv_id":"2604.23593","last_updated":"2026-04-26T08:03:32Z","snapshot_observed_at":"2026-08-14T11:50:53.807369Z","submitted_at":"2026-04-26T08:03:32Z","title":"When AI reviews science: Can we trust the referee?","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-05-08T06:19:54.727724Z"},"links":{"cited_paper":"/paper/2506.00794","citing_paper":"/paper/2604.23593"},"observation_digest":"sha256:8ac5b661f0edc8f5d5c3ec6e1121321ffb0d0e0fe5e0cc64813c06929a072183","observation_id":"6f01eadf-26ff-4fc2-a488-672666bbc266","resolution":{"observed_at":"2026-05-08T23:19:30.523123Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00794/citation-record","integrity":"/paper/2506.00794/integrity","json":"/paper/2506.00794/citation-record.json","paper":"/paper/2506.00794"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.06941","last_updated":"2024-05-17T06:35:19Z","snapshot_observed_at":"2026-08-13T05:04:35.443835Z","submitted_at":"2023-12-12T02:28:12Z","title":"Humans vs Large Language Models: Judgmental Forecasting in an Era of Advanced AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06941","snapshot_observed_at":"2026-08-07T12:05:55.463704Z","title":"Humans vs large language models: Judgmental forecasting in an era of advanced ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.463704Z"},"links":{"cited_paper":"/paper/2312.06941","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:07b2adaa5293a22995eb3cb3cfa2dea80cbe784309d7c26bb5fe227242fda852","observation_id":"eeedf0a2-6028-41b2-88b6-a18fc3c612c4","resolution":{"observed_at":"2026-08-07T12:05:55.463704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01788","last_updated":"2025-03-21T14:49:10Z","snapshot_observed_at":"2026-08-13T04:28:45.729274Z","submitted_at":"2024-02-02T02:41:28Z","title":"LitLLM: A Toolkit for Scientific Literature Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01788","snapshot_observed_at":"2026-08-07T12:05:55.548904Z","title":"Laradji, Laurent Charlin, and Christopher Pal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.548904Z"},"links":{"cited_paper":"/paper/2402.01788","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:64b96e02d8752daa4eb49d5f84d1a4c42602166495fcbb281e92c65b784ad59a","observation_id":"5afbfc62-d585-46c0-b450-f74f715fbc02","resolution":{"observed_at":"2026-08-07T12:05:55.548904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:55.630510Z","title":"Alpacafarm: A simulation framework for methods that learn from human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.630510Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:55d9afd63c50d361b7295d2ff0133b59c3a04fd7686aa161f125153e8fd35437","observation_id":"fc8f2d72-b221-469b-ae01-f7db11fb3458","resolution":{"observed_at":"2026-08-07T12:05:55.630510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18864","snapshot_observed_at":"2026-08-07T12:05:55.709041Z","title":"Towards an ai co-scientist","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.709041Z"},"links":{"cited_paper":"/paper/2502.18864","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:a8c163905053e659aee22657985780318f22abf4b66f9d055e9c14ac616503b0","observation_id":"1aa981e8-d446-4ee9-b2e8-61bed3beb569","resolution":{"observed_at":"2026-08-07T12:05:55.709041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18563","last_updated":"2024-02-28T18:54:18Z","snapshot_observed_at":"2026-08-13T04:07:57.965776Z","submitted_at":"2024-02-28T18:54:18Z","title":"Approaching Human-Level Forecasting with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18563","snapshot_observed_at":"2026-08-07T12:05:55.787770Z","title":"Approaching human-level forecasting with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.787770Z"},"links":{"cited_paper":"/paper/2402.18563","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:47b4243a78bbf51fb773b8ae89d41cf8b1e42c095d5a68129f1439cd6baf4850","observation_id":"49b6c088-00af-4006-bb02-7765bf1c0c7a","resolution":{"observed_at":"2026-08-07T12:05:55.787770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03302","last_updated":"2024-04-14T21:02:16Z","snapshot_observed_at":"2026-08-13T05:57:05.956099Z","submitted_at":"2023-10-05T04:06:12Z","title":"MLAgentBench: Evaluating Language Agents on Machine Learning Experimentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03302","snapshot_observed_at":"2026-08-07T12:05:55.906410Z","title":"Mlagentbench: Evaluating language agents on machine learning experimentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.906410Z"},"links":{"cited_paper":"/paper/2310.03302","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:8a6cf235311de3b71463767f4ec93dd4c5de5ab20df2a6876772234d4f9c8793","observation_id":"cdc97199-e562-4ef9-abd7-04dff8b60230","resolution":{"observed_at":"2026-08-07T12:05:55.906410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19839","last_updated":"2025-02-28T12:35:34Z","snapshot_observed_at":"2026-08-12T22:35:00.380884Z","submitted_at":"2024-09-30T00:41:51Z","title":"ForecastBench: A Dynamic Benchmark of AI Forecasting Capabilities","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19839","snapshot_observed_at":"2026-08-07T12:05:55.960132Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.960132Z"},"links":{"cited_paper":"/paper/2409.19839","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:08aa217d98cdc4e8861ed3c7193d1435fe1fd764ad6de14034b38a780d7fb6ee","observation_id":"0cd05966-ff5e-464d-9e8a-51b3cec2e9f0","resolution":{"observed_at":"2026-08-07T12:05:55.960132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:57.811737Z","title":"Can large language models provide useful feedback on research papers? a large-scale empirical analysis","venue":null,"work_id":"f3321a78-e94f-48a8-b33c-7ce33f23433f","year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.082833Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:488f7cbaf8154ac1feb53eeff97a009feb5cf7cbad80829518fdfae5d2df7924","observation_id":"4296a1ca-9f15-4fae-a8ed-b57e1d4e8ce4","resolution":{"observed_at":"2026-08-07T12:05:57.932804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-07T12:05:56.133782Z","title":"The ai scien- tist: Towards fully automated open-ended scientific discovery.arXiv preprint arXiv:2408.06292, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.133782Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:226f268457db6bea4bdcafbacd18c59e089cf10f99590dffbbb37318ad349d00","observation_id":"2c1e4a31-56d0-4603-a789-7efdf5865715","resolution":{"observed_at":"2026-08-07T12:05:56.133782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:57.645649Z","title":"Large language models surpass human experts in predicting neuroscience results","venue":null,"work_id":"ce40b63e-3c64-4369-af97-2b96959aba9a","year":2025},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.207802Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:063b4e7b530560533fd0be032c2c635ec305fd367bf6898ed0520cda617980ff","observation_id":"38538177-e28b-497e-a42a-d26786893a42","resolution":{"observed_at":"2026-08-07T12:05:57.711264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:57.483154Z","title":"Neurips 2021 summary, 2021","venue":null,"work_id":"f9cf67ff-5470-4d88-9baf-74802e5fd26e","year":2021},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.278474Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:ed1d775aa24be8d57b035a5ba69902a748e8143b44f94a606f52abc6ddb49d1d","observation_id":"ffb9baa2-5f72-488d-a125-056f2bf2e482","resolution":{"observed_at":"2026-08-07T12:05:57.544494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03495","last_updated":"2023-10-19T04:37:25Z","snapshot_observed_at":"2026-08-13T11:49:15.736725Z","submitted_at":"2023-05-04T15:15:22Z","title":"Automatic Prompt Optimization with \"Gradient Descent\" and Beam Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03495","snapshot_observed_at":"2026-08-07T12:05:56.352320Z","title":"gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.352320Z"},"links":{"cited_paper":"/paper/2305.03495","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:1faaaa835995d2d86ab3def7d51e2b8d3cb41f575b530f80a6538ce2261ad7b7","observation_id":"0dde4865-f67f-48c4-b329-bb5f47e9ba75","resolution":{"observed_at":"2026-08-07T12:05:56.352320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13014","last_updated":"2023-10-17T17:58:17Z","snapshot_observed_at":"2026-08-13T05:47:24.363154Z","submitted_at":"2023-10-17T17:58:17Z","title":"Large Language Model Prediction Capabilities: Evidence from a Real-World Forecasting Tournament","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13014","snapshot_observed_at":"2026-08-07T12:05:56.438248Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.438248Z"},"links":{"cited_paper":"/paper/2310.13014","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:6304fb0866bc12790964b2e7baa220c4c60608eb6931131084bee0075823ccf0","observation_id":"eb511723-d2e8-495a-bfb2-835ceb4dc392","resolution":{"observed_at":"2026-08-07T12:05:56.438248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04109","last_updated":"2024-09-06T08:25:03Z","snapshot_observed_at":"2026-08-12T22:50:09.286190Z","submitted_at":"2024-09-06T08:25:03Z","title":"Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04109","snapshot_observed_at":"2026-08-07T12:05:56.506033Z","title":"Can llms generate novel research ideas? a large-scale human study with 100+ nlp researchers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.506033Z"},"links":{"cited_paper":"/paper/2409.04109","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:e33da76572ce46515fc2c89dd8c8f739c12b13521b290fd6e62a9a25d1f97ec0","observation_id":"4095f34d-131c-4688-80e5-493e69d74eb7","resolution":{"observed_at":"2026-08-07T12:05:56.506033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:56.611944Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.611944Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:74fd259511b5fb8681f9e14893815469cff7ec94635f5caaa02689c34bc09f81","observation_id":"45f0081e-14e6-41e4-a1a7-3671dc72148b","resolution":{"observed_at":"2026-08-07T12:05:56.611944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-10T03:18:36.275195Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-07T12:05:56.687259Z","title":"The ai scientist-v2: Workshop-level automated scientific discovery via agentic tree search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.687259Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:2b78c45ca74550440e57d191ef8e31c4bdc353b0d993961d857decf4dad4ae1b","observation_id":"7ad5eaaa-d310-4f25-8756-19b310dafb9b","resolution":{"observed_at":"2026-08-07T12:05:56.687259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:56.756008Z","title":"Star: Self-taught reasoner bootstrapping reasoning with reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.756008Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:ea2d1ae089889bbc63c31b2cc0473e14d6ec0cd20a8df8f4e31a0fe121ec1918","observation_id":"bcad7cf2-68d6-4dcf-9079-bf410cf2d921","resolution":{"observed_at":"2026-08-07T12:05:56.756008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:57.275220Z","title":"Goal driven discovery of distributional differences via language descriptions","venue":null,"work_id":"2e9e6d24-8eec-4017-9e7f-e5aa9bef8a20","year":2023},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.806527Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:a64801968abdbc35e5ab87e8fdd083943e0e02336426c70714127fa677f821fc","observation_id":"25018129-528f-42b4-a652-008c26bb6588","resolution":{"observed_at":"2026-08-07T12:05:57.331730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.15474","last_updated":"2022-10-09T23:32:19Z","snapshot_observed_at":"2026-08-13T15:13:16.347871Z","submitted_at":"2022-06-30T17:59:14Z","title":"Forecasting Future World Events with Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.15474","snapshot_observed_at":"2026-08-07T12:05:56.920833Z","title":"Forecasting future world events with neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.920833Z"},"links":{"cited_paper":"/paper/2206.15474","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:cde211bf1cdb6091a7522ac83e8d3d9f750d1d64e9ab426ce1030b478518b73c","observation_id":"8a627cc6-e1e6-4218-9782-d04bf14298e5","resolution":{"observed_at":"2026-08-07T12:05:56.920833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-12T14:14:03.626008Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 3 inbound Pith citation observations for arXiv:2506.00794."}