{"as_of":"2026-08-20T13:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1a9196be1977a12813aa904c0c1dca5d1e7d2ed0335d927462adcb8ad727be51","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:31:05.820448Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09855/citation-record","integrity":"/paper/2608.09855/integrity","json":"/paper/2608.09855/citation-record.json","paper":"/paper/2608.09855"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.284651Z","title":"AGI House community newslet- ter, July 23, 2026","venue":null,"work_id":"ace6f53c-1fe0-4230-b280-bf9e8daf72bd","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.474864Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:e86b18ad2226812cca500450e2647b39f57a1a340c6353f3e76fa593c644800e","observation_id":"292ebfa1-7f72-4bc2-87f7-6e581460cfb1","resolution":{"observed_at":"2026-08-11T05:31:07.300725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.272058Z","title":"X article, July 31, 2026","venue":null,"work_id":"863c3b25-e70d-4ea4-a8f0-b3d7ac190d87","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.482020Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:6a5638cdfc2a35edfa57b53c8d9f746f8308de9ea62319b291a16af1823598b4","observation_id":"6ac6cdd4-2481-4035-8bad-7ff08b6c7441","resolution":{"observed_at":"2026-08-11T05:31:07.276062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.486529Z","title":"The Oracle Problem in Software Testing: A Survey","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.486529Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:db536aca0bb258585e785c943dc706aeb28624ba10c3cfe0a1e753ab5ac55b1e","observation_id":"2f73d93d-d090-49d4-9682-0d0eae95e7c3","resolution":{"observed_at":"2026-08-11T05:31:05.486529Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.492817Z","title":"Directed Greybox Fuzzing","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.492817Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:653e8e1ac0bc3bd6faf5e30c302d506efcb68af1b50d3d3f67436053e5da7532","observation_id":"d2a70ac0-3003-416b-a903-20801523b956","resolution":{"observed_at":"2026-08-11T05:31:05.492817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.499251Z","title":"Coverage-based Greybox Fuzzing as Markov Chain","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.499251Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:abc1be4df9080e7d3593fed61afc381bfa03d0ea28f9a4a8fbd03ad866bee5c5","observation_id":"1f4fe1fe-efcd-4209-a3e8-3629bd64317d","resolution":{"observed_at":"2026-08-11T05:31:05.499251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.505312Z","title":"On the Re- liability of Coverage-Based Fuzzer Benchmarking","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.505312Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:689fc7978a06f0eeb9f33df78c930568b9946a6c49b66098627ae48364b0c780","observation_id":"a92efadc-d01a-4c47-85c6-4a2ae51b0c2f","resolution":{"observed_at":"2026-08-11T05:31:05.505312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.513125Z","title":"Autonomous chemical research with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.513125Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:a162c482162c85f3feb02ed6827f1662dbaa0fefc12f6d0e57f22ce84a60dabd","observation_id":"197419a9-810d-452a-bbbd-e2cc95ca7a1d","resolution":{"observed_at":"2026-08-11T05:31:05.513125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-08-14T10:00:52.343929Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-11T05:31:05.520379Z","title":"Large Language Mon- keys: Scaling Inference Compute with Repeated Sam- pling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.520379Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:df61abd8fa91b5c3feb58736a067cfe1721706184b0bde781d5154d8f9202098","observation_id":"da915752-7dbf-4c1e-87e4-1b24e634bf34","resolution":{"observed_at":"2026-08-11T05:31:05.520379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.260145Z","title":"Exploration by Random Network Distillation","venue":null,"work_id":"94bd315f-e4c9-4a14-a96d-e2f38c446f56","year":2019},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.525497Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:7114a44c5db8c6f9a3eed5077a3643bf5eb056c613f6e30c5abce42e7399ce94","observation_id":"848b6abf-4416-4809-b1f5-cbb32fc53c91","resolution":{"observed_at":"2026-08-11T05:31:07.264602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.248474Z","title":"MLR-Bench: Evaluating AI Agents on Open-Ended Machine Learning Research","venue":null,"work_id":"ad644905-8973-4146-8cbb-eca6c238ee23","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.530560Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:01f13eb7ffa35c447f20cd110bb3905cea821c41283347eae838a92fd8e6484f","observation_id":"f2aed3c9-32e4-49ad-85e1-5b9a0dae752a","resolution":{"observed_at":"2026-08-11T05:31:07.252612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.540695Z","title":"Angora: Efficient Fuzzing by Principled Search","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.540695Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:19d7a6ea8c78a4df5668fb080894aa71456da89517bbdbf851baeef7088f68ee","observation_id":"c902bab6-ca3a-4851-9532-99ce31a16992","resolution":{"observed_at":"2026-08-11T05:31:05.540695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.235850Z","title":"An Unsolvable Problem of Elementary Number Theory","venue":null,"work_id":"5de519ff-0a86-4b90-b3f5-45e78e32c9cd","year":1936},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.545246Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:387cf61a7ef75be4e0c75efde2eb004325aa832a500aef9d34f102c61111d52e","observation_id":"3cbf85b9-46ac-48e7-9df4-9d7406a94f51","resolution":{"observed_at":"2026-08-11T05:31:07.239946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.223244Z","title":"The reusable holdout: Preserv- ing validity in adaptive data analysis","venue":null,"work_id":"74e05cad-59e6-45e4-a3fb-1b2ecfbec138","year":2015},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.549624Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:90c933cff42982dbe13e96fd8628414162488e7b0fdefb05d14afe185035e25f","observation_id":"88b556f3-9e90-4b39-8704-bc037375b9b7","resolution":{"observed_at":"2026-08-11T05:31:07.227165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.557241Z","title":"Transforming Science with Large Language Models: A Survey on AI-Assisted Scien- tific Discovery, Experimentation, Content Generation, and Evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.557241Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:54aecbf4edb145311879fb56512f4f664059004bbda7c6994fae660d1ed29ed7","observation_id":"cede52f7-c5b1-4f8a-a549-c5468ecb9208","resolution":{"observed_at":"2026-08-11T05:31:05.557241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.209675Z","title":"AFL++: Combining Incremental Steps of Fuzzing Research","venue":null,"work_id":"ed4e1b1c-44d0-4d19-aac6-1b269e4bf4f7","year":2020},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.562995Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:6251893a4f707a8d047c5630e21a4baa57481edc039b40f8672cf1c1e0eac076","observation_id":"ede82e73-2a80-4f52-a927-6c403a586144","resolution":{"observed_at":"2026-08-11T05:31:07.214798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.197357Z","title":"A Learning Machine: Part I","venue":null,"work_id":"d2139e33-0c5d-40c0-b6ed-18dd2e570668","year":1958},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.568749Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:afa8975933b0eef2c907ce017b978036e5da4aa72fe17fde88e9ffd85ef3acc9","observation_id":"6a2fcbb3-66ec-452c-9111-acaf35f683f9","resolution":{"observed_at":"2026-08-11T05:31:07.201753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.185010Z","title":"Scaling Laws for Reward Model Overoptimization","venue":null,"work_id":"c7b28930-4ccd-4536-80e1-fa0eec981dc3","year":2023},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.576690Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:c5e63f055773abe56379bf4b5b6940beef15bfdb1dbdd3436fc6427a3bf6533c","observation_id":"8b7caed5-02f5-4f46-b52b-e337cfeaa2b6","resolution":{"observed_at":"2026-08-11T05:31:07.189026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.172339Z","title":"Über formal unentscheidbare Sätze der Principia Mathematica und verwandter Systeme I","venue":null,"work_id":"aaa53a4b-d25d-4fc3-9e40-1455950e8490","year":1931},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.583105Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:bf201bc04ed37d04c975d3e18919de10757d2ecd8d41f44458ad7876f26d1c6c","observation_id":"dad6d249-a49c-4167-ad5a-125044987bd5","resolution":{"observed_at":"2026-08-11T05:31:07.177014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.160332Z","title":"Speculations Concerning the First Ul- traintelligent Machine","venue":null,"work_id":"059dbf76-a59e-4f87-b101-cb895d143cca","year":1966},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.588273Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:916f2c312085be4e4478b7742f5e7c3a20fe51ef982077a093496e71e5f931ab","observation_id":"3e3f8bcf-89a8-4b43-8905-4c9519949ef4","resolution":{"observed_at":"2026-08-11T05:31:07.164986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.147079Z","title":"Accelerating Scientific Discov- ery with Co-Scientist","venue":null,"work_id":"a453866c-1dc9-4da9-b26d-101d1b948d9f","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.596213Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:76ccd569d8ddbac79ee37b1445452774bcdd9ab9d82d7ca7ecfc3d98e2036dd5","observation_id":"c6f72cb1-493e-40f9-8061-d23580ada192","resolution":{"observed_at":"2026-08-11T05:31:07.152370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.133987Z","title":"Content Fuzzing for Escaping Information Cocoons on Digital Social Me- dia","venue":null,"work_id":"0cc559f1-b3ce-43c1-9062-dba1a89757a1","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.601942Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:f42b1bd14cef30c5ba8d5a6ee4c0e1b48cfb2fdcf826893070d1c3f20dadf55d","observation_id":"f7f6ac98-434c-4547-aa7a-19dfccbbf9a7","resolution":{"observed_at":"2026-08-11T05:31:07.138796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.119471Z","title":"MLA- gentBench: Evaluating Language Agents on Ma- chine Learning Experimentation","venue":null,"work_id":"d7299f55-f19b-4c7e-bdc3-f735f4a185a7","year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.607908Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:85d275462efa638782669eb4d4fe298bcc573252e6802cdc6aff0a4894afaf77","observation_id":"e656f7f1-c5a5-4d42-9f9b-a98aa3d0b9be","resolution":{"observed_at":"2026-08-11T05:31:07.124405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.104908Z","title":"ALE-Bench: A Benchmark for Long-Horizon Objective-Driven Algorithm Engineer- ing","venue":null,"work_id":"4118d25d-4f60-479c-8978-250e310aa2f5","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.614392Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:1853bf2e1a0cefa182e6d29da8a548fca0fad10890484cb52613bc1f922de1e4","observation_id":"d1bdcd0c-ed0e-4271-8342-d7129988cbda","resolution":{"observed_at":"2026-08-11T05:31:07.109605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.625385Z","title":"Evaluating Fuzz Testing","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.625385Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:3ee679a75a34f267462baa1c937fc8939bc1e89f30babfa8ec3b14b5cf3297ac","observation_id":"4f31befa-86ef-4230-803c-aa057a7b681d","resolution":{"observed_at":"2026-08-11T05:31:05.625385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.630357Z","title":"Abandoning Ob- jectives: Evolution through the Search for Novelty Alone","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.630357Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:fe937b21c04be0f13cebd9bcc9035850ab078d0703bf11af7a407dd03526dfc9","observation_id":"dcf6a9a9-5092-4591-b094-b579a35317bb","resolution":{"observed_at":"2026-08-11T05:31:05.630357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.636111Z","title":"On a Measure of the Information Provided by an Experiment","venue":null,"work_id":null,"year":1956},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.636111Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:0d507955ada1fd54ac47566307fc0c3148a3a76e77ebba5aa52acdb6861c81be","observation_id":"327d5189-2323-4076-8437-2fc726dd5868","resolution":{"observed_at":"2026-08-11T05:31:05.636111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24658","last_updated":"2026-05-19T16:11:13Z","snapshot_observed_at":"2026-07-06T23:10:38.548416Z","submitted_at":"2026-04-27T16:23:09Z","title":"The Last Human-Written Paper: Agent-Native Research Artifacts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.24658","snapshot_observed_at":"2026-08-11T05:31:05.643545Z","title":"Liu et al.The Last Human-Written Paper: Agent- Native Research Artifacts","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.643545Z"},"links":{"cited_paper":"/paper/2604.24658","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:f88e5b500e766f8a7387d58287bfacb796571e5b8e0ddacbaffbd498e16660e1","observation_id":"a2497f5c-202b-43aa-aa18-6c23d1e1bbe1","resolution":{"observed_at":"2026-08-11T05:31:05.643545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11910","last_updated":"2024-11-24T12:59:44Z","snapshot_observed_at":"2026-08-18T03:56:12.036803Z","submitted_at":"2024-11-17T13:40:35Z","title":"AIGS: Generating Science from AI-Powered Automated Falsification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11910","snapshot_observed_at":"2026-08-11T05:31:05.649250Z","title":"AIGS: Generating Science from AI- Powered Automated Falsification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.649250Z"},"links":{"cited_paper":"/paper/2411.11910","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:de284cfaa21be8bab0321a0fa3e9e173278bd9d821b6f5f5a09f6009f3d8c7fd","observation_id":"84105d83-9e65-4b30-9c70-4308e6a3555a","resolution":{"observed_at":"2026-08-11T05:31:05.649250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-08-20T13:44:59.356502Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-11T05:31:05.654896Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.654896Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:5b5c3fe0868e16b81457a8bbb259f8adbf90bf2a4d910bcf4a27c4910e754a06","observation_id":"55cbf69a-8c55-4d52-8ceb-9c52824d2ebc","resolution":{"observed_at":"2026-08-11T05:31:05.654896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.662457Z","title":"Prompt Fuzzing for Fuzz Driver Generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.662457Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:0dba78eceadbbe88a266ec56f10f6efee131428e27aa8b81e78e77d4adf92c19","observation_id":"69810099-83c5-4f73-be78-5b1523a4639b","resolution":{"observed_at":"2026-08-11T05:31:05.662457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.091386Z","title":"The Art, Science, and Engineering of Fuzzing: A Survey","venue":null,"work_id":"81b24e14-095c-44a1-99ae-203a0c713855","year":2021},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.667879Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:65ee9ea814fc450dca0647483a6a5ed00cd3319bfeae49eca14cc875e5b6d3d9","observation_id":"a878b3ff-5be8-4d0f-aad0-48bd62ddb05e","resolution":{"observed_at":"2026-08-11T05:31:07.095488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1504.04909","last_updated":"2015-04-20T01:17:00Z","snapshot_observed_at":"2026-08-15T13:07:45.856087Z","submitted_at":"2015-04-20T01:17:00Z","title":"Illuminating search spaces by mapping elites","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.04909","snapshot_observed_at":"2026-08-11T05:31:05.672812Z","title":"Illuminating Search Spaces by Mapping Elites","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.672812Z"},"links":{"cited_paper":"/paper/1504.04909","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:de8b76973dfe9206e1119e07a4933c04cb9633426051846359f94958da04eacf","observation_id":"abe0c065-81c7-4daf-8def-71ea10c51c1f","resolution":{"observed_at":"2026-08-11T05:31:05.672812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13131","last_updated":"2025-06-16T06:37:18Z","snapshot_observed_at":"2026-08-11T23:48:15.512738Z","submitted_at":"2025-06-16T06:37:18Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13131","snapshot_observed_at":"2026-08-11T05:31:05.680580Z","title":"AlphaEvolve: A Coding Agent for Scientific and Algorithmic Discovery","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.680580Z"},"links":{"cited_paper":"/paper/2506.13131","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:eb3e9a42cce73ff68e6a0e3e67062b45051e5fd88248c81142e5763f5ea2c7d1","observation_id":"edd5b415-64f5-40d3-a714-1412535c893f","resolution":{"observed_at":"2026-08-11T05:31:05.680580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.076713Z","title":"The Effects of Reward Misspecification: Mapping and Mitigating Misaligned Models","venue":null,"work_id":"f27556d4-f3dc-4d87-b0db-08dd25580333","year":2022},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.685691Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:3292a8e012eb8936a9402491ea7fae1620472eeaeb108d4093cd7100cab4291d","observation_id":"98d154a7-a2de-464c-bff0-1719fca737e8","resolution":{"observed_at":"2026-08-11T05:31:07.081520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.062214Z","title":"LLM Evaluators Recognize and Favor Their Own Generations","venue":null,"work_id":"e8bd44ea-baa3-488d-b8dc-822938889ea6","year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.689743Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:681bc687ad3a020008dae9fcf0e56af5f26fc130394c10c5b23e5d1b558262a7","observation_id":"1b570125-e1be-4fa7-8aae-274736b48b0b","resolution":{"observed_at":"2026-08-11T05:31:07.068448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.05363","last_updated":"2017-05-15T17:56:22Z","snapshot_observed_at":"2026-08-14T21:00:36.063090Z","submitted_at":"2017-05-15T17:56:22Z","title":"Curiosity-driven Exploration by Self-supervised Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.05363","snapshot_observed_at":"2026-08-11T05:31:05.693685Z","title":"Curiosity-driven Exploration by Self-supervised Pre- diction","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.693685Z"},"links":{"cited_paper":"/paper/1705.05363","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:2fe62d7ab51fd754d8f0cea5e9e47342fa56d0ba921f693c6e6e33ef165b7fcb","observation_id":"dcbec012-f47d-4d52-8eca-1f097e44a7c4","resolution":{"observed_at":"2026-08-11T05:31:05.693685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.698039Z","title":"Modern Bayesian Experimental De- sign","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.698039Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:89adb0775a4a7ad43afee4e14bad6ca49a67945389cdaf194960b1dbe0310730","observation_id":"41b61815-a489-4a45-9912-ca47b4969ff3","resolution":{"observed_at":"2026-08-11T05:31:05.698039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.046013Z","title":"Towards Scientific Dis- covery with Generative AI: Progress, Opportunities, and Challenges","venue":null,"work_id":"c5415bad-54b6-484b-8e39-603fe1aea6dd","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.701986Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:323e6a03e0fc33b3a67899479202abaf8936d797a1d5af17e2a961ab2a390c7e","observation_id":"4b692380-1411-42ad-a1ed-2a625398ee74","resolution":{"observed_at":"2026-08-11T05:31:07.051576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.032455Z","title":"Classes of Recursively Enumerable Sets and Their Decision Problems","venue":null,"work_id":"363ad7ae-cf63-4bc8-b810-1eaa67a18eb0","year":1953},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.705473Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:f1bccd45ec7cf9a5a044a90e089afc916456cb02c8a4d04fde688eec37b97a25","observation_id":"aed8d400-f8a6-4d2f-9da4-51dfc71d1256","resolution":{"observed_at":"2026-08-11T05:31:07.037142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.019667Z","title":"Mathematical Discoveries from Program Search with Large Language Models","venue":null,"work_id":"fb445f4e-a05d-47a1-bb54-14a03de85e35","year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.709150Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:b171059b0b718e1b56bb5a1d50e1b8cb4af603e8221a9450a254b85c09d7f8ad","observation_id":"24555c14-c00f-4e40-bea1-b7a7a65dd82e","resolution":{"observed_at":"2026-08-11T05:31:07.023915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.004094Z","title":"Agent Laboratory: Using LLM Agents as Research Assistants","venue":null,"work_id":"ca306f9e-58c5-4624-bc61-4674189f392c","year":null},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.712742Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:de3692603d4f4a888e2326de18453ef6e2b6983dc8d067f3c87b809d147df614","observation_id":"82729eb0-7210-409f-b00c-4915c235f44b","resolution":{"observed_at":"2026-08-11T05:31:07.010463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.970358Z","title":"Ultimate Cognition à la Gödel","venue":null,"work_id":"357753c7-0559-4193-a2b0-ca27baf4c75b","year":2009},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.724853Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:9539446f4f5214a3c7e8ef6eff4e156cc5a398dafaa3c1e6b5423ea150426159","observation_id":"93eec5fd-7ca7-48ed-a0f9-7479716bd5a6","resolution":{"observed_at":"2026-08-11T05:31:06.976105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.952411Z","title":"Can LLMs Generate Novel Research Ideas? A Large-Scale Hu- man Study with 100+ NLP Researchers","venue":null,"work_id":"db44780a-b5fa-4aac-a0ed-66e2441a2dc9","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.728789Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:b84e256f85f68fba6f279f077f303278e2b7583f786ef329c08997571118b1af","observation_id":"b3ecce25-ea2f-470e-80f4-4ab4ecbd7341","resolution":{"observed_at":"2026-08-11T05:31:06.958952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.934097Z","title":"Defining and Characterizing Reward Gaming","venue":null,"work_id":"cd13e9a3-b58a-4b50-96ae-a12a61b06558","year":2022},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.738529Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:bb6838586055780bcf55e699fe315bdd7217312cd20d7b800dd3aaaafb1be34c","observation_id":"a0f3035e-3e98-43d7-84f1-38eb1e279e83","resolution":{"observed_at":"2026-08-11T05:31:06.938619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.918608Z","title":"Scaling LLM Test-Time Compute Optimally Can Be More Effec- tive than Scaling Parameters for Reasoning","venue":null,"work_id":"dd09583c-f4ee-452d-88b3-c1dadb992185","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.745894Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:caba9426e4a71c11a856d1aab68018a7ddc2151ceb0c812b258409ecbfb9d9de","observation_id":"92bfde03-4666-4856-ac0e-9bc02d92e969","resolution":{"observed_at":"2026-08-11T05:31:06.924035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.906190Z","title":null,"venue":null,"work_id":"97d408c9-ac9b-485a-9d69-e7f8c925dee9","year":2019},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.752407Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:d1c693c9e97059e0b2567280f1df915c4fd474773839dd7625a2c477698fe5b1","observation_id":"91f095d7-c654-451b-8739-01a8a8443623","resolution":{"observed_at":"2026-08-11T05:31:06.910001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.893057Z","title":"The Virtual Lab of AI agents designs new SARS-CoV-2 nanobodies","venue":null,"work_id":"16900714-0c4d-40fe-8ee4-7f1b17da257b","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.757416Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:8274016816d8743ecab69adf4b91c706015e988c3508c96cb305b95a772231aa","observation_id":"a7398345-f1b0-454c-b858-3690a35788fe","resolution":{"observed_at":"2026-08-11T05:31:06.898150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.879483Z","title":"AI Research Agents for Ma- chine Learning: Search, Exploration, and General- ization in MLE-bench","venue":null,"work_id":"e716fd1f-68b0-4dae-9f9d-4099af60d6e4","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.764745Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:ceccd3147b31ad4f1df71828ba444ccc4e8268aa9dfb51050f22a58bfdecd197","observation_id":"f488f85d-9881-4b70-a391-4c98a13d30d1","resolution":{"observed_at":"2026-08-11T05:31:06.884106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.865110Z","title":"On Computable Numbers, with an Application to the Entscheidungsproblem","venue":null,"work_id":"b2246baa-0663-4ea4-a214-7a76140f701f","year":1936},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.769303Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:ee5a84fc11febc49f5989a861c101c142c8352b751ec2d39a78b4baa23ed0fbb","observation_id":"37909d0c-1004-46a1-8ff6-0629446e772b","resolution":{"observed_at":"2026-08-11T05:31:06.870103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.851200Z","title":"Large Language Models are not Fair Evaluators","venue":null,"work_id":"ff70b79e-0ebf-4cfb-916c-8b6bd3a727be","year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.777110Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:8426b8d47916c50d4c81b767d9b86a015123f6f859e3446d23f01355c039071a","observation_id":"bcca53e0-4df5-45aa-b8be-f2bddb4583d8","resolution":{"observed_at":"2026-08-11T05:31:06.855947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.835708Z","title":"RE-Bench: Evaluating Frontier AI R&D Capabilities of Language Model Agents against Human Experts","venue":null,"work_id":"de693efb-8f9a-42cb-b1b9-ddf9feaaf699","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.783973Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:94532695458f39e1dea711c9f807fb9d1e88322a34e4ee1d4bb7cff644c64d67","observation_id":"7619f226-e7de-45f8-accd-2b2b0483ce93","resolution":{"observed_at":"2026-08-11T05:31:06.841600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-10T03:18:36.275195Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-11T05:31:05.788489Z","title":"The AI Scientist- v2: Workshop-Level Automated Scientific Discov- ery via Agentic Tree Search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.788489Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:5a87b620fb211490131f2963c286c9c4d5ba92dac91736bc5f974c37250bda59","observation_id":"9f82b0d5-4471-486d-a775-bfce9c322e00","resolution":{"observed_at":"2026-08-11T05:31:05.788489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.814343Z","title":"NAS Evaluation Is Frustratingly Hard","venue":null,"work_id":"b00c62b3-e29d-4765-9ebb-a46c2c6da70f","year":2020},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.792859Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:6c9eaa4392b20f8232fcd4a6b0b222a6a84305cda5f686ff2b109f4bcfc675e2","observation_id":"892aa5ec-4dbd-4629-ad3c-5b2d2302393d","resolution":{"observed_at":"2026-08-11T05:31:06.818921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01708","last_updated":"2024-12-02T16:55:03Z","snapshot_observed_at":"2026-08-19T12:35:41.035290Z","submitted_at":"2024-12-02T16:55:03Z","title":"Are We There Yet? Revealing the Risks of Utilizing Large Language Models in Scholarly Peer Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01708","snapshot_observed_at":"2026-08-11T05:31:05.797221Z","title":"Are We There Yet? Revealing the Risks of Utilizing Large Language Models in Scholarly Peer Review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.797221Z"},"links":{"cited_paper":"/paper/2412.01708","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:31af9081bb2e212e24aed0098b867f8c0b706a03fc668d1021ffbead68500ba5","observation_id":"a49e3060-957f-4a10-9ef6-213a7d1157ea","resolution":{"observed_at":"2026-08-11T05:31:05.797221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.801485Z","title":"Dolphin: Moving Towards Closed- loop Auto-research through Thinking, Practice, and Feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.801485Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:3469ed0867603219da76a1e61541ce7320afd5e9f62035da5063ea9b51760685","observation_id":"10e3487c-48c1-42b2-8ae8-14f3fa9a4e41","resolution":{"observed_at":"2026-08-11T05:31:05.801485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.798536Z","title":"Position: LLMs Can’t Jump","venue":null,"work_id":"d72e3bb2-e5bc-4538-9272-17e7995522d7","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.805313Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:9e19083ac26aa0ff8d3728875901b5873c5daffc61b3b275a96ccc8439f450e4","observation_id":"548ea2b2-01c4-40e8-8615-b60037ec01e3","resolution":{"observed_at":"2026-08-11T05:31:06.804773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.785189Z","title":"Zalewski.American Fuzzy Lop (AFL)","venue":null,"work_id":"53c56256-5da2-4eee-9499-52362fa17951","year":2013},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.808978Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:27b0b399891a8186d5e20a7e6cd6cc169f0a4271ced42bc39b880f07bd3ea0f4","observation_id":"ad627df0-b705-4295-ad88-1ee918b62c1c","resolution":{"observed_at":"2026-08-11T05:31:06.789945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3654.37937","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.985444Z","title":"LLAMA- FUZZ: Large Language Model Enhanced Greybox Fuzzing","venue":null,"work_id":"2921701a-cff4-40df-8843-3ca155beb307","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.812639Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:856198b3a8c37c55e74dff0f58194b1d1c2d7ea21cbdf4897c2120ffb3f6fe2b","observation_id":"885c986b-eac3-4395-b451-94c833bb0e6d","resolution":{"observed_at":"2026-08-11T05:31:06.005863Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.773600Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","venue":null,"work_id":"c587cb31-d4df-44d3-a39e-3cc19d518784","year":2023},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.816414Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:4bf609e47ab4d3ecf4490168d063f1f328bd2894179ebcad2da7941e24c11d43","observation_id":"9ce60152-0e53-42d5-9555-dbdde4bbee69","resolution":{"observed_at":"2026-08-11T05:31:06.777396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.759582Z","title":"Neural Architecture Search with Reinforcement Learning","venue":null,"work_id":"c09a4972-e2d0-4dcd-bc56-308a1d0cded3","year":2017},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.820448Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:cf79073857a9ec4a5b1b2851fc5e982968e8c46b84e42e3c663cfe507ed4c6b5","observation_id":"24e4d74f-04dd-4c9a-9b19-1fe4016cdedb","resolution":{"observed_at":"2026-08-11T05:31:06.763454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.987827Z","title":"5977–6043.DOI: 10","venue":null,"work_id":"c4da919c-49c3-4cf2-9be2-455636892211","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.720662Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:c651912b57ccbd8ea7f3c6c9f1440032dc7d70cbf1c1b9ed27c3697d60f8bb79","observation_id":"5bbfe757-0dc0-45c7-84de-a895aec551b4","resolution":{"observed_at":"2026-08-11T05:31:06.993181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":37},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2608.09855."}