{"as_of":"2026-08-23T03:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:31e62defc1a9800db4846076e0996245ac4f26dd95b924bd4bec0fb16f83723b","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:11:05.605570Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12564/citation-record","integrity":"/paper/2608.12564/integrity","json":"/paper/2608.12564/citation-record.json","paper":"/paper/2608.12564"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-08-20T13:44:59.356502Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-16T00:11:05.283953Z","title":"The AI scientist: Towards fully automated open-ended scientific discovery.arXiv preprint arXiv:2408.06292, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.283953Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:55167411d52e9a4d14c07ee9bdc7f5c5a34675272fedf48102cad12d44a62b3e","observation_id":"7c2d0b47-dbc7-4ba4-b8e2-e18216e49ae4","resolution":{"observed_at":"2026-08-16T00:11:05.283953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18864","snapshot_observed_at":"2026-08-16T00:11:05.290228Z","title":"Towards an AI co-scientist.arXiv preprint arXiv:2502.18864, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.290228Z"},"links":{"cited_paper":"/paper/2502.18864","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:c5c2b0ba78872a93aae177de6f32dc6772707c0b557d784792434146145bbd12","observation_id":"ec215b5f-35c3-4aab-91ec-11f18071cb5e","resolution":{"observed_at":"2026-08-16T00:11:05.290228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04227","last_updated":"2025-06-17T16:19:14Z","snapshot_observed_at":"2026-08-20T09:43:35.499735Z","submitted_at":"2025-01-08T01:58:42Z","title":"Agent Laboratory: Using LLM Agents as Research Assistants","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04227","snapshot_observed_at":"2026-08-16T00:11:05.295789Z","title":"Agent laboratory: Using LLM agents as research assistants.arXiv preprint arXiv:2501.04227, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.295789Z"},"links":{"cited_paper":"/paper/2501.04227","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:bf0b68dd3df00ae08b33bc071fbf2b66037970ee045fa633b4da12cc13ca9f67","observation_id":"e739cc44-fa7d-4bc4-9bea-3306fe2b801d","resolution":{"observed_at":"2026-08-16T00:11:05.295789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.301305Z","title":"ReAct: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.301305Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:2c5e5f50543910725b16c134fde33d420172f34d5452e28d3df5ee0a56beb0c1","observation_id":"5264f757-8978-433b-a3d4-cccf44dd7a7f","resolution":{"observed_at":"2026-08-16T00:11:05.301305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.810548Z","title":"Tree of thoughts: Deliberate problem solving with large language models","venue":null,"work_id":"7d30ab97-919e-4575-adb5-4033ce899b4c","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.306280Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:f535bcc641b65c40ff74c20b218815eeb888d274d021dbac293c53f5cc2bd49f","observation_id":"6851048e-6496-4525-a9f5-200d3a5d36a3","resolution":{"observed_at":"2026-08-16T00:11:06.815673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.795025Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":"b2c82b24-c0bb-48ad-8066-274242c48038","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.311620Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:2a1163135fbb03d4a74120c4e053d75da1ed9c45f29773fa123627d72200092b","observation_id":"2be3fba0-ce69-4de5-b1b8-a0b462ea6457","resolution":{"observed_at":"2026-08-16T00:11:06.800489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.317141Z","title":"Boiko, Robert MacKnight, Ben Kline, and Gabe Gomes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.317141Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:8f964004640fd2ff3281ca9be96f8cea2a0dec8f6e93ba1414973939164328b4","observation_id":"2f9c642f-3d07-4108-95be-3c82526bd47e","resolution":{"observed_at":"2026-08-16T00:11:05.317141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.768426Z","title":"Augmenting large language models with chemistry tools.Nature Machine Intelligence, 6(5):525–535, 2024","venue":null,"work_id":"e7bab12b-e11f-4c86-9e63-02e5f7a57156","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.321738Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:08c3bcb96c830a0bdec7cd16f7d5d3f222014434c4687d47601d0717de10be1e","observation_id":"cfb74660-e33f-4f0c-b01c-e6db6ae5b493","resolution":{"observed_at":"2026-08-16T00:11:06.773718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.753337Z","title":"An autonomous laboratory for the accelerated synthesis of novel inorganic materials.Nature, 624:86–91, 2023","venue":null,"work_id":"3c85282f-91a4-4207-9126-444242c128ea","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.326136Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:7f2005f42bc71cb163ef1b8c2a9a50559f32f23c4a0f09e18e6fccc796d6c9cb","observation_id":"36d5b75f-7e46-420b-8033-370916790f13","resolution":{"observed_at":"2026-08-16T00:11:06.757818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13138","last_updated":"2025-02-18T18:57:21Z","snapshot_observed_at":"2026-08-05T07:03:00.655237Z","submitted_at":"2025-02-18T18:57:21Z","title":"AIDE: AI-Driven Exploration in the Space of Code","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13138","snapshot_observed_at":"2026-08-16T00:11:05.330947Z","title":"AIDE: AI-driven exploration in the space of code.arXiv preprint arXiv:2502.13138, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.330947Z"},"links":{"cited_paper":"/paper/2502.13138","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:adef22009feb8bf4c864b56c9cc7457d6efd85ba1eb73b629d9ff01ec3fd6159","observation_id":"4d2c54d5-b03b-47c7-8283-72f98edf4951","resolution":{"observed_at":"2026-08-16T00:11:05.330947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.738531Z","title":"DS-Agent: Automated data science by empowering large language models with case-based reasoning","venue":null,"work_id":"6b7db4f9-fc6b-476f-bb0c-63824942d3c6","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.336163Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:349a1984c7c6e0eadeb59c53254dc7d1d8585d04724cbb50b1a58be3231c1c6a","observation_id":"c92a7e88-e0d7-4683-b7a3-8df5f8fc1483","resolution":{"observed_at":"2026-08-16T00:11:06.743544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.724279Z","title":"MLAgentBench: Evaluating language agents on machine learning experimentation","venue":null,"work_id":"44395dc2-8b4d-4e0b-aed5-51880896c493","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.341343Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:04ee824b01f953a0d740127fcbd4fd68f4428b2ce8c7f4feb7736fe34bda697c","observation_id":"b8a2f26d-6207-4fed-8109-db7b81ec4956","resolution":{"observed_at":"2026-08-16T00:11:06.728662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T00:11:05.345933Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.345933Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:6d6ded56102cb1e15a319ddfef55790cdafe0c02e88b404aa9f5b92255ac7976","observation_id":"5a8b0a89-9c0e-453a-8806-78185b3a7665","resolution":{"observed_at":"2026-08-16T00:11:05.345933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-16T00:11:05.350677Z","title":"DeepSeekMath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.350677Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:89a9153aababf0d3a665ecb9d0f7ab875a1e477b5e27556674aab1b6fb4e2dfb","observation_id":"efb3001a-af35-4f44-b3d8-005113899b11","resolution":{"observed_at":"2026-08-16T00:11:05.350677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-17T14:11:00.232598Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-16T00:11:05.355314Z","title":"Tulu 3: Pushing frontiers in open language model post-training.arXiv preprint arXiv:2411.15124, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.355314Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:894e4966cd73eabd527497b456050f59fd045adcc7c33c696c51d778e8367881","observation_id":"097dac6f-4047-4b2d-b1dc-10f19f94605b","resolution":{"observed_at":"2026-08-16T00:11:05.355314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-16T00:11:05.360160Z","title":"DeepSeek-R1: Incentivizing reasoning capability in LLMs via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.360160Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:3ce1fa0d8d890f0ff0b91bce18d55bda1bb661326f000b3991fbfcd7b9837a1b","observation_id":"998db60e-2b3d-4e9e-8844-e11e53591ed9","resolution":{"observed_at":"2026-08-16T00:11:05.360160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.710034Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":"bf2e3280-9dee-408b-b280-c84e2d20f86b","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.364338Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:cd6353a5a9af4cbf1f79331af296e0c5b90db05cbf01699ecbe33af826dff725","observation_id":"a81ed9b4-8c04-4747-b143-f9f3a31a40d7","resolution":{"observed_at":"2026-08-16T00:11:06.714482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.368716Z","title":"Gonzalez, Clark Barrett, and Ying Sheng","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.368716Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:6b66042efc4fd909768be773323a2b30ff528bb05ee13bbf16f9292a610c05db","observation_id":"6c51220d-6fe0-404e-b0f9-e5c60f8ca9dc","resolution":{"observed_at":"2026-08-16T00:11:05.368716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07782","last_updated":"2025-05-12T17:35:43Z","snapshot_observed_at":"2026-08-17T02:29:08.239672Z","submitted_at":"2025-05-12T17:35:43Z","title":"MLE-Dojo: Interactive Environments for Empowering LLM Agents in Machine Learning Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07782","snapshot_observed_at":"2026-08-16T00:11:05.373386Z","title":"MLE-Dojo: Interactive environments for empowering LLM agents in machine learning engineering.arXiv preprint arXiv:2505.07782, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.373386Z"},"links":{"cited_paper":"/paper/2505.07782","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:fbe658afaa6402a320abe62348c62662c6e37ef6e0948301bf48d1d72d0b120d","observation_id":"25e21d07-2a55-48e6-993c-df7cce75a138","resolution":{"observed_at":"2026-08-16T00:11:05.373386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.378163Z","title":"SWE-World: Building software engineering agents in docker-free environments.arXiv preprint arXiv:2602.03419, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.378163Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:82f529081ce848a521bfb19d4ec395b4e63d8886b9e364373903ccfe5d83119d","observation_id":"608f95c0-b593-4d83-ae20-28bf0dc520cc","resolution":{"observed_at":"2026-08-16T00:11:05.378163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-08-18T07:04:58.690133Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-16T00:11:05.382737Z","title":"World models.arXiv preprint arXiv:1803.10122, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.382737Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:43ea2f9dc86b97e70e5adec2c3e81f00a745b6d93f52a1de2948d4dfff20ea23","observation_id":"2655ffa2-dfcb-4c73-bb60-31ff3095b7d9","resolution":{"observed_at":"2026-08-16T00:11:05.382737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.387851Z","title":"Mastering diverse control tasks through world models.Nature, 640(8059):647–653, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.387851Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:a810966e215ada887113d22bd62911444a6148269f28f34babd1fbeaa4c5e607","observation_id":"aa1922a4-b213-41d8-903f-f5d416327c43","resolution":{"observed_at":"2026-08-16T00:11:05.387851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13131","last_updated":"2025-06-16T06:37:18Z","snapshot_observed_at":"2026-08-20T22:23:36.450758Z","submitted_at":"2025-06-16T06:37:18Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13131","snapshot_observed_at":"2026-08-16T00:11:05.392258Z","title":"Alphaevolve: A coding agent for scientific and algorithmic discovery.arXiv preprint arXiv:2506.13131, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.392258Z"},"links":{"cited_paper":"/paper/2506.13131","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:332bd8669efe2a4ddeffb7dcfac23e82a6affcc5383b67da53b9c425d9c5fc65","observation_id":"fcdf4f54-da5b-4440-a27c-ca89974482f3","resolution":{"observed_at":"2026-08-16T00:11:05.392258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-10T03:18:36.275195Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-16T00:11:05.396676Z","title":"The AI scientist-v2: Workshop-level automated scientific discovery via agentic tree search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.396676Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:8bf9b189413a006eb76da485cf6c8c4318a980d3080142654e21ee3cc83255d6","observation_id":"727bb985-c958-41d2-bc63-37c8b6f31c0c","resolution":{"observed_at":"2026-08-16T00:11:05.396676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.25996","last_updated":"2026-07-04T15:07:51Z","snapshot_observed_at":"2026-08-07T11:35:11.679286Z","submitted_at":"2026-06-24T16:08:31Z","title":"Autodata: An agentic data scientist to create high quality synthetic data","version":3},"cited_work":{"arxiv_id":"2606.25996","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.25996","snapshot_observed_at":"2026-08-16T00:11:06.010206Z","title":"Autodata: An agentic data scientist to create high quality synthetic data","venue":"cs.AI","work_id":"5e63ab9e-4e02-4374-a191-9c7f537fe84e","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.401852Z"},"links":{"cited_paper":"/paper/2606.25996","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:b658e41a1638f9ce825cee648ebf7fcb0a7b5d867595d83e824b5d3bbf0f7257","observation_id":"b93fff4c-4f57-4476-85b5-bf4b9100212c","resolution":{"observed_at":"2026-08-16T00:11:06.016028Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.674195Z","title":"Many ai analysts, one dataset: Navigating the agentic data science multiverse.Proceedings of the National Academy of Sciences, 123(29):e2606495123, 2026","venue":null,"work_id":"82f497a7-5368-47d3-b207-24498ec6e561","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.406796Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:3d56e9e1fcd444e8cfb21c3aa2ff57766b671f383a3d325d8d5a5a9315699386","observation_id":"61e3b663-eceb-4065-be7b-e0846ee531c6","resolution":{"observed_at":"2026-08-16T00:11:06.679606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.28568","last_updated":"2026-07-30T17:34:01Z","snapshot_observed_at":"2026-08-19T10:38:19.888021Z","submitted_at":"2026-07-30T17:34:01Z","title":"Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering","version":1},"cited_work":{"arxiv_id":"2607.28568","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.28568","snapshot_observed_at":"2026-08-16T00:11:05.986601Z","title":"Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering","venue":"cs.CL","work_id":"33a1190b-e02e-451d-a879-fffadc8c3737","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.412479Z"},"links":{"cited_paper":"/paper/2607.28568","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:ca2d704b945c82ed9f8748007f6cdd50761135c5d152c968412e97f23ff0ff8d","observation_id":"e294bd39-cd7a-4ec8-b399-db27afb1a928","resolution":{"observed_at":"2026-08-16T00:11:05.992329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.658249Z","title":"First steps toward automated AI research.https://www.recursive.com/articles/ first-steps-toward-automated-ai-research, 2026","venue":null,"work_id":"b606f74f-b6a9-43b7-9d2e-d8fa241eb9d1","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.416968Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:f5514db1156ad02fa96a4b86d575f9cb2123b0418e595a3285901f7cd8014533","observation_id":"4f3c2a86-73fa-4561-927b-0f3d5231c03a","resolution":{"observed_at":"2026-08-16T00:11:06.662919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07095","last_updated":"2025-02-26T11:57:30Z","snapshot_observed_at":"2026-08-12T16:49:10.970507Z","submitted_at":"2024-10-09T17:34:27Z","title":"MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07095","snapshot_observed_at":"2026-08-16T00:11:05.421563Z","title":"MLE-bench: Evaluating machine learning agents on machine learning engineering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.421563Z"},"links":{"cited_paper":"/paper/2410.07095","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:72d2db50b979fdaedbde6cc0f931e965a195a0420b593d23eede0a8c89f73f7f","observation_id":"a45f5d05-2779-4526-9a76-dded855d8324","resolution":{"observed_at":"2026-08-16T00:11:05.421563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07703","last_updated":"2025-04-11T14:12:58Z","snapshot_observed_at":"2026-08-16T13:19:17.301957Z","submitted_at":"2024-09-12T02:08:00Z","title":"DSBench: How Far Are Data Science Agents from Becoming Data Science Experts?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07703","snapshot_observed_at":"2026-08-16T00:11:05.426462Z","title":"DSBench: How far are data science agents from becoming data science experts?arXiv preprint arXiv:2409.07703, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.426462Z"},"links":{"cited_paper":"/paper/2409.07703","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:481232294dba02477834237ee6d04ea347f5e50bf489f326568edd7044bfae5b","observation_id":"0505398e-866a-4ed1-b3b9-e530c2833f49","resolution":{"observed_at":"2026-08-16T00:11:05.426462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14499","last_updated":"2025-02-20T12:28:23Z","snapshot_observed_at":"2026-08-17T16:58:05.353739Z","submitted_at":"2025-02-20T12:28:23Z","title":"MLGym: A New Framework and Benchmark for Advancing AI Research Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14499","snapshot_observed_at":"2026-08-16T00:11:05.431277Z","title":"MLGym: A new framework and benchmark for advancing AI research agents.arXiv preprint arXiv:2502.14499, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.431277Z"},"links":{"cited_paper":"/paper/2502.14499","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:dc36a0aef5b4979f90fabded1d2636de2c1415b3b9a613a23973025819ee03c4","observation_id":"6eaa9709-9a1e-41b6-bf51-9d6997341e93","resolution":{"observed_at":"2026-08-16T00:11:05.431277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.643512Z","title":"SWE-bench: Can language models resolve real-world GitHub issues? InInternational Conference on Learning Representations, 2024","venue":null,"work_id":"760e3fd6-7e85-45a0-9359-eb6b672393c2","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.435987Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:c51008d30b7c86c5fed7253272b669f51694f7884a34463af6f90b063f403274","observation_id":"af1390d8-b1e8-4ff5-9714-483ba9b94d05","resolution":{"observed_at":"2026-08-16T00:11:06.648357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.628926Z","title":"SWE-agent: Agent-computer interfaces enable automated software engineering","venue":null,"work_id":"a0777745-d10e-484e-ba81-44af8b896b39","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.440413Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:94f618b3f759b92adf83723c8d1443ecd71ae405425f9fb682244f4473f7d0a5","observation_id":"b3e4f2f7-3fe1-4c38-a482-0b6eb81bba12","resolution":{"observed_at":"2026-08-16T00:11:06.633550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.614630Z","title":"OpenHands: An open platform for AI software developers as generalist agents","venue":null,"work_id":"b8ad229b-910b-44eb-a471-b0eb90e8ce9a","year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.445371Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:05ee7a4ad4b47bc76e6a55802db396c21d2d05ab861fb5f0e095f090453c8217","observation_id":"7dc99044-2aa0-45e3-b06e-b3a9fb5adf76","resolution":{"observed_at":"2026-08-16T00:11:06.619381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.599796Z","title":"Training software engineering agents and verifiers with SWE-Gym","venue":null,"work_id":"aa231ef9-821a-4867-b048-947945ec6383","year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.450245Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:1d0783060c228b15731a9d6fd1d8de8e15c7c4403ee57b81bc862af9ef5af27f","observation_id":"c4568b76-f7fa-40a3-b4df-164256650064","resolution":{"observed_at":"2026-08-16T00:11:06.604504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-16T00:11:05.454659Z","title":"HybridFlow: A flexible and efficient RLHF framework.arXiv preprint arXiv:2409.19256, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.454659Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:7b39b93d0eb2e07c3c1e044546cc9d74fd96be5978f8ddf3bf4d2d0fa30381f2","observation_id":"77e6e16d-97a1-4c87-82ff-1700845d1341","resolution":{"observed_at":"2026-08-16T00:11:05.454659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.24218","last_updated":"2026-05-22T20:59:20Z","snapshot_observed_at":"2026-08-14T22:03:51.159938Z","submitted_at":"2026-05-22T20:59:20Z","title":"QUEST: Training Frontier Deep Research Agents with Fully Synthetic Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24218","snapshot_observed_at":"2026-08-16T00:11:05.459539Z","title":"QUEST: Training frontier deep research agents with fully synthetic tasks.arXiv preprint arXiv:2605.24218, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.459539Z"},"links":{"cited_paper":"/paper/2605.24218","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:e88ca50f09182c07a7c4194d5aa0e84bb70898a165986ea58e75b9f4e9ed3f80","observation_id":"42822062-6128-46d8-a4c2-8edd867ce859","resolution":{"observed_at":"2026-08-16T00:11:05.459539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-18T05:01:20.543826Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-16T00:11:05.464570Z","title":"DAPO: An open-source LLM reinforcement learning system at scale.arXiv preprint arXiv:2503.14476, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.464570Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:32098de87094f56a9e23e99d4ccb5cf11aa9f9e41ad531ef125e0171e35515a1","observation_id":"a07e5786-d97b-4376-98c6-c8452eca5218","resolution":{"observed_at":"2026-08-16T00:11:05.464570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.469995Z","title":"POPE: Learning to reason on hard problems via privileged on-policy exploration.arXiv preprint arXiv:2601.18779, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.469995Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:eb2b062256c966dd0b552ab1de6bc8bed1260db61b6380b54b4ecd667609dc8b","observation_id":"5cc2bb77-c737-4729-b13d-ecde956b9baa","resolution":{"observed_at":"2026-08-16T00:11:05.469995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.475411Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.475411Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:53e4abc1f476dac60343e0ee29ebf3ad12979819b6bdeb3ee83b2517898413e8","observation_id":"0d46434a-3322-4aa5-b9c2-da49b6751cd6","resolution":{"observed_at":"2026-08-16T00:11:05.475411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.571838Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":"1000db2c-b5af-4084-98cb-a7a7792f2f50","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.480073Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:1a816576666c42269c3cc0c735cad97cf4d40ba44bc8fb514a3078ca2e2c260a","observation_id":"434dd338-9b49-4224-a160-fa6205ecd68f","resolution":{"observed_at":"2026-08-16T00:11:06.578742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.484296Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.484296Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:a384b5f1dc8a0c224b23c650aedb9c432ef43ca26bf29bac3dd88112fe249f07","observation_id":"e1b38f00-1767-42d9-868a-59087a1c57fd","resolution":{"observed_at":"2026-08-16T00:11:05.484296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-16T00:11:05.488861Z","title":"Cosmos world foundation model platform for physical AI.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.488861Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:8144b504f570e7aed01d2905e0638c2c44841f286e372d27a7916e347c717662","observation_id":"3a92242f-485b-4bb6-a579-4539cd83e6c0","resolution":{"observed_at":"2026-08-16T00:11:05.488861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.545675Z","title":"Generating code world models with large language models guided by monte carlo tree search","venue":null,"work_id":"defe401c-4f62-4541-a75d-1810dc1339e4","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.493494Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:e01eab2c4c7f7a59bfc11f2a6be831df2cd603b4bbff1ec9612a0a9e2d48a24c","observation_id":"0be95e50-7915-4645-b531-0f2bfda7f7a1","resolution":{"observed_at":"2026-08-16T00:11:06.551364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.528422Z","title":"Worldcoder, a model-based LLM agent: Building world models by writing code and interacting with the environment","venue":null,"work_id":"096c6943-e58f-4beb-a655-ef7d7591d6f6","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.497930Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:45458bbcbbc5064accfd52de1030f5de9568a48523b89d0cc929af757025d3bd","observation_id":"48c3c47c-a4e5-45d4-9e33-19e18bde0b75","resolution":{"observed_at":"2026-08-16T00:11:06.534218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.512312Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":"0d98042e-3fba-4451-9eef-111b9c2de592","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.502476Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:7a50d07b6c4184bf004dfa9696501015390a57c7490ef4cfcb04607b074bd018","observation_id":"0add552b-e8ed-4733-9d3c-07bc712ab87f","resolution":{"observed_at":"2026-08-16T00:11:06.517603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.506885Z","title":"Reward model ensembles help mitigate overoptimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.506885Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:f6a874d41fd71434fae000349abfa2991a85d3f12dda2a8d2c464d45b11a6923","observation_id":"7cf83f13-c3f8-4400-bff5-fc5fbf52264a","resolution":{"observed_at":"2026-08-16T00:11:05.506885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-08-13T17:59:32.644760Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-16T00:11:05.511374Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.511374Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:a99779f767755186d1a7ff814e3758b24709d6c1fe6547b9db239e8c8c506a21","observation_id":"a8d2a9b0-60ed-46c8-801d-1ddebbd4ebb6","resolution":{"observed_at":"2026-08-16T00:11:05.511374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.486771Z","title":"Transforming classifier scores into accurate multiclass probability estimates","venue":null,"work_id":"fd0ae3a2-0412-40c6-9fb6-03c01ed28af5","year":2002},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.516199Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:301d30567f3703847408d39ee0293358cae13f13b533ff12f74f4c59fea6a743","observation_id":"40081426-dc0a-4591-b720-63c76cae791d","resolution":{"observed_at":"2026-08-16T00:11:06.491718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.471035Z","title":"Weinberger","venue":null,"work_id":"ca1855c6-6f19-4be5-a10d-22183926f016","year":2017},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.520562Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:d3f242f91ac73f739637b83eb3e18710e823e68d7d6d3732175cba2759bacf8b","observation_id":"e29755e3-d629-4b54-b256-905a8540f44f","resolution":{"observed_at":"2026-08-16T00:11:06.476606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.456631Z","title":"DualDICE: Behavior-agnostic estimation of dis- counted stationary distribution corrections","venue":null,"work_id":"f8510d3e-1f60-4f39-8619-71290c2b69f0","year":2019},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.525329Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:f83171cb95b248b9038f5835aadfa955466612e4b4eb75cf44cd6cec686b7ab8","observation_id":"22e5339a-5e71-4db2-a980-5bf5b3ec5c50","resolution":{"observed_at":"2026-08-16T00:11:06.461678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.442023Z","title":"Off-policy reinforcement learning with optimistic exploration and distribution correction","venue":null,"work_id":"73e0c285-37dc-46a6-90ab-67ff9e538a85","year":2022},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.529587Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:21a889ebc575f7d4867796cb38f5f871ce5bf9155c93207c4ef7ac27df6c880f","observation_id":"a6382609-e0a2-4fe0-8531-82afb58b13ba","resolution":{"observed_at":"2026-08-16T00:11:06.446683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23723","last_updated":"2026-04-30T19:55:27Z","snapshot_observed_at":"2026-08-14T13:12:40.014662Z","submitted_at":"2025-05-29T17:54:44Z","title":"ML-Agent: Reinforcing LLM Agents for Autonomous Machine Learning Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23723","snapshot_observed_at":"2026-08-16T00:11:05.534174Z","title":"ML-Agent: ReinforcingLLMagentsforautonomousmachinelearningengineering.arXivpreprintarXiv:2505.23723, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.534174Z"},"links":{"cited_paper":"/paper/2505.23723","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:20497d6f2d7dc2541863d469c5869fa46495fa4d7c4b11dfbd28c1456c4f54ae","observation_id":"a4f085af-e9f9-4413-b738-6e5db8a27260","resolution":{"observed_at":"2026-08-16T00:11:05.534174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.07906","last_updated":"2026-05-07T09:44:38Z","snapshot_observed_at":"2026-08-16T03:25:54.487595Z","submitted_at":"2026-02-08T10:55:03Z","title":"AceGRPO: Adaptive Curriculum Enhanced Group Relative Policy Optimization for Autonomous Machine Learning Engineering","version":5},"cited_work":{"arxiv_id":"2602.07906","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.07906","snapshot_observed_at":"2026-08-16T00:11:05.687095Z","title":"AceGRPO: Adaptive Curriculum Enhanced Group Relative Policy Optimization for Autonomous Machine Learning Engineering","venue":"cs.LG","work_id":"2798fd6a-db8b-41e6-966c-0284f1a94847","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.538765Z"},"links":{"cited_paper":"/paper/2602.07906","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:a5bf48c89f86952259bf5723f7d741d055b5006b0851765fce4e763cd7cbd7d9","observation_id":"931b5f53-4014-4541-96f2-c79484996c52","resolution":{"observed_at":"2026-08-16T00:11:05.694818Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04872","last_updated":"2026-04-06T17:19:29Z","snapshot_observed_at":"2026-07-06T22:53:46.999911Z","submitted_at":"2026-04-06T17:19:29Z","title":"Synthetic Sandbox for Training Machine Learning Engineering Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.04872","snapshot_observed_at":"2026-08-16T00:11:05.543606Z","title":"Synthetic sandbox for training machine learning engineering agents.arXiv preprint arXiv:2604.04872, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.543606Z"},"links":{"cited_paper":"/paper/2604.04872","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:8a5f8f7015ecad03f52227da2e9ac9ebb7f64c2db610eadebc9bcf0b8da69f95","observation_id":"b4ebe061-87de-4c81-8d1b-b4e06b75495b","resolution":{"observed_at":"2026-08-16T00:11:05.543606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.548699Z","title":"LIBERO: Benchmarking knowledge transfer for lifelong robot learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.548699Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:31f7435ccce180546e332b41bcec87b5d0cc5ace1b30abb872e91e65d27058e7","observation_id":"258d2b2b-c7bb-4594-aecb-bbef8ebe5e24","resolution":{"observed_at":"2026-08-16T00:11:05.548699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.416794Z","title":"Qwen3.5.https://qwen.ai/blog?id=qwen3.5, 2026","venue":null,"work_id":"84e7562f-9c39-41f1-bd3b-fe0719f1ba22","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.553409Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:cf9ae431bd993ae82a40917669c10eba4243db905a13f2260ea63edd17897b85","observation_id":"3f722c6a-2621-4e57-b941-9299e84a6c90","resolution":{"observed_at":"2026-08-16T00:11:06.421910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.402710Z","title":"MiniVLA: A better VLA with a smaller footprint.https://github","venue":null,"work_id":"b3ac5263-ea5c-4b2e-aa7f-1cac2dc6b61f","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.557872Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:8f1d5b886c9e7318f2141af8dc4a02911bdb8600a19b54803080b5b98aaeedec","observation_id":"0acf7aba-d5b9-4189-85f7-437edab02770","resolution":{"observed_at":"2026-08-16T00:11:06.407362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02115","last_updated":"2026-05-13T21:07:49Z","snapshot_observed_at":"2026-08-12T16:18:51.295325Z","submitted_at":"2026-03-02T17:38:58Z","title":"Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.02115","snapshot_observed_at":"2026-08-16T00:11:05.562900Z","title":"Huang, Luke Zettlemoyer, Dieter Fox, Yu Xiang, Anqi Li, Andreea Bobu, Abhishek Gupta, Stephen Tu, Erdem Biyik, and Jesse Zhang","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.562900Z"},"links":{"cited_paper":"/paper/2603.02115","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:4ce5d8918e2d38e39209db699441365548a0fbd228c95a785f527d2010eaf9d0","observation_id":"fbe222f3-aea4-4d1b-be1b-3dc0f9e6f7ac","resolution":{"observed_at":"2026-08-16T00:11:05.562900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.387937Z","title":"OpenVLA: An open-source vision-language- action model","venue":null,"work_id":"81ff6cbe-4577-4c06-b90c-c4448f677e93","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.567664Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:878f319d95e02e05f3dc97c200cc621b17809d94ee7fe947616f339beb14c3cb","observation_id":"c86dc91e-9618-40e4-a4fa-8381b0ff4eb5","resolution":{"observed_at":"2026-08-16T00:11:06.393065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-16T00:11:05.572219Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.572219Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:72497600bc5e0563f1ed00ab26fa86d11d53fb82c2c54a832e56a4164c58e7ca","observation_id":"ea2d7fe4-75e9-4aa2-b88f-26fcb03f74bc","resolution":{"observed_at":"2026-08-16T00:11:05.572219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.372303Z","title":"Latent reasoning VLA: Latent thinking and prediction for vision-language-action models","venue":null,"work_id":"9b23add2-0f84-4ce8-aa4b-c9f798915715","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.577122Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:4d88fe22038c1501d5ad283c537e2d21afa37bc75ed99044685df878d2027c8c","observation_id":"2a0f3628-7a74-40be-b8e6-fa3f01de429c","resolution":{"observed_at":"2026-08-16T00:11:06.378180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.581626Z","title":"Finite-time analysis of the multiarmed bandit problem.Machine Learning, 47:235–256, 2002","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.581626Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:d451d56ca5dca927db0e354b0d370ff49ba2ff6f834249ff3bb46b6700da1625","observation_id":"f4bb520c-473f-45fd-ba80-13a0355d188c","resolution":{"observed_at":"2026-08-16T00:11:05.581626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.586199Z","title":"Information-theoretic considerations in batch reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.586199Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:c1aa7334a14fdb2852dc4fc844b7b697e612810f993dc3413ea329ed795dd355","observation_id":"ad29ba01-d6f6-4f79-81d8-27dbcc28f206","resolution":{"observed_at":"2026-08-16T00:11:05.586199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.338366Z","title":"Risk bounds in isotonic regression.The Annals of Statistics, 30(2):528–555, 2002","venue":null,"work_id":"a5115df7-a0cc-42ba-9d92-e0e469c0f6ad","year":2002},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.590764Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:78561c3ccdc7f7221fa37c43ce2ac037f7b3cc1913483533900e8c95a73ed474","observation_id":"29769821-e6f9-413b-bcec-bb1e428d6043","resolution":{"observed_at":"2026-08-16T00:11:06.343549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.322219Z","title":"MLE-bench: Evaluating machine learning agents on machine learning engineering.https: //openai.com/index/mle-bench/, 2024","venue":null,"work_id":"fc16c2dc-0c1b-4419-a73d-c1b19a2ff48f","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.594916Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:8f7cd9a85c5e4394ae8ed4ea66781c2ac7409161147440eb0eb612ebddd4a51a","observation_id":"16bd80b9-5de1-41a1-953c-0cea028cb6e2","resolution":{"observed_at":"2026-08-16T00:11:06.327646Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.307485Z","title":null,"venue":null,"work_id":"8d9cc0c9-db3b-47ec-a061-b2c8ae79d232","year":null},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.601191Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:e3f68c9e5028ec7162fbc8b7d05b9879e913488f841e02048700023e115e9d42","observation_id":"e4c22bb7-b518-4a2e-befc-c756a43a7fa6","resolution":{"observed_at":"2026-08-16T00:11:06.311940Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.292291Z","title":"reason\":","venue":null,"work_id":"5e49dfb0-2044-42cf-9339-37787cf01413","year":null},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.605570Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:a407fed188939a47c5a85abf858867a630b8cb04f8266bdc473a55e34fe0db46","observation_id":"951cc6cd-d94c-4e8e-aaf0-73d90dbd9126","resolution":{"observed_at":"2026-08-16T00:11:06.297389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-21T05:46:13.693428Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":3,"verified_fuzzy":27},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2608.12564."}