{"as_of":"2026-08-05T06:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6cf10a54ccee0f712c6a93df44f52ed9fb23eabafab8378ec44b695167e7f6c5","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T12:30:38.516376Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20486/citation-record","integrity":"/paper/2607.20486/integrity","json":"/paper/2607.20486/citation-record.json","paper":"/paper/2607.20486"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.16982","last_updated":"2025-02-24T09:12:29Z","snapshot_observed_at":"2026-08-02T00:32:51.000665Z","submitted_at":"2025-02-24T09:12:29Z","title":"Muon is Scalable for LLM Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16982","snapshot_observed_at":"2026-08-02T12:30:37.205102Z","title":"Muon is scalable for llm training.arXiv preprint arXiv:2502.16982, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.205102Z"},"links":{"cited_paper":"/paper/2502.16982","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:429c2b0fe8927f4c74e254bfc3072ccd0a9abea860e6677ded58d932f44a930b","observation_id":"f6dcbe8f-a36d-41d6-8e75-719a87c5001c","resolution":{"observed_at":"2026-08-02T12:30:37.205102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T12:30:37.406691Z","title":"Evolving deep learning optimizers.arXiv preprint arXiv:2512.11853,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.406691Z"},"links":{"citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:a95c00159422769508902779ef763208018d9ac735c47ba0ed673970e27ee997","observation_id":"022d59af-d086-4986-93d6-aa36d5f876cc","resolution":{"observed_at":"2026-08-02T12:30:37.406691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12670","last_updated":"2025-06-19T15:01:04Z","snapshot_observed_at":"2026-07-06T20:24:17.280431Z","submitted_at":"2025-01-22T06:10:27Z","title":"Celo: Training Versatile Learned Optimizers on a Compute Diet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12670","snapshot_observed_at":"2026-08-02T12:30:37.510251Z","title":"Celo: Training versatile learned optimizers on a compute diet.arXiv preprint arXiv:2501.12670,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.510251Z"},"links":{"cited_paper":"/paper/2501.12670","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:59da03a3d183a7ac65259f28703be7606fc4e2f50f23001c8fe8672905963872","observation_id":"0b9ff42a-70c5-4c97-9992-36fc451b415f","resolution":{"observed_at":"2026-08-02T12:30:37.510251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13131","last_updated":"2025-06-16T06:37:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-16T06:37:18Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13131","snapshot_observed_at":"2026-08-02T12:30:37.570409Z","title":"Alphae- volve: A coding agent for scientific and algorithmic discovery.arXiv preprint arXiv:2506.13131,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.570409Z"},"links":{"cited_paper":"/paper/2506.13131","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:ad74df7cae725f6249d32d2aab8bd98db817c3cf1b6006fba48cc66206ae743a","observation_id":"b7211e0b-b8ee-438c-a80a-21aa0ab0b049","resolution":{"observed_at":"2026-08-02T12:30:37.570409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03137","last_updated":"2024-09-27T18:31:02Z","snapshot_observed_at":"2026-07-06T19:10:43.721644Z","submitted_at":"2024-09-05T00:13:16Z","title":"The AdEMAMix Optimizer: Better, Faster, Older","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03137","snapshot_observed_at":"2026-08-02T12:30:37.647532Z","title":"The ademamix optimizer: Better, faster, older","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.647532Z"},"links":{"cited_paper":"/paper/2409.03137","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:1ac7cf83fe33fd2b98b69aec3921b02eb8ac6a77ba367b15582787283c47bf4e","observation_id":"d082cccb-7185-4a1f-b115-e979fe04e62c","resolution":{"observed_at":"2026-08-02T12:30:37.647532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T12:30:37.769775Z","title":"Agent laboratory: Using llm agents as research assistants.Findings of the Association for Computational Linguistics: EMNLP 2025, pages 5977–6043,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.769775Z"},"links":{"citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:b40adc8d11fc4a99339a9014e590bf9580cb8abe744c700e808e794fe59894c3","observation_id":"b3646b4c-f5df-4c5c-8f89-1eebbad837e2","resolution":{"observed_at":"2026-08-02T12:30:37.769775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11321","last_updated":"2025-01-31T18:52:42Z","snapshot_observed_at":"2026-07-06T19:16:51.512681Z","submitted_at":"2024-09-17T16:18:05Z","title":"SOAP: Improving and Stabilizing Shampoo using Adam","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11321","snapshot_observed_at":"2026-08-02T12:30:37.840921Z","title":"Soap: Improving and stabilizing shampoo using adam.arXiv preprint arXiv:2409.11321,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.840921Z"},"links":{"cited_paper":"/paper/2409.11321","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:4a98157580a6a6dfb15c67fe65be547b918610fa60b9ca75fcb6151c75a2610b","observation_id":"1e0fbc28-13f5-4a0c-a40b-e1eed22d1611","resolution":{"observed_at":"2026-08-02T12:30:37.840921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-02T12:30:37.928953Z","title":"V oyager: An open-ended embodied agent with large language models.arXiv preprint arXiv:2305.16291,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.928953Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:5a945ff8abd430268b964a8e2f2ed028ab64056c98b1526450158f032be2a526","observation_id":"d3f0ab87-0d9a-43d4-b28e-24ce0c57e9ee","resolution":{"observed_at":"2026-08-02T12:30:37.928953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02046","last_updated":"2025-09-04T19:22:04Z","snapshot_observed_at":"2026-08-02T20:37:51.914753Z","submitted_at":"2025-09-02T07:43:22Z","title":"Fantastic Pretraining Optimizers and Where to Find Them","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02046","snapshot_observed_at":"2026-08-02T12:30:38.010996Z","title":"Fantastic pretraining optimizers and where to find them.arXiv preprint arXiv:2509.02046,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:38.010996Z"},"links":{"cited_paper":"/paper/2509.02046","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:88d83e161d21acf5b74bc14d23bf21585209f8d70fff1d6fb318a3a9ee28b080","observation_id":"b463f58c-5e27-4376-9c2e-65ce27c0606e","resolution":{"observed_at":"2026-08-02T12:30:38.010996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-02T12:30:38.113503Z","title":"React: Synergizing reasoning and acting in language models.arXiv preprint arXiv:2210.03629,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:38.113503Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:d416271d353be320303ba87289c168d2f45ea74e384138a004e6c407fa4ff451","observation_id":"57ec6676-3b01-43eb-a35f-c398c4a2b9ae","resolution":{"observed_at":"2026-08-02T12:30:38.113503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10438","last_updated":"2025-09-04T09:37:05Z","snapshot_observed_at":"2026-07-06T19:51:05.604758Z","submitted_at":"2024-11-15T18:57:39Z","title":"MARS: Unleashing the Power of Variance Reduction for Training Large Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10438","snapshot_observed_at":"2026-08-02T12:30:38.237293Z","title":"Mars: Unleashing the power of variance reduction for training large models.arXiv preprint arXiv:2411.10438,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:38.237293Z"},"links":{"cited_paper":"/paper/2411.10438","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:1422f50d13ab574fc99a271e23760b5513f2acdf3052e11ad3b69a582db7d147","observation_id":"0f32997d-8304-4d9a-9fa0-e4c2397f32b3","resolution":{"observed_at":"2026-08-02T12:30:38.237293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16793","last_updated":"2025-02-24T11:29:08Z","snapshot_observed_at":"2026-08-03T23:43:24.359346Z","submitted_at":"2024-06-24T16:56:41Z","title":"Adam-mini: Use Fewer Learning Rates To Gain More","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16793","snapshot_observed_at":"2026-08-02T12:30:38.316916Z","title":"Adam-mini: Use fewer learning rates to gain more.arXiv preprint arXiv:2406.16793,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:38.316916Z"},"links":{"cited_paper":"/paper/2406.16793","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:86bf894e798a2d59267d1489f399d2f92ceab8c350b555608b7ba5f1f94ad569","observation_id":"a1d73cfc-f921-4284-ba34-3986618c46ee","resolution":{"observed_at":"2026-08-02T12:30:38.316916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03507","last_updated":"2024-06-02T21:24:12Z","snapshot_observed_at":"2026-07-06T17:40:15.746482Z","submitted_at":"2024-03-06T07:29:57Z","title":"GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03507","snapshot_observed_at":"2026-08-02T12:30:38.429120Z","title":"Galore: Memory-efficient llm training by gradient low-rank projection.arXiv preprint arXiv:2403.03507,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:38.429120Z"},"links":{"cited_paper":"/paper/2403.03507","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:68eb6780a2c84b6feec4b50b63d58ab9cbb807a448d3883f9be576e3834dc5de","observation_id":"9ab70c78-1040-4bde-8430-3410abfde270","resolution":{"observed_at":"2026-08-02T12:30:38.429120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T12:30:38.516376Z","title":"The main paper only introduces the high-level idea: optimizers are represented as modular update programs","venue":null,"work_id":null,"year":1913},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:38.516376Z"},"links":{"citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:06194a4a8025b247e623e7fe68c9e8b39e8f54ddc72642cbc68ebf67a9cf6a71","observation_id":"42760fe0-916a-4f08-80f8-ccd4e16cb9d1","resolution":{"observed_at":"2026-08-02T12:30:38.516376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T12:30:36.865277Z","title":"Researchagent: Iterative research idea generation over scientific literature with large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:36.865277Z"},"links":{"citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:2977b2e67b220ae64d41e8f54fb1600c88206eb7d246a8aebc32b2526f30971e","observation_id":"10073dda-28f5-4d69-b5fb-6182f31873af","resolution":{"observed_at":"2026-08-02T12:30:36.865277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-02T12:30:37.293148Z","title":"The ai scientist: Towards fully automated open-ended scientific discovery.arXiv preprint arXiv:2408.06292,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.293148Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:d8ea13a212d041de70aeae9346112b7e8e5a2e38e7700dbe27e566e29d02bc58","observation_id":"28c76fd8-8bc7-4bd6-aa2a-b901780789a1","resolution":{"observed_at":"2026-08-02T12:30:37.293148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02051","last_updated":"2024-06-01T16:48:37Z","snapshot_observed_at":"2026-07-06T17:11:25.753590Z","submitted_at":"2024-01-04T04:11:59Z","title":"Evolution of Heuristics: Towards Efficient Automatic Algorithm Design Using Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02051","snapshot_observed_at":"2026-08-02T12:30:37.006708Z","title":"Evolution of heuristics: Towards efficient automatic algorithm design using large language model.arXiv preprint arXiv:2401.02051,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.006708Z"},"links":{"cited_paper":"/paper/2401.02051","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:0894b569d0a78f5c110a2d18e8ebbfb67ef754b42ce0f2fd43617075805131b0","observation_id":"962eaa74-353e-4565-a227-bdb8082bf18a","resolution":{"observed_at":"2026-08-02T12:30:37.006708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14342","last_updated":"2024-03-05T17:07:16Z","snapshot_observed_at":"2026-07-06T15:31:51.249701Z","submitted_at":"2023-05-23T17:59:21Z","title":"Sophia: A Scalable Stochastic Second-order Optimizer for Language Model Pre-training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14342","snapshot_observed_at":"2026-08-02T12:30:37.114754Z","title":"Sophia: A scalable stochastic second-order optimizer for language model pre-training.arXiv preprint arXiv:2305.14342,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:37.114754Z"},"links":{"cited_paper":"/paper/2305.14342","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:1ee73a73cdcbf6017e2ec6552461b87e296379adda98bee57a047d68a3c2a91d","observation_id":"a0823259-c6e0-43b6-be8a-72bef1918ab1","resolution":{"observed_at":"2026-08-02T12:30:37.114754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-02T12:30:36.923611Z","title":"com/karpathy/nanochat","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T12:30:36.923611Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2607.20486"},"observation_digest":"sha256:27453f8bb55e16a625e5518cb902d81eeed9ddcc28318461877cc92216623deb","observation_id":"c5f72569-e566-4879-8ea1-5b60ad5cbeac","resolution":{"observed_at":"2026-08-02T12:30:36.923611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20486","last_updated":"2026-06-02T15:21:53Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-04T12:41:14.831060Z","submitted_at":"2026-06-02T15:21:53Z","title":"OPTScientist: Multi-Agent Discovery of Typed Optimizer Programs for Transformer Pretraining"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2607.20486."}