{"as_of":"2026-08-11T04:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2b215ad370285504e6536d673ef592d0c3d0191e0780c9170f0fae099e36bbf","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T03:53:11.469583Z","state":"measured"},{"denominator":92,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":92,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T04:19:39.354599Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10468","snapshot_observed_at":"2026-07-11T22:10:49.683444Z","title":"Can muon fine-tune adam-pretrained models?arXiv preprint arXiv:2605.10468, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04033","last_updated":"2026-07-04T21:27:05Z","snapshot_observed_at":"2026-08-07T05:07:10.107694Z","submitted_at":"2026-07-04T21:27:05Z","title":"OmniOpt: Taxonomy, Geometry, and Benchmarking of Modern Optimizers","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-11T22:10:49.683444Z"},"links":{"cited_paper":"/paper/2605.10468","citing_paper":"/paper/2607.04033"},"observation_digest":"sha256:2adc42e9142cd83d7ffd88d732d463e617931f17f4d4a04fed826ded86788056","observation_id":"01673901-5d3c-4e49-850b-c3c4479d368f","resolution":{"observed_at":"2026-07-11T22:10:49.683444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10468","snapshot_observed_at":"2026-08-01T21:13:39.650752Z","title":"Shao, Z.; Wang, P.; Zhu, Q.; Xu, R.; Song, J.; Bi, X.; Zhang, H.; Zhang, M.; Li, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16169","last_updated":"2026-08-02T14:51:38Z","snapshot_observed_at":"2026-08-08T13:31:17.185519Z","submitted_at":"2026-07-17T17:49:05Z","title":"When Does Muon Help Agentic Reinforcement Learning?","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:39.650752Z"},"links":{"cited_paper":"/paper/2605.10468","citing_paper":"/paper/2607.16169"},"observation_digest":"sha256:7aa3131ffb9f61073e2391b7685b58b4c184d1d5fdbc4a34bcf5fd4dd6ae4c4e","observation_id":"8317e0a4-15fe-49e9-9eb4-f2affd78f164","resolution":{"observed_at":"2026-08-01T21:13:39.650752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10468","snapshot_observed_at":"2026-08-04T04:19:39.354599Z","title":"Shao, Z.; Wang, P.; Zhu, Q.; Xu, R.; Song, J.; Bi, X.; Zhang, H.; Zhang, M.; Li, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16169","last_updated":"2026-08-02T14:51:38Z","snapshot_observed_at":"2026-08-08T13:31:17.185519Z","submitted_at":"2026-07-17T17:49:05Z","title":"When Does Muon Help Agentic Reinforcement Learning?","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T04:19:39.354599Z"},"links":{"cited_paper":"/paper/2605.10468","citing_paper":"/paper/2607.16169"},"observation_digest":"sha256:acbdac6812185572d2518fbd272f689150c89f984132f685ddc13a7f4d6a1493","observation_id":"734d5f15-22eb-4cf3-ab53-819cfdfae2a3","resolution":{"observed_at":"2026-08-04T04:19:39.354599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.10468/citation-record","integrity":"/paper/2605.10468/integrity","json":"/paper/2605.10468/citation-record.json","paper":"/paper/2605.10468"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:08:01.085168Z","title":"2024 , url =","venue":null,"work_id":"3fbe430d-48a5-4bf1-b3ab-3491a0d1629a","year":2024},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:f54eed9540dc570e0c7ca2e42bb1037a03c3741070a8e217caacfa97e5f66526","observation_id":"0a69aca6-32e3-48d7-b972-4ec1e8511dab","resolution":{"observed_at":"2026-05-12T17:41:44.633015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kingma and Jimmy Ba , title =","venue":null,"work_id":"78eb1908-e79c-467e-995d-06510492887d","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:493aa97dbaaf29e1a6d7d2677a3111e8401c419f7b389eb60669457ca4da6a0e","observation_id":"a54ed0b9-8c48-4e55-902f-27a2fa02aa40","resolution":{"observed_at":"2026-05-12T17:41:44.621160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":"c18e57bb-cd05-4648-ba21-ce1b870646cd","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:4cd441b50ee7ba6a9188599d8ed6c7a2a3f8fc760763ae42d9b6427b2a33636e","observation_id":"e2d4fe14-528a-436a-aabd-de4c49f40289","resolution":{"observed_at":"2026-05-12T17:41:44.624600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16982","last_updated":"2025-02-24T09:12:29Z","snapshot_observed_at":"2026-08-02T00:32:51.000665Z","submitted_at":"2025-02-24T09:12:29Z","title":"Muon is Scalable for LLM Training","version":1},"cited_work":{"arxiv_id":"2502.16982","doi":"10.48550/arxiv.2502.16982","metadata_source":"pith","pith_arxiv_id":"2502.16982","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Muon is Scalable for LLM Training","venue":"cs.LG","work_id":"a818f37a-b985-49e6-879d-603a00525f65","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2502.16982","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:f4a5e3731483474e9384926524f15b45ab53652601a047f87c4515be5aabb23d","observation_id":"6cf5ea67-3b49-4e40-9ffd-6a597ae35eb4","resolution":{"observed_at":"2026-05-12T06:51:28.739353Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02222","last_updated":"2025-05-20T01:04:35Z","snapshot_observed_at":"2026-08-07T15:56:34.964782Z","submitted_at":"2025-05-04T19:14:43Z","title":"Practical Efficiency of Muon for Pretraining","version":4},"cited_work":{"arxiv_id":"2505.02222","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.02222","snapshot_observed_at":"2026-07-09T17:36:25.409899Z","title":"arXiv preprint arXiv:2505.02222 , year=","venue":"cs.LG","work_id":"3b5f21a7-2f9f-4001-bba4-8f7b7f0468f4","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2505.02222","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:e1ee93690b8400619b9c4d6b05072bd1cd9eb9ebdbbf308ba206682be741e492","observation_id":"bd2fbc96-4e95-4d56-8ad2-9384536099b7","resolution":{"observed_at":"2026-05-12T06:51:28.805735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":"2507.20534","doi":"10.1145/3448609","metadata_source":"pith","pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi K2: Open Agentic Intelligence","venue":"cs.LG","work_id":"7f18284c-12d3-4137-bea1-1da97e8cf3c1","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:7ab910b13ae91343e95344191bc86f9bc160fcf032fef4e602127793e65d831d","observation_id":"3e355b27-807e-4e37-ac1f-10960a9da443","resolution":{"observed_at":"2026-05-12T06:51:28.797706Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06471","last_updated":"2025-08-08T17:21:06Z","snapshot_observed_at":"2026-08-11T03:34:09.767397Z","submitted_at":"2025-08-08T17:21:06Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","version":1},"cited_work":{"arxiv_id":"2508.06471","doi":"10.48550/arxiv.2508.06471","metadata_source":"pith","pith_arxiv_id":"2508.06471","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","venue":"cs.CL","work_id":"5bb4e5d7-985e-431b-bb0d-75576cdc2950","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2508.06471","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:ed74cc39d807f7122dc100d119824e3879cac187181fa8b49573d65245534e03","observation_id":"367ebd77-181c-4ac0-8c4c-d49a6c6b679d","resolution":{"observed_at":"2026-05-12T06:51:28.762151Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , publisher =","venue":null,"work_id":"22a8680d-95b6-4e2e-ab05-8533b2c15e17","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:97a2b4313c7a6644554ca066849bb3fa6fc4ca52389e3a94265fef5852a5cdcd","observation_id":"af721adf-f816-4929-a980-326955656c03","resolution":{"observed_at":"2026-05-12T17:41:44.617570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":"83a0b76b-1fd8-41d0-baee-65f000639591","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:87de138f237407f06d19dbc6259f0864ff72baf9902b99912c4ddc6c8fc59ec7","observation_id":"6924a8de-e952-43a0-99e5-cf1f870af3fd","resolution":{"observed_at":"2026-05-12T17:41:44.636014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:26.053493Z","title":"Psychology of learning and motivation , volume=","venue":null,"work_id":"c5ad20b8-f874-4d27-a471-86b6a9feb775","year":1989},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:fde579bbb01900df52687028606931910f64765b861d7f807597331a2e4636e3","observation_id":"e42616f0-37d9-4dfa-9b61-51a5ea46f807","resolution":{"observed_at":"2026-05-12T17:41:44.628987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trends in cognitive sciences , volume=","venue":null,"work_id":"ab37536a-4233-4fdd-bece-a52231a185f0","year":1999},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:a5ca4e6ea21eefb704e99fd7c0769563cb4860b707dc55338ba7dde966fec2ad","observation_id":"a01ad59f-8375-44c5-a699-98b7a0d90200","resolution":{"observed_at":"2026-05-12T17:41:44.639542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gower , title =","venue":null,"work_id":"45bfab40-b390-450a-ac19-afc7e9fe2d36","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:801ee518300e68c4a680360132d2d8c6b4d49f8dc320e645db1a5b1f07cdf825","observation_id":"82ab2da7-5cfb-4eda-be7c-1efad97ea5d8","resolution":{"observed_at":"2026-05-12T17:41:44.642863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03732","last_updated":"2023-11-28T03:23:20Z","snapshot_observed_at":"2026-08-08T21:34:35.024914Z","submitted_at":"2023-11-28T03:23:20Z","title":"A Rank Stabilization Scaling Factor for Fine-Tuning with LoRA","version":1},"cited_work":{"arxiv_id":"2312.03732","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.03732","snapshot_observed_at":"2026-07-04T16:19:56.302830Z","title":"A Rank Stabilization Scaling Factor for Fine-Tuning with LoRA","venue":"cs.CL","work_id":"107c6606-e629-4ec8-b1f4-a5b9c8a5a59e","year":2023},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2312.03732","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:471816caeefef1341be334bf0b5007180185e2627f0c07e94e3f665572fe6089","observation_id":"520e6a6a-4952-44ff-908a-6b8f3231ee20","resolution":{"observed_at":"2026-05-15T22:05:50.945454Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2ba5c0f9-17c1-4c5c-b031-aa4fa5b5ce1c","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:a14f36971c9affda92cabcec489f9c54b65aae6bdabb866b41d8db85f4aae0d3","observation_id":"ee50462c-2996-4622-9ada-0ba733cd273c","resolution":{"observed_at":"2026-05-12T17:41:44.460250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":"b16a9ba0-eab9-4133-ace2-9e8bd15e965b","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:6f57d352a6aa4f66e418cd2460ab86e00c3818d2d817786dd378be67b45a826c","observation_id":"2d378ab9-a4b0-4d2b-882a-f0eafc523911","resolution":{"observed_at":"2026-05-12T17:41:44.613676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T00:36:39.823011Z","title":null,"venue":null,"work_id":"7d981199-ade9-4083-80fd-c73b601f213a","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:621973d1581366e629b8d89a210bc1da05769df0c3841f680d662d5f676ee808","observation_id":"8c4dfad0-98b1-4ab5-8198-d7c4810d9e60","resolution":{"observed_at":"2026-05-12T17:41:44.474417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6a60cb39-3492-437f-a111-59980922308a","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:9f86aeee5ec10ee7d99c228923351eafc07566a27f55981de19d60f23ade2df5","observation_id":"ec3c3ade-4b18-4588-b866-e3f725afeb47","resolution":{"observed_at":"2026-05-12T17:41:44.487626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":"0ecd8ecb-c13b-41d9-991f-d12ec55b3c6c","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:e5b862b4dbe7caf4389b2f5c616250cbb87eac618895cb20b5b4207ddc8501f0","observation_id":"887ce54e-02e0-408f-91cc-3c54b265281f","resolution":{"observed_at":"2026-05-12T17:41:44.502233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":"6003a160-9f01-49ad-9eca-9f3da92cd3ce","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:ebcbfcabe6b0b0f693fa59b337a5b20e9f07bbf3502f1bf809803e73dea2b7cb","observation_id":"68f159db-e4a9-4dc3-88b4-f50c9ae8db43","resolution":{"observed_at":"2026-05-12T17:41:44.438393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T16:52:40.575860Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"cb2ae7f4-3fc5-46bb-a5bc-53d87f814b46","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:26e6ea3c1045fae3bb7d9fe523e1a07a45528c42bea51a12f2a93647afb92a65","observation_id":"f00a2d1c-2747-410e-8933-33d6c5561aa3","resolution":{"observed_at":"2026-05-12T17:41:44.433224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20325","last_updated":"2024-12-06T14:09:22Z","snapshot_observed_at":"2026-08-03T03:18:47.425243Z","submitted_at":"2024-09-30T14:26:12Z","title":"Old Optimizer, New Norm: An Anthology","version":2},"cited_work":{"arxiv_id":"2409.20325","doi":"10.48550/arxiv.2409.20325","metadata_source":"pith","pith_arxiv_id":"2409.20325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Old Optimizer, New Norm: An Anthology","venue":"cs.LG","work_id":"c0089db6-7349-44fd-b103-0d7b36142bab","year":2024},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2409.20325","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:28d18f0962b3daec6a3bbb91cf2319ae780e1614e76605bd1a8659226e3bbb84","observation_id":"3e13ee7a-635c-490b-8bca-375cbf61e94f","resolution":{"observed_at":"2026-05-16T07:27:53.041705Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Implicit Bias of","venue":null,"work_id":"69a0c182-da26-4730-bf87-9a116c0be049","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:26ca21123f6a67fb650fe423a01058d99d5442e63671918344af5afe87c83f38","observation_id":"341776e6-240a-4ddb-97e6-5ade7b55a5bf","resolution":{"observed_at":"2026-05-12T17:41:44.449488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":"c1377db6-fcd7-46dd-abd4-c6817643c4ae","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:c8a72dee395dc9644a22c8102e77b5c615bfbf7811adc5de79040da3d0b837bc","observation_id":"0b5963a0-2283-4357-a48c-58a858a13bfb","resolution":{"observed_at":"2026-05-12T17:41:44.452509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transactions on Machine Learning Research , year=","venue":null,"work_id":"b67e5648-2601-41a2-9ba4-82baeef54439","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:0be2614f988468daadd272393758e462de1408cfd6a7539ab709d4e13c49c6f0","observation_id":"8062df40-bc6c-4443-87ef-4613e5919d60","resolution":{"observed_at":"2026-05-12T17:41:44.463992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12645","last_updated":"2025-04-08T16:47:42Z","snapshot_observed_at":"2026-08-09T21:31:17.577486Z","submitted_at":"2025-03-16T20:49:34Z","title":"Understanding Gradient Orthogonalization for Deep Learning via Non-Euclidean Trust-Region Optimization","version":2},"cited_work":{"arxiv_id":"2503.12645","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12645","snapshot_observed_at":"2026-07-04T07:29:38.574824Z","title":"arXiv preprint arXiv:2503.12645 , year=","venue":null,"work_id":"fe62cb1b-f9dc-4379-8586-5c2f591ba7e5","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2503.12645","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:1be78d0221ea41aef35c4e603aef99a47e00206da68e92589c89dc21ee9df783","observation_id":"f84eac50-3db7-4eda-937f-962f38444cd5","resolution":{"observed_at":"2026-05-12T06:51:28.816677Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dissecting","venue":null,"work_id":"e44d2ea7-d51a-4b81-bc91-77ca1e801008","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:c58b77a609201f4501fcfe6934cba8a8cbb317f87dc4d0a180c20d5c394e6ae7","observation_id":"8d28066b-e0d0-4fb1-8fc3-48ba6838451a","resolution":{"observed_at":"2026-05-12T17:41:44.496538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"451059bf-dc77-4356-8bcc-d7be7128e085","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:b4693f3f92397285886dc52b88b3b6319770405ce9b201e453284b7f7449445f","observation_id":"81dd3537-f2c3-452a-8dac-3a3d2cfffc04","resolution":{"observed_at":"2026-05-12T17:41:44.505683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2020 , booktitle=","venue":null,"work_id":"2002067f-2d25-4029-8ccd-7223890a4fcd","year":2020},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:080fc31a5c6fd7d3b7365a54aff04f922770f9e09f44050f9e4dff16ff5d8ef7","observation_id":"4c79b5bf-18dd-4b0d-a9a0-e8e94b8b2905","resolution":{"observed_at":"2026-05-12T17:41:44.517524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.05295","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T21:35:37.653099Z","title":"Dion: Distributed Orthonormalized Updates","venue":null,"work_id":"4ecfbe15-0efd-41f4-a129-82f6a2164d2f","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:98e77cbc11ffd4e54c002b0374d521626e059eb81c4f0d5f9a0d01d51e4b06fc","observation_id":"ec989f89-cbb0-48e7-8d28-8e331ad6760c","resolution":{"observed_at":"2026-05-12T06:51:28.731870Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2dd87343-1e8f-468a-9749-144ac6211330","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:1ddd00a5e69e287058e8f408afd2ae267f58e122231e90ba2a83b69c7c9dda4e","observation_id":"e2019f1d-9335-4e23-8ab9-cbf6a63a162a","resolution":{"observed_at":"2026-05-12T17:41:44.469461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:de673423e71c716c63e22224421f7ad26660e853621bf293114ebdb28c7e9997","observation_id":"a1caae03-10f3-4c6b-9950-1881ff2ca513","resolution":{"observed_at":"2026-05-12T06:51:28.810579Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b75618f8-f50d-4fa4-b367-a30b8829993e","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:e08bb843fbfbef3383a95e2771344aff9fe8d5394e924e8ae6beecab62017d84","observation_id":"06c8133a-8c19-4f92-8963-895edcdf6d3a","resolution":{"observed_at":"2026-05-12T17:41:44.443816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T16:15:06.372663Z","title":"Liu , title =","venue":null,"work_id":"cdbfa130-054a-4c46-ba43-f51f9c363d25","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:a073a519e5bb3af2de8777479f7fbd6d9244046351bdfd4cba00ab1005f85daa","observation_id":"b3ff67b2-060d-41a0-90b3-e05c7be3ba81","resolution":{"observed_at":"2026-05-12T17:41:44.493688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bowman , title=","venue":null,"work_id":"1e58bf61-6235-4dcd-89b3-6c1c5122acc5","year":2019},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:141c1c0f72a9012f39eab8adfbec940f61a9a1deb2038d01df43c7d1526529dc","observation_id":"8d3728a4-9040-459d-b247-84c21e83c645","resolution":{"observed_at":"2026-05-12T17:41:44.454968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2018 , booktitle=","venue":null,"work_id":"3b89ca4f-3894-481b-a93f-71acae7c1dad","year":2018},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:c0b1f547939333b702c34da91a4740b4036de462b24649b5db3a0e4fc2093eee","observation_id":"574c7925-b23b-4171-a07f-80e712fa7135","resolution":{"observed_at":"2026-05-12T17:41:44.446168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e2865ce3-379f-4322-840f-d21f2d60c9da","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:c6879a86c7d7cf5e0125621114add969136c7c964751d6b10cf1d09fc19a3072","observation_id":"36c3f9be-667b-40d4-843d-776d7a660be0","resolution":{"observed_at":"2026-05-12T17:41:44.480414Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:41cb3e4bd112a86c88cdc95257f445a8ba484d33807a70bac94021d2822ac13c","observation_id":"479ff287-9aa9-4923-bada-72e4560f419a","resolution":{"observed_at":"2026-05-12T06:51:28.719270Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , booktitle=","venue":null,"work_id":"a461bdc4-cf61-41db-a3f2-ca586f33a4d5","year":2024},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:2ec14d43ef032ffeeb4d27677af5a8a7cfcb1ff11b505a97c86318d2669a6ab6","observation_id":"0b8a9cf0-3010-4eb2-ad87-404b334ff3dc","resolution":{"observed_at":"2026-05-12T17:41:44.527654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 , journal=","venue":null,"work_id":"990b3bc3-41de-4e03-9f1d-534131837c55","year":2021},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:e49695eb2a33821686948e7d5b7c2ec3cd57cba444767f3684845f48c44f0844","observation_id":"9b140de3-1e84-4ceb-b8bf-d1be1c0d2188","resolution":{"observed_at":"2026-05-12T17:41:44.490297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T05:40:44.338593Z","title":null,"venue":null,"work_id":"6a065a65-4ae4-4250-8070-6ff2dcb8d6b4","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:14062c49202be55deb54e1b60d151f1499c0000511c9810ea6af9740c6228884","observation_id":"566255a3-0bf0-4ef3-b512-ce4114b79624","resolution":{"observed_at":"2026-05-12T17:41:44.583626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:4bb4fde9ac381a2f9fdc24fb1039657afad6bdd3fae51022a1eb4ac88ab341e7","observation_id":"b15623de-5e2b-4232-9430-0fb415ce6b39","resolution":{"observed_at":"2026-05-12T06:51:28.665883Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2019 , booktitle=","venue":null,"work_id":"dcc2f50b-cbfb-4e6d-b592-4023ee0914d0","year":2019},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:1baa96522943848f873bfc1de4a454a96874f732b78805a157466354efe299ea","observation_id":"ac976652-253e-49a1-814f-b8485f98f695","resolution":{"observed_at":"2026-05-12T17:41:44.531376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2020 , booktitle=","venue":null,"work_id":"4dad09cc-41c0-40c9-9492-99c5410f1500","year":2020},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:65f32fe4217268ba2741ce195f962fdd99b3e8fa4ad24f432f951784e21c397d","observation_id":"d20b8110-d99a-47fc-aa84-37b6a65aa226","resolution":{"observed_at":"2026-05-12T17:41:44.484716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2020 , booktitle=","venue":null,"work_id":"c73dbc1b-dc7f-4f82-8a33-fa599137689d","year":2020},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:49708cc008991d708cc045eb23c420672ceb71aed74407a45573fa00b1dd8a45","observation_id":"083e1265-d180-4fbd-b108-ae340652ff0c","resolution":{"observed_at":"2026-05-12T17:41:44.457545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2019 , booktitle=","venue":null,"work_id":"ac184aed-7e5b-4445-9f2d-2971ae6a71ba","year":2019},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:50bb997f8b6ac688488035e208987a94b5cc0d4cceb0abd5b0b8d59da56c9b00","observation_id":"a6a16712-796c-4c8c-bb86-024d3d1ef96a","resolution":{"observed_at":"2026-05-12T17:41:44.466820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2018 , booktitle=","venue":null,"work_id":"aad73156-87c9-46e4-a0ee-d8f60fc28f37","year":2018},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:1da3742b999f20b0bad1fb7a160b2c195c4e678f0769d8a2e04b42de5e8562e1","observation_id":"4e81f818-9dcf-4e3e-a4dd-78d6108e90ef","resolution":{"observed_at":"2026-05-12T17:41:44.471903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.12608602","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:46:45.648157Z","title":"doi:10.5281/zenodo.12608602 , url =","venue":"Zenodo (CERN European Organization for Nuclear Research)","work_id":"2c57f331-c45e-4b28-9887-1931db7da39f","year":2024},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:945d292df1de949c5a1005fb08d37f5add32aa591fe8efb5eea2fa175f096d85","observation_id":"976ab4f8-9486-44d7-93d2-ed4167f829f0","resolution":{"observed_at":"2026-05-12T03:56:20.860396Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T09:08:05.232771+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T09:08:05.232771+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a93a13da-8113-4655-9c61-b347bab69995","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:af33598dc6b0a303c7a87e9ca110920fea2227f09a0210be6057c40f6bd86ba0","observation_id":"82f14185-3092-4a97-8c6d-510b94bd82e2","resolution":{"observed_at":"2026-05-12T17:41:44.600205Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dfd1cbae-6908-4f33-afde-59e829982b2b","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:808d4350b4c8a58b772dcce8c4f5db4e1fc7efe49a9aa73eac2e4a3ee6a1e6ce","observation_id":"48eeb983-491a-4a7f-b713-2254d81f85b1","resolution":{"observed_at":"2026-05-12T17:41:44.435540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the International Conference on Machine Learning , year =","venue":null,"work_id":"ec97710a-693b-4d32-9933-ca144372c07b","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:b526819192f130d63072b1840075a7c9d91b89be502491c80905d6465e9a3ce4","observation_id":"0ea67876-722c-4d58-bfb8-49b45c269cb2","resolution":{"observed_at":"2026-05-12T17:41:44.441203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the IEEE International Conference on Computer Vision Workshops , year=","venue":null,"work_id":"b533ef4c-b1f0-447b-b29d-72b5e3da095b","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:d04adfb5d764e32be9d8bca9f9d5814ae4dc4f40a883e6969828b65ac475b867","observation_id":"8b12a214-09f5-4abc-9561-648a70b54b7a","resolution":{"observed_at":"2026-05-12T17:41:44.426236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T09:26:59.757086Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition , year =","venue":null,"work_id":"e0a39c9e-c81f-44df-98a6-652c68c5ba82","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:bde144418a38db1ac986e8f089540e70d7fe6edac7872e1877e542631e469f3e","observation_id":"c4911bd8-82b6-4cf4-9720-87763a19459f","resolution":{"observed_at":"2026-05-12T17:41:44.524721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The German Traffic Sign Recognition Benchmark: A multi-class classification competition , year=","venue":null,"work_id":"21d0e9b3-1a73-4bef-9006-c82af4a1731b","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:8f80a31e7d2f7e469996e3ca6e4d2dcde7787a92e9d3ec0a6fd98b53561b3a72","observation_id":"216c70e1-9961-4891-b41e-f84db5c964cf","resolution":{"observed_at":"2026-05-12T17:41:44.546441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Remote Sensing Image Scene Classification: Benchmark and State of the Art , year=","venue":null,"work_id":"c4b0daed-75db-44a8-af42-f1b1d1d31448","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:d2dba25c2e704252a321c6214d01e6cef30efaa8efa54c5f12dbc0fecdda0dc0","observation_id":"5e26df63-e17f-4407-9733-7d08090186e8","resolution":{"observed_at":"2026-05-12T17:41:44.498929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Oliva, Aude and Torralba, Antonio , booktitle=","venue":null,"work_id":"cd86c469-7587-48df-9018-db2da1e6defb","year":2010},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:4601680adf870917f12e0e6bfa28e22ad54151155379c0019c832e445f057910","observation_id":"a26001ab-b89b-4755-95d2-9f6e2eb8b902","resolution":{"observed_at":"2026-05-12T17:41:44.597062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T15:57:21.309094Z","title":"NIPS workshop on deep learning and unsupervised feature learning , year=","venue":null,"work_id":"5b3a4c41-697d-4328-a7d4-c12d1adcb930","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:cd84d76c3e0ffb5fc99f29e8a50971acee5eb8bda9b62ac1dcb67155794e4b92","observation_id":"2ecaff28-ad59-4b6b-ae71-f7ac7ed0effa","resolution":{"observed_at":"2026-05-12T17:41:44.593774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"aaa7f1e9-1f0d-4f09-9b3d-13601965b313","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:a7c408be8ef79f1cb7bab0137004feebf2a43556b0a5af38b80ea6bfd240e089","observation_id":"ce5bb158-5770-4c60-a04e-37caaf86c962","resolution":{"observed_at":"2026-05-12T17:41:44.606671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"c9355add-5353-4e5f-84eb-887f44eddee9","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:7c9a21bac7f1d566088c72aecabc6e88be58cba9e889eaa58cddaa0a711fdb9f","observation_id":"9a73b5b0-5f1b-407f-ab43-acc5db46857b","resolution":{"observed_at":"2026-05-12T17:41:44.580125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b8de7e90-2245-4a53-a535-12d5875d5cfb","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:d06a30996b623fedec43af453de228ad1fade281be4990932ad3bdd6cb47ee63","observation_id":"e17202f1-1857-435f-8a9f-172e53238d86","resolution":{"observed_at":"2026-05-12T17:41:44.603325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e671fcfd-7387-4540-b244-050c83708de1","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:928a4d6a76576b6ee9494979580865f936eefef2b61dce41dfecb4965eb22826","observation_id":"1909cdd9-22e3-45f4-ac34-1033087cad28","resolution":{"observed_at":"2026-05-12T17:41:44.577071Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"785d7b6a-aedb-4b9e-85a3-f6ed7047ea3d","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:87cef07cc44cdeeda3b1706197ca43659cd1bf1287d3956504a7d0489bc748b4","observation_id":"30f3134a-5299-49db-ac76-063cbac5abec","resolution":{"observed_at":"2026-05-12T17:41:44.610143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , journal=","venue":null,"work_id":"6e98b8e0-23c3-458c-aaba-0f23c8d2c644","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:998b6eec3d47f142d9a1e60eb8e0728ab8f5f1ae6e136f1c2b15833df0287bd0","observation_id":"25da8e20-d8b1-4278-bbc6-b20004c437cb","resolution":{"observed_at":"2026-05-12T17:41:44.560396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.10935","doi":"10.48550/arxiv.2506.10935","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grishina, M","venue":"arXiv (Cornell University)","work_id":"e0965fe0-a555-4f58-8bc2-33b219db9443","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:f333ea8c9b73fe5009c771467bc371b5fea1216952a4eb126c5416ca238f8eb6","observation_id":"9135876b-0168-4272-bede-593ef2f97dee","resolution":{"observed_at":"2026-05-12T06:51:28.695166Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.00674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:29:38.165345Z","title":"ArXiv Preprint: 2511.00674 , Year =","venue":null,"work_id":"5e0fa664-f7a6-4ce3-934b-dd6d242ac7c6","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:c66d12303f9fcd5c67adc78a2e4f31ef4d8dc9cc75d4e25431d454b5381d76c1","observation_id":"46768aea-7484-420b-ae50-d8ab53f3c543","resolution":{"observed_at":"2026-05-12T06:51:28.685238Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention is All you Need , year =","venue":null,"work_id":"a8d4d41c-280e-4d44-a2c0-f75b5523f7be","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:f2922209b30f2267d090a3152bdfe006d2792dee37b6492f50133d62d429cbca","observation_id":"73e1b398-e803-40eb-898c-7e23c63f3010","resolution":{"observed_at":"2026-05-12T17:41:44.556809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.127063","doi":"10.1016/j.neucom.2023.127063.https://arxiv.org/abs/","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"2024 , issn =","venue":null,"work_id":"ea6c2332-aa10-40e3-87f5-b2cb91d7909a","year":2024},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:2da338e3870f896a9dfbb2d25fbc327acf0826d6b3ddc19468d3673e986bbbd3","observation_id":"edef0b79-4950-4789-a9b6-e6e3f2a461ce","resolution":{"observed_at":"2026-05-12T03:56:20.848968Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":"95c6c392-4230-47e4-b676-680026b55923","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:802711c11fd1e67a9fc7dba3b2719fb369ed88b884fbf89c8a8c34c48f707723","observation_id":"b6d227bc-7198-496f-9108-db65cc3e93f2","resolution":{"observed_at":"2026-05-12T17:41:44.550313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":"1606.08415","doi":"10.18653/v1/n19-1122","metadata_source":"pith","pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gaussian Error Linear Units (GELUs)","venue":"cs.LG","work_id":"0466fd22-03a1-4a61-af0a-a900e77bb023","year":2016},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:78d0211b608f6f35bbc3b624bc52eefd4c3f2d05e68ef596e3ce3f44ebea3677","observation_id":"7270d405-bcb7-478c-b1d3-7452998032bf","resolution":{"observed_at":"2026-05-12T06:51:28.672647Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.15403103","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.5281/zenodo.15403103 , url =","venue":"Zenodo (CERN European Organization for Nuclear Research)","work_id":"867ace60-1032-4ed2-b5e1-9259a9a28c90","year":2022},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:c5af5ed2d80ba9c8531de2f852664719dcdb336d90519801deca621c73a06fe3","observation_id":"1e86e378-2c28-436f-9c3e-f6211602b68e","resolution":{"observed_at":"2026-05-12T03:56:20.851985Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , booktitle=","venue":null,"work_id":"f5a9cd46-d503-4f4e-a757-f1d558135bcd","year":2024},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:2550ed680540605c2f3c517eee67c03919ce88a8dc23b1393526b7d9f813a8fa","observation_id":"81134192-294f-4228-9594-526680ba3c61","resolution":{"observed_at":"2026-05-12T17:41:44.509175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kakade , booktitle=","venue":null,"work_id":"ead02fc5-e7ed-41da-adab-88e6c3deb734","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:0759fcfa2171db596dcebe1e5964239eaa7e9c0d8edfbe37a717b18b246bf9f8","observation_id":"166b2124-05e5-4679-9032-238947a65794","resolution":{"observed_at":"2026-05-12T17:41:44.420361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , journal=","venue":null,"work_id":"1e0039c7-c4b3-4dd9-85f5-114e328e4746","year":2025},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:1b5633638698fd74f35d5f06add45949286102e63451140c3a33c57001551f79","observation_id":"f382f3e2-63c5-433e-9829-9e42ea2101f0","resolution":{"observed_at":"2026-05-12T17:41:44.429265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Klusowski, Jason Matthew and Shigida, Boris , booktitle =","venue":null,"work_id":"f6fb347a-661d-481f-882e-ff041af425ba","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:163d6a9227635c0ea61f3f105fc0654eae550fed7aac0ba83b0a1e256a6a669c","observation_id":"e9c120da-03b8-45ab-9c70-ec0f424f4001","resolution":{"observed_at":"2026-05-12T17:41:44.539128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Query-Key Normalization for Transformers","venue":null,"work_id":"c5313fd3-296e-42b1-ae24-177ddfa9c65c","year":2020},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:dfd39621337e0a95724b49783fb4bfa77312288dc6d72ec459d6fb57edf52d4c","observation_id":"64b188c4-6d19-445e-9104-55edb2aafee1","resolution":{"observed_at":"2026-05-12T17:41:44.423251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"e89f5cb6-3025-4937-b743-0a42d1cca32e","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:a591696f981c8600d36e52baf92accb36bcb6f6673af05f02da8e13911eb8c0c","observation_id":"bc7b0c73-9f19-47be-a4d1-4b749615e73f","resolution":{"observed_at":"2026-05-12T17:41:44.542975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:57:07.641327Z","title":"OpenAI blog , year=","venue":null,"work_id":"e9205f00-c9f5-49ab-a6d6-29c54de4d990","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:688328a97eaf6744f70a5959709c39a9be63800b9a8fdc73f04c925cd4de3bdc","observation_id":"27a8fc72-ee81-4ca1-8c5f-a2b3cddaf43d","resolution":{"observed_at":"2026-05-12T17:41:44.586787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.02218","last_updated":"2020-03-04T17:52:48Z","snapshot_observed_at":"2026-08-08T21:43:40.840815Z","submitted_at":"2020-03-04T17:52:48Z","title":"The large learning rate phase of deep learning: the catapult mechanism","version":1},"cited_work":{"arxiv_id":"2003.02218","doi":"10.48550/arxiv.2003.02218","metadata_source":"arxiv_reference","pith_arxiv_id":"2003.02218","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The large learning rate phase of deep learning: the catapult mechanism","venue":"arXiv (Cornell University)","work_id":"fdbcc7a5-2170-42dd-8424-9e228495e447","year":2003},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2003.02218","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:1b4f18174dcf2ef82e6a97c8c0cf99f01057ed8e0e9780ef3d0ffd7b94af24e1","observation_id":"22c671cb-62d2-45e7-a830-c0bd1247e408","resolution":{"observed_at":"2026-05-12T06:51:28.677058Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-12T15:49:36.486557+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T15:49:36.486557+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Thejas and Nipun Kwatra and Ramachandran Ramjee and Muthian Sivathanu , title =","venue":null,"work_id":"1b69cb13-35d3-4d0c-9cae-b2aaadd2ae65","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:dcb6583af68e8365c02d9094e1baf7b3bf61e1fe18ff56088d3ea208936b70f6","observation_id":"584d3828-3169-49ea-8960-7bb1ae7fd9a0","resolution":{"observed_at":"2026-05-12T17:41:44.590584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":"57ce9316-2221-4cc0-9c6c-8c716b6b3992","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:0d463a5062ae0ebb9988133b6d61c2eebe064643449ceada7f9bc6479d8c0d9c","observation_id":"a9856dbe-3c74-4549-83d3-c9ce712b0b08","resolution":{"observed_at":"2026-05-12T17:41:44.535348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d197f1b4-f41d-4adb-aad1-120ec885ab48","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:4256465d50e4304fbd9dd9a644492e3908cab7ec756ee9385ceae941ea57a543","observation_id":"cdba61d8-7243-4050-adbc-2e23e19582c9","resolution":{"observed_at":"2026-05-12T17:41:44.414891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10702","last_updated":"2023-11-20T02:01:33Z","snapshot_observed_at":"2026-08-10T23:26:33.935470Z","submitted_at":"2023-11-17T18:45:45Z","title":"Camels in a Changing Climate: Enhancing LM Adaptation with Tulu 2","version":2},"cited_work":{"arxiv_id":"2311.10702","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.10702","snapshot_observed_at":"2026-07-01T12:15:43.645501Z","title":"Camels in a changing climate: Enhancing lm adaptation with tulu 2","venue":null,"work_id":"82cc9861-1b97-4684-9fa3-72a23e1c2c07","year":2023},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2311.10702","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:f89d8284e16821d0febbfcf8ebce7421e624cd51ad0b369051a1cde28c6d2f47","observation_id":"a407ea2d-0bbb-4966-bade-847c266ab547","resolution":{"observed_at":"2026-05-12T06:51:28.751346Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the Conference on Empirical Methods in Natural Language Processing , year=","venue":null,"work_id":"0cedec07-dc64-44f8-97df-396d49b92298","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:ead7869983d4f750456e236a0403a35f4332b456c3775ce28602249f72f02043","observation_id":"4638c3e8-134f-4fa1-9e61-36fcf90c5233","resolution":{"observed_at":"2026-05-12T17:41:44.573541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the Association for Computational Linguistics , year=","venue":null,"work_id":"03b2333c-5753-4094-8cd3-5db57120a85d","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:b74ba45adc1b06567ff60970a3c6f46a8f91d9c2f419f145d012e69e80b0613f","observation_id":"d38805a7-94ca-4c6a-99eb-e6cac18a7222","resolution":{"observed_at":"2026-05-12T17:41:44.570208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05605","last_updated":"2024-01-11T00:44:25Z","snapshot_observed_at":"2026-07-06T17:14:03.152949Z","submitted_at":"2024-01-11T00:44:25Z","title":"Scaling Laws for Forgetting When Fine-Tuning Large Language Models","version":1},"cited_work":{"arxiv_id":"2401.05605","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.05605","snapshot_observed_at":"2026-07-03T10:58:03.105441Z","title":"Scaling laws for forgetting when fine-tuning large language models","venue":null,"work_id":"81c90535-a2ac-40cd-80f3-ac6a962a3547","year":2024},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"cited_paper":"/paper/2401.05605","citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:2276b4e322c6ea8aa7bc97d91e8157e4abfc231bff62ef45b8a372fc12906683","observation_id":"f789671f-77a5-476e-b3a8-5a82cdd42e54","resolution":{"observed_at":"2026-05-12T06:51:28.706971Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d72c7192-e73c-422f-9f69-3062845f6d48","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:b547c6726a1098eb2267f43d5357256bcfbfbf6fa056b0d3340b4cb6a95aae78","observation_id":"40e396ba-63a0-4fd1-afea-c8e993c15935","resolution":{"observed_at":"2026-05-12T17:41:44.514174Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"40d31176-3690-4e80-91f3-eb83581e08ec","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:4cbd0e8326f4149af7cbc96c433298acdf1fbc3a837cc3deb85c19e668a03269","observation_id":"310586ee-80c9-4e96-a11c-8542aa7c75be","resolution":{"observed_at":"2026-05-12T17:41:44.520785Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:46:46.747876Z","title":null,"venue":null,"work_id":"41487152-8ae4-4323-a44c-95ab18a028e2","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:7e7f40b064bfb7d4a62c1bd3754058bd530807f338aa7f76b41cfe82217e7b36","observation_id":"0cfa845d-e624-47c4-bb42-eb0d276a5d2c","resolution":{"observed_at":"2026-05-12T17:41:44.563716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d361bb76-3111-4471-b6c0-d0f9aff1b8f5","year":null},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:7ec3b2902b35553696c7c87bcd54e508ca613d88a59722fdc8492df29a2b8ec0","observation_id":"2b38fab1-0c68-42e6-b67b-17134ab29151","resolution":{"observed_at":"2026-05-12T17:41:44.566703Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0665.364036","doi":"10.1145/3620665.3640360","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PyTorch 2: Faster Machine Learning Through Dynamic Python Bytecode Transforma- tion and Graph Compilation","venue":null,"work_id":"abd261ad-4aca-4ea3-8090-344914daba35","year":2024},"citing_paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-12T03:53:11.469583Z"},"links":{"citing_paper":"/paper/2605.10468"},"observation_digest":"sha256:cc7a6b01e610d21740df3466c6db5939b588a25d4aee9ffe0c4a16c9e2d01514","observation_id":"405b14c5-1f36-4cf4-b72f-ee8a77fd869e","resolution":{"observed_at":"2026-05-12T03:56:20.865339Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.10468","last_updated":"2026-05-11T12:34:20Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T10:39:37.475240Z","submitted_at":"2026-05-11T12:34:20Z","title":"Can Muon Fine-tune Adam-Pretrained Models?"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":0,"metadata_mismatch":16,"parse_uncertain":0,"unresolved":17,"verified_exact":5,"verified_fuzzy":51},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 3 inbound Pith citation observations for arXiv:2605.10468."}